Pular para o conteúdo
InícioPT · EN · ES · JA · ZH

Visão geral

O Data Pump lê os snapshots que a AWS já tira do seu RDS e monta um datalake consultável no Athena. Nada se conecta ao banco de produção — nem para descobrir quais tabelas existem.

Analisar dados de um Postgres em produção normalmente exige uma escolha ruim: rodar query analítica no banco que atende a aplicação, manter uma réplica, ou instalar CDC. Todas cobram algo — concorrência, configuração no banco, um agente para manter, uma rota de rede que vira exceção de segurança.

O snapshot já existe. A AWS o tira todo dia, e o custo do backup já está na fatura. O Data Pump parte dele.

Um pipeline que dispara sozinho quando um snapshot fica pronto, e um console para operar tudo — ambos rodando na sua conta AWS. Seus dados não passam pela CO2 Lab em momento nenhum.

Origem Snapshots automáticos ou manuais, da própria conta ou de outra
Formato Parquet, catalogado no Glue
Consulta Athena, ou qualquer coisa que leia o Glue Data Catalog
Operação Console web, na sua VPC, atrás de login

O Data Pump é licenciado por instalação e não tem instalador genérico. Cada instalação começa por um handoff com a CO2 Lab, onde definimos conta, região, VPC, bucket e contas de origem — e você recebe um pacote montado para esse cenário.

O motivo é que essas decisões mudam quais recursos o template declara, então não podem ser tomadas na hora de instalar. Veja instalar para o que é definido no handoff.

Não é open source e não está no AWS Marketplace. Para contratar: contato@co2lab.io.

  • Como funciona — o caminho do dado, do snapshot ao SELECT
  • Requisitos — o que precisa existir na conta antes do handoff
  • Instalar — o handoff e o passo a passo

Se o banco de origem está em outra conta AWS, veja banco em outra conta — isso precisa ser definido no handoff, porque acrescenta permissões ao template.