Ir al contenido
InicioPT · EN · ES · JA · ZH

Data Pump

Data Pump lee los snapshots que AWS ya toma de tu RDS y arma un datalake consultable en Athena. Nada se conecta a la base de datos de producción — ni siquiera para descubrir qué tablas existen.

Analizar datos de un Postgres en producción normalmente exige una mala elección: ejecutar consultas analíticas en la base que atiende a la aplicación, mantener una réplica, o instalar CDC. Todas cobran algo — concurrencia, configuración en la base, un agente que mantener, una ruta de red que se convierte en una excepción de seguridad.

El snapshot ya existe. AWS lo toma todos los días, y el costo del backup ya está en la factura. Data Pump parte de ahí.

Un pipeline que se dispara solo cuando un snapshot queda listo, y una consola para operarlo todo — ambos ejecutándose en tu cuenta AWS. Tus datos no pasan por CO2 Lab en ningún momento.

Origen Snapshots automáticos o manuales, de la propia cuenta o de otra
Formato Parquet, catalogado en Glue
Consulta Athena, o cualquier cosa que lea el Glue Data Catalog
Operación Consola web, en tu VPC, detrás de un login

Data Pump se licencia por instalación y no tiene instalador genérico. Cada instalación empieza por un handoff con CO2 Lab, donde definimos cuenta, región, VPC, bucket y cuentas de origen — y recibes un paquete armado para ese escenario.

El motivo es que esas decisiones cambian qué recursos declara la plantilla, así que no pueden tomarse a la hora de instalar. Mira instalar para lo que se define en el handoff.

No es open source y no está en el AWS Marketplace. Para contratar: contato@co2lab.io.

  • Cómo funciona — el camino del dato, del snapshot al SELECT
  • Requisitos — qué debe existir en la cuenta antes del handoff
  • Instalar — el handoff y el paso a paso

Si la base de origen está en otra cuenta AWS, mira base en otra cuenta — eso necesita definirse en el handoff, porque agrega permisos a la plantilla.