Data Engineer

Amaris Consulting

Lima Metropolitana

Presencial

PEN 302.000 - 436.000

Jornada completa

Hace 8 días
Generador de candidaturas

Consigue una respuesta de este empleador — un currículum y una carta de presentación adaptados exactamente a lo que busca para contratar.

Supera los filtros ATS

Descripción de la vacante

Amaris Consulting en Lima busca un Data Engineer para diseñar y operar pipelines de datos en producción, construir arquitecturas lakehouse en AWS y Databricks, y entregar productos de datos confiables para analítica, BI e IA.

Se valorará experiencia de 5 años en ingeniería de datos, dominio de CDC log-based, Delta Lake, Unity Catalog y herramientas de orquestación; y capacidad para trabajar en migraciones y cumplimiento normativo de protección de datos.

Formación

  • Bachiller o titulado en Ingeniería de Sistemas o afines.
  • Más de 5 años de experiencia en ingeniería de datos.
  • Experiencia en pipelines en producción y entornos cloud.
  • Conocimiento de gobernanza y protección de datos.
  • Dominio de SQL avanzado y procesamiento distribuido.

Responsabilidades

  • Diseñar pipelines de ingesta CDC log-based desde Oracle, PostgreSQL y MySQL.
  • Implementar arquitecturas lakehouse con Databricks, Delta Lake y AWS.
  • Definir métricas de calidad y certificar productos de datos.
  • Trabajar en modelado físico de tablas y tuning de consultas.
  • Migrar cargas legacy hacia Lakehouse y mantener paralelismo para validación.
  • Preparar tablas gold para BI.
  • Gestionar datos personales con governanza y seudonimización.
  • Cumplir normativa peruana de protección de datos.

Conocimientos

Data engineering
CDC ingestion
Delta Lake
Databricks
AWS
SQL avanzado
CI/CD
Governance de datos

Educación

Bachiller otitulado en Ingeniería de Sistemas
Especialización en ingeniería de datos

Herramientas

Lakeflow Connect
Unity Catalog
Delta Lake
Apache Iceberg
Apache Hudi
Git
CI/CD

Descripción del empleo

Lleva tu carrera al siguiente nivel como Data Engineer en Lima, diseñando y operando pipelines de datos en producción, construyendo arquitecturas lakehouse sobre AWS y Databricks, y preparando productos de datos confiables para analítica, BI e inteligencia artificial.

Tus funciones
  • Diseñar pipelines de ingesta CDC log-based desde bases de datos transaccionales como Oracle, PostgreSQL y MySQL, utilizando Lakeflow Connect sobre AWS.
  • Implementar arquitecturas medallón con Databricks, Delta Lake, S3 y Unity Catalog, mediante pipelines declarativos y jobs.
  • Definir expectativas de calidad para cada pipeline y publicar sus métricas para certificar los productos de datos.
  • Trabajar en el modelado físico de las tablas y en el rendimiento de las consultas dentro de Databricks.
  • Migrar cargas y flujos analíticos legacy hacia la plataforma lakehouse, manteniendo los pipelines antiguo y nuevo en paralelo hasta demostrar la paridad de resultados.
  • Preparar las tablas gold para BI y otros casos de consumo de datos.
  • Construir y operar los pipelines del modelo canónico de persona, incluyendo matching, deduplicación y survivorship, de acuerdo con el diseño del Arquitecto de Data y las reglas de mapeo definidas por Gobierno de Datos. El trabajo comenzará con el primer dominio de negocio priorizado.
  • Clasificar los datos personales según su nivel de sensibilidad y aplicar las reglas de tratamiento correspondientes a cada destino.
  • Implementar la seudonimización de datos antes de cualquier ruta hacia soluciones de inteligencia artificial generativa, de acuerdo con la ley peruana de protección de datos personales.
Perfil requerido
  • Bachiller o titulado en Ingeniería de Sistemas, Ciencias de la Computación, Ingeniería Informática o carreras afines.
  • Especialización o diplomado en ingeniería de datos, big data o arquitecturas cloud.
  • Más de 5 años de experiencia en ingeniería de datos, construyendo y operando pipelines en producción.
  • Más de 3 años trabajando con procesamiento distribuido de datos, cargas batch y streaming, y SQL avanzado.
  • Más de 2 años de experiencia con arquitecturas lakehouse o medallón y formatos como Delta Lake, Apache Iceberg o Apache Hudi.
  • Experiencia con replicación CDC log-based desde Oracle, PostgreSQL o MySQL.
  • Experiencia en migraciones de cargas ETL legacy o warehouses analíticos hacia plataformas lakehouse.
  • Experiencia con Git, CI/CD, pruebas automatizadas, revisión por pares y despliegue de código de datos.
  • Conocimiento de Databricks, Unity Catalog, pipelines declarativos, jobs, orquestación, calidad de datos y tuning de consultas para BI.
  • Experiencia trabajando con datos personales en entornos regulados, incluyendo clasificación, gobierno, linaje y seudonimización. Se valoran conocimientos de Oracle, PL/SQL y normativa peruana de protección de datos personales.
  • Comunidad internacional con más de 110 nacionalidades.
  • Plan de formación y desarrollo con nuestra Academia interna.
  • Entorno colaborativo, con eventos internos y cultura de mejora continua.
  • Fuerte compromiso con la Responsabilidad Social Empresarial a través de WeCare Together.

Amaris Consulting se compromete a promover la diversidad dentro de su equipo y a crear un entorno de trabajo inclusivo. Se consideran todas las candidaturas de personas calificadas, independientemente de su género, orientación sexual, raza, etnia, creencias, edad, estado civil, discapacidad u otras características.

Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Ingeniero de Datos
Ingeniero de Datos

CONFIDENCIAL • Miraflores

Híbrido
PEN 90.000 - 150.000
Trabajo híbrido
EPS compartidos
Buen clima laboral
Ingeniero de datos
Ingeniero de datos

Frice La • Lima Metropolitana

Híbrido
PEN 60.000 - 100.000
Hybrid work (2 días/semana)
Ingeniero de Datos
Ingeniero de Datos

Experis Perú • San Isidro

Híbrido
PEN 70.000 - 110.000
Planilla completa
Beneficios legales
Trabajo híbrido Miraflores
+2
Data Engineer
Data Engineer

NTT DATA Europe & Latam • Trujillo

Presencial
PEN 90.000 - 150.000
Bono alimentación
Descuentos corporativos
Contrato indefinido
+3
Cloud Data Architect | Microsoft Fabric & Azure
Cloud Data Architect | Microsoft Fabric & Azure

NTT DATA Europe & Latam • Trujillo

Presencial
PEN 150.000 - 230.000
Contrato indefinido desde el primer dí
Capacitación y certificaciones MICROSO
EPS cubierta al 100%
+3
Ingeniero de datos
Ingeniero de datos

frice-la • Lima Metropolitana

Presencial
Data Steward
Data Steward

Indra Group • Lima Metropolitana

Híbrido
PEN 60.000 - 100.000
Udemy acceso
Descuentos corporativos
Asesoría con psicólogo/nutricionista
+1
Data Fullstack Developer
Data Fullstack Developer

Indra Group • Lima Metropolitana

Híbrido
PEN 90.000 - 150.000
Seguro EPS cubierto al 100%
Seguro Vida Ley
Programa de Certificaciones
+2
Data Strategy Analyst
Data Strategy Analyst

Nestlé • San Isidro

Presencial
PEN 60.000 - 100.000
Data Engineer Semisenior (AWS)
Data Engineer Semisenior (AWS)

EVOL (TSnet) • Lima Metropolitana

Híbrido
PEN 60.000 - 90.000
EPS cubierta al 100%
Formación profesional
Horario L-V
+2