Data Engineer · Yom Full time

Get on Board

Santiago

Hybrid

CLP 60,000,000 - 90,000,000

Full time

21 hours ago
Be an early applicant
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Benefits offered by this job

Modalidad híbrida
Vacaciones extras
Beneficios de deporte/educación

Job summary

Get on Board busca un Data Engineer para diseñar, construir y operar pipelines de integración desde ERP y APIs hacia PostgreSQL en AWS. Se responsabilizará de ETL/ELT en Python, validación de calidad de datos y migración de sistemas heredados, trabajando con Data Intelligence.

Se valorará experiencia en Cuadrar cifras, contratos de datos, y coordinación con equipos de data science, producto e ingeniería. Modalidad híbrida y foco en data de consumo masivo y distribución B2B.

Qualifications

  • Experiencia de 5+ años en roles de datos o 3+ años como Data Engineer construyendo pipelines en producción.
  • Conocimiento profundo de Python para procesamiento de datos y tests automatizados.
  • SQL avanzado en PostgreSQL, modelado, índices y cargas incrementales.

Responsibilities

  • Diseñar, construir y operar pipelines de integración desde ERP/APIs/webhooks hasta PostgreSQL en AWS.
  • Escribir procesos ETL/ELT en Python, migrando pipelines heredados al nuevo stack.
  • Definir contratos de datos y validar calidad en cada etapa del pipeline.
  • Gestionar accesos y credenciales con mínimo privilegio y documentar flujos operativos.
  • Trabajar con data science, producto e ingeniería para alimentar el motor de recomendaciones.

Skills

Python
SQL
Airflow
ETL/ELT
PostgreSQL
AWS
Data quality
NoSQL MongoDB
CI/CD
Inglés técnico

Tools

AWS
PostgreSQL
Airflow
Glue
Docker

Job description

Tu misión será diseñar, integrar y operar los flujos de datos de nuestros clientes, asegurando calidad, trazabilidad y cifras que cuadren con el origen. Reportarás al Líder de Inteligencia.

Detrás de cada almacén, ferretería o botillería hay una familia que queremos ayudar a vender más y estar mejor abastecida. Y todo comienza con datos confiables y oportunos.

Somos obsesivos con la precisión: si el ERP registra 100 ventas y nosotros vemos 98, buscamos las 2 faltantes. Un dato incorrecto afecta decisiones comerciales y la experiencia de los usuarios de nuestro Agente Conversacional.

Hoy estamos transformando nuestra tecnología: unificamos el stack, estandarizamos integraciones desde ERPs, SFTP y APIs, e incorporamos validaciones de calidad en cada etapa.

Es una prioridad estratégica de la compañía, con recursos asignados, y buscamos a quien lidere este desafío junto al equipo de Data Intelligence.

Lo que vas a hacer
  • Diseñar, construir y operar pipelines de integración desde el origen de cada cliente (ERPs, APIs REST, webhooks, SFTP, VPN, archivos en S3) hasta PostgreSQL en AWS RDS.
  • Escribir procesos ETL y ELT en Python, orquestados con Apache Airflow. Migrar los pipelines legados (AWS Glue y flujos heredados) al nuevo stack.
  • Definir contratos de datos declarativos por cliente y entidad: esquema, tipos, vocabularios, ventanas de entrega y umbrales de cuarentena.
  • Implementar reglas de calidad por dimensión (completitud, validez, unicidad, integridad referencial, consistencia, oportunidad) y verificar que cada transformación preserve los invariantes del dato.
  • Diseñar el modelo de datos, versionarlo con migraciones y hacer el onboarding de clientes nuevos.
  • Construir la observabilidad del pipeline: hallazgos de calidad por corrida, alertas y detección de fallas silenciosas, como el proceso que termina “con éxito” sin haber recibido un solo archivo.
  • Cuadrar nuestras cifras con las del cliente, explicar cada diferencia y arreglar la causa en el pipeline.
  • Gestionar accesos y credenciales de procesos y cuentas de servicio con mínimo privilegio.
  • Documentar flujos, contratos de datos y procedimientos operativos.
  • Trabajar con data science, producto e ingeniería en los datos que alimentan el motor de recomendaciones y la plataforma.
Lo que buscamos
Experiencia
  • 5+ años en roles de datos, o 3+ años como Data Engineer construyendo y operando pipelines en producción.
Python y SQL
  • Python avanzado para procesamiento de datos (pandas), con tests automatizados (pytest). SQL avanzado en PostgreSQL: modelado, índices, planes de ejecución y cargas incrementales (upserts).
Calidad y contratos de datos
  • Validación de datos con esquemas y contratos (pandera, pydantic, Great Expectations o similares). Criterio para pensar la calidad del dato desde el diseño del pipeline.
  • AWS: S3, RDS y al menos un servicio de procesamiento (Glue, Lambda, Batch o ECS).
  • Diseñaste integraciones batch y streaming (eventos, webhooks, CDC o colas de mensajes). Migraste pipelines entre plataformas sin detener la operación. Manejas migraciones de esquema y versionamiento del modelo de datos. Diseñas software desacoplado y mantenible (SOLID, arquitectura hexagonal o similar). Trabajaste con bases NoSQL, en particular MongoDB. Conoces contenedores y CI/CD. Integraste ERPs (SAP u otros) y entiendes su modelo comercial: facturas, pedidos, catálogo y clientes. Usas IA aplicada al desarrollo (Claude Code, MCP u otras): agentes, subagentes, skills y flujos automatizados con LLMs. Te sientes cómodo/a levantando requerimientos directo con los equipos técnicos de los clientes. Documentas tus decisiones y sabes explicar un problema de datos a alguien que no es técnico. Conoces la industria de consumo masivo, distribución o e-commerce B2B. Lees inglés técnico sin problema (documentación, librerías, cursos).
Lo que te ofrecemos
  • Pipelines reales en producción, con ownership de punta a punta. Un equipo en crecimiento, con stack moderno y uso intensivo de IA en el día a día.
  • Modalidad híbrida y horario flexible.
  • Beneficios de deporte, educación, compra de equipo y días administrativos.
  • 5 días extras de vacaciones
  • Cultura horizontal y cercana.

Somos una empresa que busca habilitar el crecimiento y la prosperidad de los almaceneros de barrio a través de la digitalización de la cadena de valor comercial en el canal tradicional mediante soluciones tecnológicas.— YOM's full profile

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Data Engineer
Data Engineer

NeuralWorks • Santiago

Hybrid
CLP 24,000,000 - 40,000,000
MacBook Air M2
Bonos por desempeño
Bonos de almuerzo y almuerzo de equipo
+8
Data Engineer - CL
Data Engineer - CL

Imagemaker • Lo Barnechea

On-site
CLP 50,000,000 - 75,000,000
3 días libres al año adicionales a tus
Vacaciones extendidas
Permiso sin goce de sueldo
+8
Senior Data Engineer
Senior Data Engineer

Banco Falabella • Santiago

On-site
CLP 39,060,000 - 72,540,000
Ingeniero de Datos
Ingeniero de Datos

Api UX • Santiago

Hybrid
CLP 27,900,000 - 42,408,000
Día libre en tu cumpleaños
Seguro médico
Seguro de vida
+2
Data Quality Engineer
Data Quality Engineer

Inmetrics LATAM • Santiago

On-site
CLP 18,000,000 - 30,000,000
Seguro de salud Complementario
Seguro de Vida y dental
Tarjeta de alimentación
+5
Data Engineer
Data Engineer

Stefanini Latam • Santiago

On-site
CLP 334,800 - 502,200
Modalidad Hibrida
Ingeniero de Datos
Ingeniero de Datos

Apiux Tech • Santiago

Hybrid
CLP 20,088,000 - 35,712,000
Día libre por cumpleaños
Seguro médico
Seguro dental
+1
Data engineer
Data engineer

CONKORD • Santiago

On-site
CLP 900,000 - 1,300,000
Seguro de salud
Vida
Flexibilidad laboral
+2
Data Engineer
Data Engineer

Publicis Groupe ANZ • Santiago

On-site
CLP 24,552,000 - 40,176,000
Seguro de vida y salud
Formato mixto
Oficinas en Las Condes
+5
Data Engineer
Data Engineer

Publicis Groupe • Santiago

On-site
CLP 20,088,000 - 33,480,000
Seguro de salud
Días libres extra
Pluxee alimentación
+3