Data Engineer (ML & LLM Focus)

Improving South America

Perú

Presencial

USD 90.000 - 150.000

Jornada completa

hace 4 horas
Sé de los primeros/as/es en solicitar esta vacante

Recibe más respuestas de empleadores

Envía un currículum específico para el puesto de trabajo en cuestión de minutos.

Ventajas ofrecidas por este puesto de trabajo

Clases de inglés
Equipo Apple
Presupuesto libros
Bonos anuales
Cursos online

Descripción de la vacante

Improving South America busca un perfil de datos para desarrollar soluciones basadas en datos y pipelines ETL/ELT, limpiando datasets crudos y transformándolos para analytics.

Se espera experiencia en Python, Pandas y SQL, con capacidad para diseñar modelos y desplegarlos como servicios. Se valora Azure, Databricks y enfoque en ML/LLMs. Contrato a largo plazo, 100% remoto y crecimiento profesional.

Formación

  • Inglés intermedio-avanzado imprescindible.
  • Python sólido con manipulación de datos real.
  • Experiencia con Pandas para leer, joins, agregaciones y deduplicación.
  • SQL sólido con joins y filtros.
  • Capacidad para parsear CSV, JSON anidado y logs.
  • Experiencia construyendo pipelines ETL/ELT.

Responsabilidades

  • Desarrollar e implementar soluciones basadas en datos para resolver problemas de negocio complejos.
  • Limpiar, preprocesar y analizar datasets crudos.
  • Diseñar y desplegar pipelines de datos (ETL/ELT).
  • Construir y desplegar modelos de ML (valorada experiencia en optimización).
  • Desarrollar e integrar soluciones con LLMs.
  • Aplicar arquitectura cloud y microservicios para servir modelos como servicios web.
  • Colaborar con equipos multifuncionales y entregar insights accionables.
  • Tomar ownership total de las tareas y entregar resultados de alta calidad.

Conocimientos

Inglés avanzado
Python
Pandas
SQL
ETL/ELT
Azure
Databricks
Arquitectura Cloud

Herramientas

Azure Data Factory (ADF)
Databricks

Descripción del empleo

En Improving South America, brindamos servicios de TI para transformar la percepción del profesional de TI. Nos enfocamos en consultoría de TI, desarrollo de software y formación ágil.

La empresa promueve una cultura de trabajo excepcional basada en el trabajo en equipo, la excelencia y la diversión, con enfoque en crecimiento personal y recompensas compartidas. Al integrarse, el/la candidato/a formará parte de una comunidad que prioriza la comunicación abierta y relaciones laborales sólidas a largo plazo, respaldada por una estructura de desarrollo profesional y aprendizaje continuo.

Funciones del cargo
  • Desarrollar e implementar soluciones basadas en datos para resolver problemas de negocio complejos.
  • Limpiar, preprocesar y analizar datasets crudos o desordenados antes de escribir código.
  • Diseñar, construir y desplegar pipelines de datos (ETL/ELT) para ingesta y preparación de datos, cubriendo el flujo completo: raw data → transformación → datasets listos para analytics.
  • Construir y desplegar modelos de Machine Learning (se valora experiencia con algoritmos de optimización).
  • Desarrollar e integrar soluciones que aprovechen Large Language Models (LLMs).
  • Aplicar conceptos de arquitectura cloud y microservicios para desplegar algoritmos como servicios web.
  • Colaborar con equipos multifuncionales para definir requerimientos de proyecto, traducir problemas de negocio en soluciones técnicas y entregar insights accionables.
  • Tomar ownership total de las tareas asignadas: clarificar requerimientos ambiguos desde el inicio y entregar resultados de alta calidad.
Requerimientos del cargo
  • Inglés Intermedio- avanzado o avanzado (indispensable)
  • Python sólido: fundamentos reales de manipulación de datos y manejo de archivos, no solo uso de librerías.
  • Experiencia práctica con Pandas (o librería equivalente) para leer archivos, hacer joins, agregaciones, filtrado y deduplicación de datos.
  • SQL sólido: joins, filtros, operadores lógicos (NOT, AND, OR, etc.).
  • Capacidad de parsear y trabajar con distintos formatos de datos crudos (CSV, JSON anidado, logs de texto).
  • Experiencia construyendo pipelines ETL/ELT para limpieza y preparación de datos.
  • Experiencia hands‑on con Azure (ADF, Databricks) o un stack cloud equivalente (AWS, GCP).
  • Comprensión de arquitectura cloud y microservicios para desplegar modelos/algoritmos como servicios web.
  • Capacidad de análisis: entender los datos antes de programar, y explicar un plan de solución antes de ejecutar.
Opcionales
  • Experiencia construyendo y desplegando modelos de Machine Learning en producción.
  • Conocimiento de algoritmos de optimización.
  • Experiencia integrando LLMs (LangChain, RAG, APIs de modelos como Azure OpenAI, Vertex AI, etc.).
  • C# — no excluyente. Priorizamos la capacidad de resolver problemas de datos de forma eficiente; un dominio fuerte de Python es buena señal de que la persona puede adaptarse a C# si el proyecto lo requiere.
Condiciones
  • Contrato a largo plazo.
  • 100% Remoto.
  • Vacaciones y PTOs
  • Posibilidad de recibir 2 bonos al año.
  • 2 revisiones salariales al año.
  • Clases de inglés.
  • Equipamiento Apple.
  • Plataforma de cursos en linea
  • Budget para compra de libros.
  • Budget para compra de materiales de trabajo
  • mucho mas..
Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Data Scientist
Data Scientist

Improving South America • Perú

Presencial
USD 80.000 - 120.000
Vacaciones y PTOs
Bonos al año
Clases de inglés
+2
Back-end Engineer (Java)
Back-end Engineer (Java)

Improving South America • Perú

Presencial
USD 130.000 - 170.000
Contrato a largo plazo
100% Remoto
Vacaciones y PTOs
+8
Senior Java Backend Engineer - Remote & AI-Driven
Senior Java Backend Engineer - Remote & AI-Driven

Improving South America • Perú

Presencial
USD 130.000 - 170.000
Contrato a largo plazo
100% Remoto
Vacaciones y PTOs
+8
Data Architect
Data Architect

Bluetab, an IBM Company • San Isidro

Presencial
PEN 90.000 - 150.000
Contrato indefinido
Formación continua
Plan de carrera
+3
Data Engineer - Azure
Data Engineer - Azure

INDRA PERU • Lima Metropolitana

Híbrido
PEN 90.000 - 150.000
EPS 100%
Udemy accceso aprendizaje
Descuentos corporativos
+4
Machine Learning Engineer
Machine Learning Engineer

NTT DATA Europe & Latam • Lima Metropolitana

Presencial
PEN 70.000 - 110.000
Carrera profesional
Contrato indeterminado
EPS 100%
+4
Ingeniero de Datos
Ingeniero de Datos

INTEGRATION & QUALITY PROJECT MANAGEMENT S.A.C. - IQ PROJECT S.A.C. • Lima Metropolitana

Híbrido
PEN 70.000 - 110.000
Ingreso a planilla MYPE desde el día 1
Modalidad híbrida (1–2 días pres. por
Data Engineer (AZURE) - Outsourcing
Data Engineer (AZURE) - Outsourcing

SEIDOR • Lima Metropolitana

Presencial
PEN 60.000 - 120.000
Data Engineer – SQL & Python
Data Engineer – SQL & Python

Solera • Surquillo

Presencial
PEN 80.000 - 110.000
Planilla desde día uno
EPS cubierta 80%
Proyecto estratégico de transformación
Data Engineer Senior
Data Engineer Senior

Apex Global Mobility • Perú

Presencial
PEN 90.000 - 130.000