Spark Software Engineer - AI/LLMs & Data Pipelines

Hitachi, Ltd.

Región Centro

Presencial

MXN 1.004.000 - 1.562.000

Jornada completa

Hace 5 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Transforma esta oferta en una entrevista — un currículum y una carta de presentación creados pensando en lo que quiere el empleador.

Supera los filtros ATS

Ventajas ofrecidas por este puesto de trabajo

Exciting Projects
Collaborative Environment
Work-Life Balance
Professional Development
Excellent Benefits

Descripción de la vacante

GlobalLogic is seeking a skilled Data Engineer to join our team in Mexico. You will develop and maintain tools to upgrade Apache Spark versions, build robust data validation pipelines, and write clean, scalable code for data processing utilities.

You will explore AI models to aid migrations, work with large-scale data systems, and collaborate with a global team to ensure data parity, performance, and quality across projects.

Formación

  • Experience: 4–8 years in professional software development.
  • Strong proficiency in Java and/or Python.
  • Hands-on experience with Apache Spark and Hadoop ecosystem.
  • Exposure to AI tools, methodologies, and LLMs, esp. Gemini models/APIs.
  • Proven experience in testing, debugging, and maintaining batch or streaming data pipelines.
  • Nice to have: Cloud environments like Google Cloud Platform / Dataproc.
  • Familiarity with unit testing frameworks and CI/CD pipelines for data engineering.
  • Experience with automated data diffing or validation tools.

Responsabilidades

  • Develop and maintain automated tools and scripts to facilitate and accelerate Spark version upgrades.
  • Design and execute data validation pipelines and data quality checks post-upgrade to ensure parity, integrity, and performance.
  • Write clean, scalable, maintainable code for data processing or toolchain utilities.
  • Explore and integrate AI models and methodologies to assist in code assessment, error detection, or translation tasks during migrations.

Conocimientos

Java
Python
Apache Spark
Hadoop ecosystem
Google Gemini
Data pipelines testing
GCP / Dataproc
Unit testing frameworks
CI/CD pipelines
Automated data validation

Herramientas

CI/CD tools

Descripción del empleo

GlobalLogic is seeking a skilled Data Engineer to join our team in Mexico. You will develop and maintain tools to upgrade Apache Spark versions, build robust data validation pipelines, and write clean, scalable code for data processing utilities.

You will explore AI models to aid migrations, work with large-scale data systems, and collaborate with a global team to ensure data parity, performance, and quality across projects.

Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

Software Engineer- Apache spark
Software Engineer- Apache spark

Hitachi, Ltd. • Región Centro

Presencial
MXN 1.004.000 - 1.562.000
Exciting Projects
Collaborative Environment
Work-Life Balance
+2
Senior Data Engineer: Databricks, GCP & AI Pipelines
Senior Data Engineer: Databricks, GCP & AI Pipelines

AgileEngine, LLC. • Monterrey

Presencial
MXN 900.000 - 1.300.000
Professional growth
Competitive compensation
A selection of exciting projects
+1
Senior Data & Analytics Engineer: Build Scalable Pipelines
Senior Data & Analytics Engineer: Build Scalable Pipelines

Agileengine • Región Centro

Híbrido
MXN 600.000 - 900.000
Professional growth
Competitive USD-based compensation
A selection of exciting projects
+1
Senior Data Engineer - Lakehouse Platform & Pipelines
Senior Data Engineer - Lakehouse Platform & Pipelines

Arkham Technologies • Ciudad de México

Presencial
MXN 900.000 - 1.300.000
Data Engineer - Databricks, GCP & AI Workflows
Data Engineer - Databricks, GCP & AI Workflows

AgileEngine, LLC. • León

Presencial
MXN 600.000 - 900.000
Professional growth
Competitive compensation
A selection of exciting projects
+1
Data Engineer — Flextime & Databricks/GCP Pipelines
Data Engineer — Flextime & Databricks/GCP Pipelines

Agileengine • Monterrey

Híbrido
MXN 1.273.000 - 2.182.000
Professional growth
Competitive compensation (USD)
Exciting projects
+1
Remote Lead Data Engineer - AI & Big Data Solutions
Remote Lead Data Engineer - AI & Big Data Solutions

EDM S. DE RL DE CV • San Pedro Garza García

A distancia
MXN 900.000 - 1.300.000
GenAI & ML Scientist – Enterprise Analytics with LLMs
GenAI & ML Scientist – Enterprise Analytics with LLMs

Softtek • México

Presencial
MXN 900.000 - 1.200.000
Senior Backend Engineer: Cloud-Native Java & API Expert
Senior Backend Engineer: Cloud-Native Java & API Expert

Hitachi, Ltd. • Región Centro

Presencial
MXN 300.000 - 500.000
Exciting Projects
Collaborative Environment
Work-Life Balance
+2
On-site Data Engineer 2: Cloud Pipelines & Spark
On-site Data Engineer 2: Cloud Pipelines & Spark

Jones Lang LaSalle Incorporated • México

A distancia
MXN 600.000 - 900.000