Remote Databricks Data Engineer | Azure & Power BI

Capgemini Engineering

Aguascalientes

A distancia

MXN 600.000 - 900.000

Jornada completa

14 días+
Generador de candidaturas

Una candidatura hecha para este puesto de trabajo: un currículum y una carta de presentación adaptados que responden directamente a la oferta.

Supera los filtros ATS

Ventajas ofrecidas por este puesto de trabajo

Flexible work arrangements
Continuous learning opportunities

Descripción de la vacante

Capgemini Engineering is seeking a MID -Data Engineer- to design, build, and optimize scalable data pipelines and analytics solutions on the Databricks platform. You will leverage Python, SQL, and cloud services to transform and load data for analytics across engineering, manufacturing, and supply chain domains.

The role focuses on data replication, ETL/ELT development, governance, and collaboration with data scientists to enable ML workloads in a distributed environment.

Formación

  • Bachelor’s degree in computer science, engineering, or related field.
  • Hands-on experience with data engineering or big data development.
  • Strong knowledge of SQL, Oracle, or SQL Server.
  • Experience with Databricks Platform and Apache Spark (PySpark/Scala).
  • Proficiency in Python and SQL; familiarity with Delta Lake and data lake architecture.
  • Cloud experience (Azure, AWS, or GCP) and data orchestration tools (Azure Data Factory, Airflow).
  • Understanding of data warehousing concepts and version control (Git).

Responsabilidades

  • Design, develop, and support data replication and integration solutions using HVR.
  • Build and maintain scalable data pipelines with Databricks (Spark, Delta Lake).
  • Develop and optimize ETL/ELT processes for structured and unstructured data.
  • Ensure data quality, integrity, and performance across large datasets.
  • Implement data models and transformations for analytics and reporting.
  • Collaborate with data scientists and analysts for advanced analytics and ML workloads.
  • Integrate data from databases, APIs, and streaming systems.
  • Optimize Spark jobs for performance and cost efficiency.
  • Implement data governance, security, and access controls.
  • Monitor and troubleshoot data pipelines and production issues.
  • Support CI/CD pipelines and DevOps practices for data engineering workflows.
  • Assist data migration and modernization initiatives.
  • Ensure data quality, governance, security, and compliance.
  • Create operational documentation and runbooks.
  • Participate in production support and performance tuning activities.

Conocimientos

Databricks Platform
Python
SQL
Spark
Delta Lake
Azure
Power BI
Tableau
Git
CI/CD

Educación

Bachelor’s degree in computer science or engineering

Herramientas

Databricks Platform
Delta Lake
Azure Data Factory
Airflow
Git
CI/CD tooling
Power BI
Tableau

Descripción del empleo

Capgemini Engineering is seeking a MID -Data Engineer- to design, build, and optimize scalable data pipelines and analytics solutions on the Databricks platform. You will leverage Python, SQL, and cloud services to transform and load data for analytics across engineering, manufacturing, and supply chain domains.

The role focuses on data replication, ETL/ELT development, governance, and collaboration with data scientists to enable ML workloads in a distributed environment.

Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Remote Data Engineer – Databricks & Cloud Pipelines
Remote Data Engineer – Databricks & Cloud Pipelines

Capgemini • Aguascalientes

Presencial
MXN 520.000 - 760.000
Data Engineer
Data Engineer

Capgemini Engineering • Aguascalientes

Presencial
MXN 600.000 - 900.000
Flexible work arrangements
Continuous learning opportunities
Data Engineer - Hybrid: Azure, Databricks & Data Lakes
Data Engineer - Hybrid: Azure, Databricks & Data Lakes

Capgemini • Ciudad de México

Híbrido
MXN 420.000 - 720.000
Sr Data Engineer
Sr Data Engineer

Capgemini Engineering • Aguascalientes

Presencial
MXN 600.000 - 900.000
Flexible work location
Learning opportunities
Senior Data Engineer - Azure Databricks & Lakehouse
Senior Data Engineer - Azure Databricks & Lakehouse

Capgemini • Ciudad de México

Presencial
MXN 750.000 - 1.100.000
Remote Databricks Data Engineer — End-to-End Pipelines
Remote Databricks Data Engineer — End-to-End Pipelines

BairesDev • Veracruz

Presencial
MXN 1.188.000 - 1.867.000
Remote work 100%
USD compensation or local currency
Home office setup
+4
Databricks Ops Engineer — PySpark & L2 Production Support
Databricks Ops Engineer — PySpark & L2 Production Support

Capgemini • Aguascalientes

Presencial
MXN 520.000 - 760.000
Ingeniero de Datos Azure Databricks | Lakehouse & Big Data
Ingeniero de Datos Azure Databricks | Lakehouse & Big Data

Capgemini • Ciudad de México

Híbrido
MXN 600.000 - 900.000
Senior Data Engineer - PySpark, Databricks & Spark
Senior Data Engineer - PySpark, Databricks & Spark

Improving • México

Presencial
MXN 600.000 - 900.000
Remote Senior Data Engineer - Lakehouse & Spark
Remote Senior Data Engineer - Lakehouse & Spark

Capgemini Engineering • Aguascalientes

Presencial
MXN 600.000 - 900.000
Flexible work location
Learning opportunities