Remote Data Engineer (Big Data) - Spark & Databricks

METRICA

United States

Remote

USD 23,000 - 38,000

Full time

5 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

En Métrica España buscamos un/a Data Engineer con al menos 3 años de experiencia en entornos Big Data para diseñar, desarrollar y optimizar procesos distribuidos utilizando Apache Spark, PySpark y Azure Databricks. El rol implica colaborar con clientes y equipos, y aplicar IA para revisión de código y pruebas.

Se ofrece contrato indefinido, salario competitivo y oportunidades de desarrollo profesional. Trabajo 100% remoto, con flexibilidad horaria y proyectos de alto impacto tecnológico.

Qualifications

  • Experiencia demostrable de al menos 3 años en Data Engineering, Big Data o desarrollo de soluciones de procesamiento distribuido.
  • Experiencia sólida con Apache Spark y PySpark.
  • Conocimientos avanzados de optimización en Spark: Particionado y shuffles; Persistencia y caché; DAG y stages; Gestión de memoria; Optimización de ejecución y rendimiento.
  • Dominio de Python aplicado al tratamiento y procesamiento de datos.
  • Experiencia con PySpark, Pandas y NumPy.
  • Experiencia en diseño y desarrollo de procesos ETL/ELT, pipelines de datos y datasets.
  • Experiencia con Azure Databricks y Delta Lake.
  • Conocimientos de procesamiento de datos columnar con Pandas UDF, Vectorized UDF y Apache Arrow.
  • Experiencia o conocimientos en algoritmos distribuidos e iterativos.
  • Uso práctico de herramientas de IA para desarrollo de software, como GitHub Copilot, GenAI o LLMs, orientado a agilizar revisiones, pruebas y validaciones.
  • Capacidad para comunicarse de manera técnica, clara y eficaz con cliente y equipos multidisciplinares.

Responsibilities

  • Diseño, desarrollo y mantenimiento de procesos de datos distribuidos con Apache Spark y PySpark.
  • Desarrollo y optimización de pipelines ETL/ELT y diseño de datasets escalables.
  • Análisis y mejora del rendimiento de procesos Spark: particionado, shuffles, persistencia, caché, ejecución de DAG, stages y gestión de memoria.
  • Desarrollo de soluciones de procesamiento columnar mediante Pandas UDF, Vectorized UDF y Apache Arrow.
  • Desarrollo y mantenimiento de soluciones en Azure Databricks y Delta Lake.
  • Optimización de workloads, tiempos de ejecución, consumo de recursos y costes asociados a los procesos de datos.
  • Aplicación de algoritmos distribuidos e iterativos para el procesamiento de grandes volúmenes de información.
  • Uso de técnicas de Approximate Computing, como HyperLogLog, Bloom Filters, sketching y estadísticas de streaming, cuando sea necesario.
  • Uso de herramientas de IA aplicadas al desarrollo ---GenAI, Copilot y LLMs--- para revisión de código, generación de pruebas, validación y mejora de la productividad.
  • Colaboración directa con cliente y equipos técnicos para la toma de requisitos, definición de soluciones y comunicación del avance técnico.
  • Documentación técnica de los desarrollos, pipelines y procesos implementados.
  • Identificación y propuesta de mejoras continuas en calidad, eficiencia, rendimiento y robustez.

Skills

Apache Spark
PySpark
Python
Azure Databricks
Delta Lake
ETL/ELT
Pandas
NumPy
AI-assisted development
Spark optimization

Tools

Azure Databricks
Delta Lake
Pandas
NumPy
GitHub Copilot
GenAI
LLMs

Job description

En Métrica España buscamos un/a Data Engineer con al menos 3 años de experiencia en entornos Big Data para diseñar, desarrollar y optimizar procesos distribuidos utilizando Apache Spark, PySpark y Azure Databricks. El rol implica colaborar con clientes y equipos, y aplicar IA para revisión de código y pruebas.

Se ofrece contrato indefinido, salario competitivo y oportunidades de desarrollo profesional. Trabajo 100% remoto, con flexibilidad horaria y proyectos de alto impacto tecnológico.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Data Engineer Big Data (Spark / PySpark / Azure Databricks)
Data Engineer Big Data (Spark / PySpark / Azure Databricks)

METRICA • United States

On-site
USD 23,000 - 38,000
Remote Data Engineer: PySpark, Databricks & SQL
Remote Data Engineer: PySpark, Databricks & SQL

METRICA • United States

Remote
USD 110,000 - 150,000
Data Engineer PySpark / Databricks – 100% Teletrabajo
Data Engineer PySpark / Databricks – 100% Teletrabajo

METRICA • United States

Remote
USD 110,000 - 150,000
Senior Data Engineer: Azure Databricks, Growth & Mentorship
Senior Data Engineer: Azure Databricks, Growth & Mentorship

Apex Global Mobility • United States

Remote
USD 120,000 - 170,000
Remote Data Engineer: ELT, Spark & Databricks
Remote Data Engineer: ELT, Spark & Databricks

Builth Wells • United States

Remote
USD 73,000 - 123,000
Remote Data Engineer - Microsoft Fabric & PySpark
Remote Data Engineer - Microsoft Fabric & PySpark

Tamarind Intelligence • United States

Remote
USD 110,000 - 160,000
Remote work
Formación continua
Equipo consolidado
+1
Senior Data Engineer (Databricks) - Remote, Flexible Hours
Senior Data Engineer (Databricks) - Remote, Flexible Hours

BairesDev • Peru (IL)

On-site
USD 120,000 - 180,000
Remote work 100%
USD or local currency payout
Work-from-home setup
+2
Desarrollador Python & PySpark - 100% Remoto
Desarrollador Python & PySpark - 100% Remoto

Grupo TECDATA Engineering • United States

Remote
USD 38,000 - 47,000
Teletrabajo 100%
Data Engineer | Ingestión de Datos & Big Data (Remote)
Data Engineer | Ingestión de Datos & Big Data (Remote)

Tecdata Engineering • United States

Remote
USD 32,000 - 39,000
Senior Data Engineer (Remote) — Databricks on AWS/Azure
Senior Data Engineer (Remote) — Databricks on AWS/Azure

Datapao • United States

Remote
USD 94,000 - 148,000
Remote UK
Databricks training
Flexible PTO