Data engineer Spark/Scala - Híbrido (Madrid)

Aubay Spain

Madrid

Híbrido

EUR 50.000 - 75.000

Jornada completa

hace 12 horas
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Transforma esta oferta en una entrevista: un currículum y una carta de presentación creados pensando en lo que quiere el empleador.

Supera los filtros ATS

Ventajas ofrecidas por este puesto de trabajo

Contrato indefinido
Trabajo híbrido (50% teletrabajo)
Ubicación Madrid Río
Formación a medida
Retribución flexible
Seguro médico
Ticket restaurante
Cheque guardería

Descripción de la vacante

Aubay Spain busca un/a Data Engineer para unirse a nuestro equipo y dar soporte, mantenimiento y evolución técnica de una plataforma DataHub clave. Diseñar e implementar pipelines escalables con Scala, Spark y Hadoop, integrando datos de múltiples fuentes y trasladándolos a la capa Raw del DataHub, con controles de calidad.

Participarás en DevOps, Airflow, CI/CD y migración a Cloud. Contrato indefinido en un entorno internacional, modalidad híbrida y oficina en Madrid Río.

Formación

  • Experiencia en diseño e implementación de pipelines de datos con Scala y Spark.
  • Conocimiento de Hadoop, HDFS y Apache Airflow, Oozie y almacenamiento de objetos (S3/COS).
  • Operaciones: Shell scripting y manejo de herramientas CI/CD (GitLab, Jenkins).
  • Experiencia demostrable creando y optimizando pipelines de datos, ETL y pruebas de integración continua.
  • Conocimiento del SDLC y trabajo en marcos Agile.

Responsabilidades

  • Diseñar e implementar pipelines de procesamiento escalables utilizando Scala, Spark, Hadoop y almacenamiento cloud (COS/S3).
  • Realizar modelado de datos para ingesta, transformación y enriquecimiento de grandes volúmenes con reglas de negocio complejas.
  • Integrar datos de múltiples fuentes y formatos en la capa Raw del DataHub, asegurando calidad y consistencia con controles.
  • Dar soporte a producción, resolver incidencias y garantizar disponibilidad de procesos.
  • Implementar orquestación y scheduling con Apache Airflow; configurar CI/CD y ejecutar pruebas unitarias e de validación.
  • Participar en la migración de Hadoop hacia arquitecturas Cloud (Kubernetes, COS, Spark as a Service, Airflow as a Service).
  • Elaborar documentación técnica y operativa; trabajar con un stacks Big Data.

Conocimientos

Scala
Spark
SQL
CI/CD

Herramientas

GitLab
Jenkins
Airflow
Oozie
Hadoop

Descripción del empleo

En Aubay estamos buscando un/a Data Engineer para unirse a nuestro equipo y ser una pieza clave en el soporte, mantenimiento y evolución técnica de una importante plataforma DataHub.

Tus principales responsabilidades
Arquitectura y Desarrollo de Datos:
  • Diseñar e implementar pipelines de procesamiento escalables utilizando Scala, Spark, Hadoop y almacenamiento cloud (COS/S3).
  • Realizar el modelado de datos para la ingesta, transformación y enriquecimiento de grandes volúmenes de datos con reglas de negocio complejas.
  • Integrar datos procedentes de múltiples fuentes y formatos en la capa Raw del DataHub, asegurando la calidad y consistencia mediante controles exhaustivos.
Mantenimiento, Soporte y Optimización:
  • Dar soporte a producción y mantener el DataHub: resolución de incidencias, anomalías y garantía de disponibilidad de los procesos.
  • Modificar y optimizar el código existente para mejorar su rendimiento, seguridad y mantenibilidad aplicando buenas prácticas.
DevOps, Automatización y Cloud:
  • Implementar orquestación y scheduling mediante Apache Airflow.
  • Configurar pipelines de CI/CD para automatizar despliegues, testing y gestión del desarrollo.
  • Desarrollar y ejecutar pruebas unitarias y de validación.
  • Participar en la migración de la infraestructura Hadoop hacia arquitecturas Cloud (Kubernetes, COS, Spark as a Service, Airflow as a Service).
  • Elaborar documentación técnica y operativa del proyecto.
  • Stack Tecnológico: Sólida experiencia con Scala, Spark, SQL y bases de datos estructuradas.
  • Ecosistema Big Data: Conocimiento en Hadoop, HDFS, Apache Airflow, Oozie y almacenamiento de objetos (S3/COS).
  • Operaciones: Shell scripting y manejo de herramientas CI/CD (GitLab, Jenkins o similares).
  • Habilidades técnicas: Experiencia demostrable creando y optimizando pipelines de datos, procesos ETL/calidad, testing unitario e integración continua.
  • Metodología: Conocimiento del ciclo de vida del software (SDLC) y experiencia trabajando bajo marcos Agile.
Valoraremos muy positivamente (Deseables)
  • Experiencia previa en migraciones de Hadoop hacia arquitecturas Cloud.
  • Conocimientos en: Kubernetes/containerización, Dremio, Elasticsearch, Kibana, Kafka (streaming), HashiCorp Vault o Dataiku.
  • Experiencia o conocimiento del sector bancario.
  • Contrato indefinido en un proyecto estable y de larga duración.
  • Modalidad de trabajo híbrida (50% teletrabajo / 50% presencial).
  • Ubicación: Oficinas en Madrid Río.
  • Salario a negociar según la experiencia aportada.
  • Plan de formación a medida (certificaciones técnicas, idiomas, etc.).
  • Desarrollo profesional continuo dentro de un ambiente de trabajo internacional.
  • Plan de Retribución Flexible (seguro médico, ticket restaurante, cheque guardería).

¡No dudes en inscribirte si estás buscando un nuevo reto en el área del dato!

Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

DATA ENGINEER SPARK Y SCALA
DATA ENGINEER SPARK Y SCALA

Aubay Spain • Madrid

Híbrido
EUR 45.000 - 65.000
Contrato indefinido
Modalidad híbrida de trabajo (50% tele
Ubicación: Madrid Río
Hybrid Data Engineer: Spark/Scala for DataHub
Hybrid Data Engineer: Spark/Scala for DataHub

Aubay Spain • Madrid

Híbrido
EUR 50.000 - 75.000
Contrato indefinido
Trabajo híbrido (50% teletrabajo)
Ubicación Madrid Río
+5
Data Engineer: Spark & Scala | Hybrid Madrid
Data Engineer: Spark & Scala | Hybrid Madrid

Aubay Spain • Madrid

Híbrido
EUR 45.000 - 65.000
Contrato indefinido
Modalidad híbrida de trabajo (50% tele
Ubicación: Madrid Río
JUNIOR DATA ENGINEER - ANALITYCS (Hibrido Madrid)
JUNIOR DATA ENGINEER - ANALITYCS (Hibrido Madrid)

Michael Page • Madrid

Híbrido
EUR 30.000 - 40.000
24 días laborables de vacaciones
Compensación de gastos de teletrabajo
Retribución flexible
+5
Senior Data Engineer – Empresa tecnológica
Senior Data Engineer – Empresa tecnológica

Botic Partners • Madrid

Híbrido
EUR 55.000 - 70.000
Contrato indefinido
Modelo híbrido (3 días presenciales en
Salario competitivo
Data Engineer (Java / Spark)
Data Engineer (Java / Spark)

knowmad mood • España

Presencial
EUR 40.000 - 55.000
Horario flexible
22 días de vacaciones + 2 días libres
Retribución flexible
+6
Ingeniero o Ingeniera de Datos
Ingeniero o Ingeniera de Datos

hiberus • Madrid

Presencial
EUR 55.000 - 75.000
Senior Data Engineer (Databricks & PySpark)
Senior Data Engineer (Databricks & PySpark)

SDG Group España • Valencia

Híbrido
EUR 35.000 - 50.000
Crecimiento y plan de carrera
Formación continua
Retribución flexible
Senior Data Engineer (Databricks & PySpark)
Senior Data Engineer (Databricks & PySpark)

SDG Group España • Madrid

Híbrido
EUR 40.000 - 70.000
Flexibilidad laboral
Formación continua
Apoyo económico para el teletrabajo
+1
Ingeniero de datos
Ingeniero de datos

Habla computing • Madrid

Presencial
EUR 35.000 - 50.000
Salario competitivo
Formación técnica continua
Clases de inglés subvencionadas