Une candidature sur mesure pour ce poste — un CV personnalisé et une lettre de motivation qui correspondent directement à l’offre.
ALTEN recherche un Data Engineer sénior pour renforcer son pôle Data & Analytics. Vous concevrez et déploierez des pipelines de données robustes avec Databricks, PySpark et DBT, et veillerez à l’optimisation des traitements ETL/ELT et à la modélisation des données.
Vous collaborerez avec Data Scientists et métiers, automatiserez les déploiements via CI/CD et contribuerez à l’évolution de l’architecture data du groupe, avec des solutions cloud et une forte attention RGPD et sécurité.
Leader de l’Ingénierie et des IT Services, présent dans plus de 30 pays, le groupe ALTEN accompagne la stratégie de développement de ses clients dans les domaines de l’innovation, de la R&D et des systèmes d'information technologiques.
Plus qu’un poste, découvrez l’aventure qui vous attend au sein d’une entreprise engagée.
Pour renforcer son pôle Data & Analytics, la Direction des Solutions Technologiques du groupe ALTEN, leader mondial de l’ingénierie et du conseil en technologies, recrute un Data Engineer senior spécialisé en modélisation de données et traitement massivement parallèle. Ce poste, placé sous la responsabilité du Responsable Data Platform, s’inscrit dans une dynamique d’innovation et de transformation digitale pour accompagner nos clients dans la valorisation de leurs données.
Missions principales
Concevoir et déployer des pipelines de données robustes et scalables à l’aide de Databricks, PySpark et DBT, pour alimenter des environnements d’analyse et de machine learning.
Optimiser les performances des traitements ETL/ELT en exploitant les bonnes pratiques de data modeling (schémas en étoile, en flocon, etc.) et les capacités distribuées de Spark.
Collaborer avec les Data Scientists et les équipes métiers pour comprendre les besoins et livrer des jeux de données fiables, documentés et prêts à l’emploi.
Automatiser le déploiement et la maintenance des pipelines via des outils CI/CD (GitLab, Jenkins, etc.) et garantir leur monitoring (Airflow, Prometheus, etc.).
Contribuer à l’évolution de l’architecture data du groupe, en intégrant des solutions cloud (AWS, Azure ou GCP) et en veillant à la conformité RGPD et aux normes de sécurité.
Intervenir en tant qu’expert technique pour résoudre les problèmes complexes liés à la qualité, la latence ou la volumétrie des données.
Documenter les processus, les schémas de données et les bonnes pratiques pour faciliter la maintenance et l’onboarding des nouveaux membres de l’équipe.
Diplôméd’une école d’ingénieurs ou titulaire d’un Master (Bac+5)
Minimum 4ans d’expérience(hors alternance)
Maîtrise de PySpark (optimisation, UDFs, DataFrames).
Expérience confirmée avec Databricks (Delta Lake, Spark SQL, clusters).
Pratique avancée de DBT (modélisation, tests, documentation).
Connaissance des bases de données (SQL, NoSQL) et des entrepôts cloud (Snowflake, BigQuery, Redshift).
Familiarité avec les outils de versioning (Git) et les environnements DevOps.
Capacité à travailler en équipe pluridisciplinaire.
Rigueur, autonomie et sens de l’innovation.
Excellente communication technique et fonctionnelle.
Maîtrise professionnelle de l'anglais