Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.
ALTEN recrute un Data Engineer senior pour renforcer le pôle Data & Analytics de la Direction des Solutions Technologiques. Concevoir et déployer des pipelines robustes avec Databricks, PySpark et DBT pour alimenter les environnements d’analyse et de ML.
Vous travaillerez avec les Data Scientists et les équipes métiers pour livrer des jeux de données fiables et documentés, optimiser les ETL/ELT et automatiser le déploiement via CI/CD tout en assurant le monitoring et la conformité RGPD.
Leader de l’Ingénierie et des IT Services, présent dans plus de 30 pays, le groupe ALTEN accompagne la stratégie de développement de ses clients dans les domaines de l’innovation, de la R&D et des systèmes d'information technologiques.
Plus qu’un poste, découvrez l’aventure qui vous attend au sein d’une entreprise engagée.
Pour renforcer son pôle Data & Analytics, la Direction des Solutions Technologiques du groupe ALTEN, leader mondial de l’ingénierie et du conseil en technologies, recrute un Data Engineer senior spécialisé en modélisation de données et traitement massivement parallèle. Ce poste, placé sous la responsabilité du Responsable Data Platform, s’inscrit dans une dynamique d’innovation et de transformation digitale pour accompagner nos clients dans la valorisation de leurs données.
Missions principales
Concevoir et déployer des pipelines de données robustes et scalables à l’aide de Databricks, PySpark et DBT, pour alimenter des environnements d’analyse et de machine learning.
Optimiser les performances des traitements ETL/ELT en exploitant les bonnes pratiques de data modeling (schémas en étoile, en flocon, etc.) et les capacités distribuées de Spark.
Collaborer avec les Data Scientists et les équipes métiers pour comprendre les besoins et livrer des jeux de données fiables, documentés et prêts à l’emploi.
Automatiser le déploiement et la maintenance des pipelines via des outils CI/CD (GitLab, Jenkins, etc.) et garantir leur monitoring (Airflow, Prometheus, etc.).
Contribuer à l’évolution de l’architecture data du groupe, en intégrant des solutions cloud (AWS, Azure ou GCP) et en veillant à la conformité RGPD et aux normes de sécurité.
Intervenir en tant qu’expert technique pour résoudre les problèmes complexes liés à la qualité, la latence ou la volumétrie des données.
Documenter les processus, les schémas de données et les bonnes pratiques pour faciliter la maintenance et l’onboarding des nouveaux membres de l’équipe.
Diplôméd’une école d’ingénieurs ou titulaire d’un Master (Bac+5)
Minimum 4ans d’expérience(hors alternance)
Maîtrise de PySpark (optimisation, UDFs, DataFrames).
Expérience confirmée avec Databricks (Delta Lake, Spark SQL, clusters).
Pratique avancée de DBT (modélisation, tests, documentation).
Connaissance des bases de données (SQL, NoSQL) et des entrepôts cloud (Snowflake, BigQuery, Redshift).
Familiarité avec les outils de versioning (Git) et les environnements DevOps.
Capacité à travailler en équipe pluridisciplinaire.
Rigueur, autonomie et sens de l’innovation.
Excellente communication technique et fonctionnelle.
Maîtrise professionnelle de l'anglais