Data Engineer F/H H/F

GROUPE M6

Île-de-France

Sur place

EUR 55 000 - 75 000

Plein temps

14 jours+
Générateur de candidature

Une candidature complète en une minute — un CV et une lettre de motivation personnalisés, prêts à être envoyés.

Passez les filtres ATS

Résumé du poste

GROUPE M6 recherche un ingénieur data pour concevoir et opérer des pipelines de données robustes sur AWS et développer des traitements optimisés en Python. Vous analyserez des volumes importants issus de l'adserver, du CRM et des audiences, et vous productionnerez des KPI pour divers départements.

Vous travaillerez sur des modèles de données solides (datalake raw → golden) avec Parquet/Delta Lake/Iceberg et consoliderez l’écosystème Spark pour des workloads distribués.

Qualifications

  • Diplôme Bac+5 minimum en Data Engineering, Mathématiques appliquées, Statistiques ou domaine équivalent.
  • Expérience de 2 ans minimum en data engineering; l’expérience dans le secteur des médias est un plus.

Responsabilités

  • Concevoir et opérer des pipelines de données robustes sur AWS (S3, Glue, Athena, MWAA, EMR, ECS).
  • Optimiser la performance et la gouvernance sur l’ensemble du cycle de vie (monitoring, coûts, sécurité IAM).
  • Analyser des données volumineuses issues de l'adserver, du CRM, des audiences et de la radio pour produire des insights actionnables.
  • Développer des traitements optimisés et industrialisables en Python (Pandas, PySpark, AWS Wrangler).
  • Produire et optimiser du SQL avancé pour les analyses et pipelines (CTE, window, performance tuning, partitionnement).
  • Gérer et optimiser les traitements Spark pour gérer les téraoctets du datalake.
  • Construire des KPI métier pour la régie publicitaire, le CRM, la radio et les équipes audiences.
  • Mettre en place des modèles de données solides (datalake raw → golden), avec Parquet, Iceberg ou Delta Lake.

Connaissances

Python
Data engineering
SQL
Spark
Pandas
PySpark
AWS Wrangler
Parquet
Delta Lake
Iceberg
Terraform

Formation

Bac+5 en Data Engineering / Mathématiques appliquées / Statistiques

Outils

S3
Glue
Athena
MWAA
EMR
ECS

Description du poste

Le Groupe M6 est l'un des groupes audiovisuels les plus importants de France, avec un portefeuille de chaînes comprenant M6, W9, 6ter, Gulli, Paris Première, Téva, ainsi que des stations de radio (RTL, RTL2, Fun Radio) et des services numériques. Le Groupe M6 est à la pointe de l’innovation numérique et de la transformation des médias, avec un engagement fort dans l’exploitation des données pour améliorer l’expérience utilisateur et optimiser ses revenus publicitaires.

Responsabilités
  • Concevoir et opérer des pipelines de données robustes sur AWS (S3, Glue, Athena, MWAA, EMR, ECS).
    Optimiser la performance et la gouvernance sur l’ensemble du cycle de vie (monitoring, coûts, sécurité IAM).
  • Analyser des données volumineuses issues de l'adserver, du CRM, des audiences et de la radio pour produire des insights actionnables.
  • Développer des traitements optimisés et industrialisables en Python (Pandas, PySpark, AWS Wrangler).
  • Produire et optimiser du SQL avancé pour les analyses et pipelines (CTE, window, performance tuning, partitionnement).
  • Gérer et optimiser les traitements Spark pour gérer les téraoctets du datalake.
  • Construire des KPI métier pour la régie publicitaire, le CRM, la radio et les équipes audiences.
  • Mettre en place des modèles de données solides (datalake raw → golden), avec Parquet, Iceberg ou Delta Lake.
Collaboration et innovation
  • Collaborer avec les data scientists pour élaborer des produits et services prédictifs robustes.
  • Effectuer une veille scientifique et technologique pour nourrir les innovations au sein du groupe.
  • Accompagner les équipes métier (régie publicitaire, streaming, CRM, études TV) dans l’exploitation des insights data.
Qualifications
  • Diplôme Bac+5 minimum en Data Engineering, Mathématiques appliquées, Statistiques ou domaine équivalent (École d’ingénieur ou Master spécialisé).
  • Expérience de 2 ans minimum en data engineering; l’expérience dans le secteur des médias est un plus.
Compétences techniques
  • Expertise en Python et en data engineering.
  • Maîtrise avancée de Python appliqué au traitement de données (Pandas, PySpark, AWS Wrangler), structuration de projets, optimisation des performances et bonnes pratiques de développement.
  • Très bon niveau en SQL pour interroger, transformer et optimiser des datasets volumineux (CTE, window functions, tuning, broadcast join).
  • Expérience solide des environnements cloud – AWS, comprenant S3, Glue, Athena, Lambda, MWAA, ECS, IAM et la gestion du datalake en zones (raw → golden).
  • Industrialisation et orchestration des pipelines.
  • Compétence confirmée dans la création et la gestion de pipelines avec MWAA, incluant la mise en production, la surveillance, l’optimisation et la fiabilité des workflows.
  • Traitement de données à grande échelle et maîtrise de Spark (optimisation, partitionnement) pour les workloads distribués, et utilisation avancée de Pandas pour les traitements.
  • Expérience avec les formats modernes et transactionnels : Parquet, Delta Lake, Iceberg.
  • Connaissance des données CRM/ADserveur ainsi que Terraform est un plus.
Compétences personnelles
  • Excellente capacité de modélisation, d’analyse et de synthèse.
  • Curiosité intellectuelle et forte appétence pour l’innovation.
  • Sens pédagogique et capacité à vulgariser des concepts complexes.
  • Autonomie et esprit d’initiative.
  • Capacité à travailler en équipe multidisciplinaire.
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Data Engineer F/H H/F
Data Engineer F/H H/F

Groupe M6 • France

Sur place
EUR 45 000 - 60 000
Media Data Engineer - AWS Pipelines & Insights
Media Data Engineer - AWS Pipelines & Insights

GROUPE M6 • Île-de-France

Sur place
EUR 55 000 - 75 000
Stage | Assistant(e) Data Analyst – Audiences & CRM H/F
Stage | Assistant(e) Data Analyst – Audiences & CRM H/F

Groupe M6 • Nanterre

Sur place
Stage: Data & CRM Analytics Intern
Stage: Data & CRM Analytics Intern

Groupe M6 • Nanterre

Sur place
Data Engineer
Data Engineer

Azira Europe • Paris

Sur place
EUR 45 000 - 65 000
Data Engineer H/F
Data Engineer H/F

MP DATA • Paris

Sur place
EUR 40 000 - 55 000
Accompagnement personnalisé
Projets à forte valeur ajoutée
Environnement technique moderne
Data Engineer – Plateforme Data Engineering (H/F)
Data Engineer – Plateforme Data Engineering (H/F)

ALTEN • Boulogne-Billancourt

Sur place
EUR 50 000 - 70 000
Data Engineer & Data Architect - Senior Consultant
Data Engineer & Data Architect - Senior Consultant

JAKALA • Paris

Hybride
EUR 70 000 - 100 000
Centre Paris et Caen
Télétravail possible
Mutuelle d’entreprise
+4
CDI - Data Engineer confirmé - H/F
CDI - Data Engineer confirmé - H/F

Médiaperformances SAS • France

Hybride
EUR 50 000 - 70 000
Télétravail 2/j/semaine
RTT 18 jours
Open space et sport
+3
Lead Analytics Engineer (H-F)
Lead Analytics Engineer (H-F)

M13h • Paris

Sur place
EUR 50 000 - 70 000