Démarquez-vous pour ce poste — générez un CV et une lettre de motivation personnalisés en environ une minute.
GLOBE GROUPE FRANCE recherche un ingénieur Data expérimenté pour fiabiliser et opérer sa plateforme data moderne. Vous travaillerez sur une stack comprenant Snowflake, dbt, Airflow et Airbyte, avec un écosystème FastAPI, React et PostgreSQL.
Vous renforcerez l’observabilité, standardiserez les processus et contribuerez à l’industrialisation du pipeline d’entity resolution, tout en assurant une documentation et une sécurité améliorées.
Vous rejoignez l’équipe Data Groupe pour fiabiliser, opérer et faire évoluer une plateforme data moderne, utilisée par plusieurs équipes et business units.
5 ans minimum d’expérience en data engineering ou data platform.Expérience significative sur une plateforme data en production, utilisée par plusieurs équipes, business units ou clients.Maîtrise du SQL : modélisation, optimisation, gestion des droits/RBAC.Très bonne maîtrise de dbt en contexte industrialisé : modèles incrémentaux, tests, packages, CI/CD, documentation.Solide expérience d’Airflow, idéalement en version 2.x ou 3.x.Connaissance des bonnes pratiques d’orchestration : datasets/assets, patterns de factory, monitoring des DAGs.Expérience avec un outil d’ingestion managé type Airbyte ou Fivetran.Pratique confirmée de Python : qualité de code, tests, maintenabilité.Culture DevOps réelle : Kubernetes, Helm, GitOps/ArgoCD, CI/CD, gestion des secrets, environnements multiples.Réflexe config-as-code et security by design : changements versionnés, revus, reproductibles et documentés.Autonomie, rigueur et capacité à simplifier les systèmes existants.Français courant et anglais professionnel, notamment pour la documentation et les livrables groupe.Nice to haveExpérience d’un semantic layer ou d’une couche métriques gouvernée : dbt metrics, MetricFlow, Cube ou équivalent.Expérience de migration depuis un existant BI : DAX, Tabular, Power BI.Connaissance de l’entity resolution ou du MDM : Splink, dédoublonnage probabiliste, golden records.Pratique de l’observabilité data : Elementary, Monte Carlo, Grafana.Expérience sur des catalogues de données : OpenMetadata, DataHub.Expérience d’instrumentation de workloads LLM en production : OpenAI Batch, Langfuse, suivi des coûts, évaluation.Notions de FastAPI et de React pour contribuer ponctuellement aux produits data internes.Expérience en environnement multi-tenant, retail, SaaS B2B ou CPG.Connaissance de Terraform.Contribution à des choix d’architecture warehouse : tenancy, optimisation des coûts, structuration des environnements