Responsable Engineering – Site Reliability Engineering (SRE) H/F

Thales

La Ciotat

Sur place

EUR 90 000 - 120 000

Plein temps

Il y a 6 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.

Passez les filtres ATS

Résumé du poste

Thales recherche un Responsable SRE expérimenté pour superviser une équipe de fiabilité et piloter les pratiques d'observabilité à l’échelle des produits Synapse, Jarvis, Oxygen, Photon et Foundations. Vous dirigerez le Cloud Center of Excellence et assurerez l’excellence opérationnelle, l’automatisation et la réduction du MTTR.

Vous interviendrez avec les Product Owners et Engineering Managers pour définir les SLOs, les budgets d’erreur et les plans de croissance, tout en assurant une

Qualifications

  • Diplômé d'un Master 2 en ingénierie ou école d'ingénieurs.
  • Expérience avérée en gestion d'équipes SRE ou plateforme engineering.
  • Solide background en fiabilité, observabilité et systèmes distribués.

Responsabilités

  • Assurer le développement de carrière et le mentoring des ingénieurs SRE.
  • Définir et gouverner les SLOs, budgets d'erreur et cibles de fiabilité.
  • Piloter l'adoption de Datadog et la maturité des runbooks.
  • Co-responsabiliser les engagements de fiabilité avec les Product Owners et Engineering Managers.
  • Orienter l'architecture de fiabilité pour Synapse, Jarvis, Oxygen, Photon et Foundations.

Connaissances

Management d'équipe
SRE / Observabilité
Datadog
SLO / Error budgets
Incidents / MTTR
Cloud (AWS/Azure/GCP)
Kubernetes
Automation
Anglais

Formation

Master 2 en ingénierie

Outils

Datadog
Kubernetes

Description du poste

Vos missions

Lieu : La Ciotat, France

Construisons ensemble un avenir de confiance

Thales est un leader mondial des hautes technologies spécialisé dans trois secteurs d’activité : Défense & Sécurité, Aéronautique & Spatial, et Cyber & Digital. Il développe des produits et solutions qui contribuent à un monde plus sûr, plus respectueux de l’environnement et plus inclusif. Le Groupe investit près de 4 milliards d’euros par an en Recherche & Développement, notamment dans des domaines clés de l’innovation tels que l’IA, la cybersécurité, le quantique, les technologies du cloud et la 6G. Thales compte près de 81 000 collaborateurs dans 68 pays.

Nos engagements, vos avantages
  • Une réussite portée par notre excellence technologique, votre expérience et notre ambition partagée
  • Un package de rémunération attractif
  • Un développement des compétences en continu : parcours de formation, académies et communautés internes
  • Un environnement inclusif, bienveillant et respectant l’équilibre des collaborateurs
  • Un engagement sociétal et environnemental reconnu
Votre quotidien

En nous rejoignant à La Ciotat, vous intégrez un site idéalement localisé sur le littoral méditerranéen, au sein d'un environnement international regroupant nos activités d'identité et de sécurité numériques.

Au sein de Cybersécurité et Identité Numérique (CDI), le Cloud Center of Excellence (CCoE) centralise l'expertise cloud pour accélérer la transformation numérique de Thales.

Le CCoE opère sur Cloud Start, Cloud Boost, et Cloud Scale, au service de plusieurs Business Lines (MCS, PAY, IBS).

Le département SRE protège la santé opérationnelle de cinq produits cœur :

  • Synapse (passerelle IA gérée)
  • Jarvis (tour de contrôle développeur)
  • Oxygen (services de plateforme et API)
  • Photon (services de données et calcul)
  • Foundations (infrastructure et fondations de plateforme)

Le poste dirige les ingénieurs SRE responsables de la fiabilité, de l'observabilité et de l'excellence incident à l'échelle CCoE, avec Datadog comme colonne vertébrale stratégique de l'observabilité.

Vos missions
People Management
  • Assumer le développement de carrière, les revues de performance et le mentorat des ingénieurs SRE
  • Construire des plans de croissance avec un fort développement des capacités Datadog (infra, APM, logs, synthetics, RUM, sécurité, automation)
  • Favoriser les post-mortems sans blâme, la sécurité psychologique et des pratiques d'astreinte durables
  • Équilibrer la préparation aux incidents avec le développement à long terme de l'équipe
Delivery & Strategy
  • S'associer à toutes les équipes produit pour définir et gouverner les SLOs, error budgets et cibles de fiabilité
  • Améliorer la réponse aux incidents et le MTTR via des garde-fous automatisés et la maturité des runbooks
  • Définir les standards de fiabilité et les processus d'excellence opérationnelle
  • Piloter l'adoption et la maturité de Datadog dans l'ensemble de l'organisation
  • Traduire la croissance business en plans de capacité et de résilience opérationnelle
Technical Oversight
  • Orienter l'architecture de fiabilité sur Synapse, Jarvis, Oxygen, Photon et Foundations
  • Garantir une couverture d'observabilité de haute qualité et une intelligence incident fiable
  • Soutenir l'adoption des pratiques avancées Datadog (SLO/error budgets, prévision, détection d'anomalies, corrélation)
  • Agir comme référent technique sans devenir un goulot d'étranglement opérationnel
Cross-functional Collaboration
  • Co-responsabiliser les engagements de fiabilité avec les Product Owners et Engineering Managers
  • Agir comme point de contact exécutif lors des incidents et revues de fiabilité
  • Faire remonter les risques tôt et négocier les compromis innovation vs. stabilité
  • Aligner les pratiques SRE sur le modèle opérationnel délégué du CCoE
Votre profil
  • Vous êtes diplômé d'un Master 2 en ingénierie ou d'une école d'ingénieur
  • Expérience avérée dans la gestion d'équipes SRE ou de plateforme engineering, incluant le management humain direct
  • Solide background en site reliability engineering, observabilité et systèmes distribués
  • Expérience pratique sur Datadog ou plateformes d'observabilité équivalentes à grande échelle
  • Expérience démontrée dans la propriété de cadres SLO, error budgets et gestion d'incidents de production
  • Exposition antérieure aux environnements cloud (AWS/Azure/GCP) et aux plateformes conteneurs (Kubernetes/EKS/AKS)
  • Expérience dans la création d'automatisation opérationnelle, garde-fous et modèles d'auto-réparation
  • Courant en anglais ; le français est un plus
  • Leadership de fiabilité : conception des SLOs, commande d'incidents, boucles d'amélioration post-incident
  • Expertise en observabilité : métriques/logs/traces/signaux utilisateur et qualité d'alerte actionnable
  • Prise de décision opérationnelle sous pression avec une communication claire avec les parties prenantes
  • Influence inter-équipes pour aligner la vélocité engineering sur les standards de fiabilité
  • Discipline d'exécution forte dans les contextes astreinte et critiques pour la production
Idéalement Vous Disposez
  • Expertise avancée de l'écosystème Datadog (gouvernance entreprise, templates réutilisables, workflows)
  • Expérience de support des plateformes centrées sur l'IA et gestion des risques de dépendances tierces
  • Familiarité avec la planification de fiabilité informée par FinOps et compromis coût-performance cloud

Thales, entreprise Handi-Engagée, reconnait tous les talents. La diversité est notre meilleur atout.

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Responsable Engineering – Site Reliability Engineering (SRE) H/F
Responsable Engineering – Site Reliability Engineering (SRE) H/F

Thales Group • La Ciotat

Sur place
EUR 70 000 - 90 000
Environnement inclusif
Développement des compétences
Package de rémunération attractif
Ingénieur SRE (F/H)
Ingénieur SRE (F/H)

Thales • La Ciotat

Sur place
EUR 70 000 - 100 000
Site Reliability Engineer (W/M)
Site Reliability Engineer (W/M)

Thales • Valbonne

Sur place
EUR 75 000 - 110 000
Site Reliability Engineer (F/H)
Site Reliability Engineer (F/H)

Thales • La Ciotat

Sur place
EUR 45 000 - 60 000
Ingénieur Datadog / cloud / Kubernetes (H/F)
Ingénieur Datadog / cloud / Kubernetes (H/F)

Thales • La Ciotat

Sur place
EUR 70 000 - 90 000
Site Reliability Engineer (SRE) F/H
Site Reliability Engineer (SRE) F/H

NUMSPOT • Courbevoie

Sur place
EUR 55 000 - 80 000
Expert(e) Observabilité - Dynatrace - Île-de-France
Expert(e) Observabilité - Dynatrace - Île-de-France

Sopra Steria • Courbevoie

Hybride
EUR 90 000 - 120 000
Télétravail partiel
Mutuelle
Titres restaurants
+2
Ingénieur logiciel DevOps F/H
Ingénieur logiciel DevOps F/H

Thales • Valbonne

Sur place
EUR 60 000 - 90 000
Ingénieur Plateforme DevOps
Ingénieur Plateforme DevOps

Thales • Rennes

Sur place
EUR 65 000 - 90 000
Lead Security (F/H)
Lead Security (F/H)

Thales • La Ciotat

Sur place
EUR 70 000 - 110 000
Rémunération attractive
Formation continue
Environnement inclusif
+1