Site Reliability Engineer (W/M)

Thales

Valbonne

Sur place

EUR 75 000 - 110 000

Plein temps

Il y a 4 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Une candidature sur mesure pour ce poste — un CV et une lettre de motivation personnalisés qui correspondent à l’offre.

Passez les filtres ATS

Résumé du poste

Thales recherche un Ingénieur Site Reliability Engineer à Sophia Antipolis pour assurer un haut niveau de service d’une solution télécom cloud. Vous concevrez l’infrastructure, piloterez les SLO/SLI et piloterez les infrastructures via CI/CD.

Vous participerez aux rotations d’astreinte 24/7 et améliorerez la fiabilité et l’évolutivité de la plateforme. Le poste nécessite des compétences Java, Docker/Kubernetes, Jenkins/GitLab et Datadog, avec une expérience en Cloud public et en bases NoSQL.

Qualifications

  • Au moins 5 ans d'expérience en tant que SRE.
  • Compétences en développement Java.
  • Vous êtes familier avec le Cloud Public (GCP, AWS), les conteneurs et microservices (Docker, Kubernetes, Java), CI/CD et automatisation (Jenkins, GitLab, Helm), bases de données NoSQL.
  • Vous êtes fluent en anglais.

Responsabilités

  • Automatisation & Infrastructure as Code : Concevoir, construire et maintenir une infrastructure évolutive en utilisant des outils tels que Terraform, Ansible et Kubernetes. Développer des pipelines CI/CD automatisés via GitLab pour réduire le travail manuel répétitif.
  • Disponibilité & Ingénierie de la Fiabilité : Définir et surveiller les Objectifs de Niveau de Service (SLO) et les Indicateurs de Niveau de Service (SLI). Gérer les "Error Budgets" afin d'équilibrer la vitesse d'intégration des nouvelles fonctionnalités avec la stabilité de la plateforme.
  • Gestion des Incidents & Support en Astreinte : Participer aux rotations d’astreinte 24/7 pour fournir une réponse d’urgence et effectuer des diagnostics approfondis des problèmes en production.
  • Performance & Planification de la Capacité : Réaliser des analyses de performance système, identifier les goulets d’étranglement et planifier la capacité pour garantir que l’infrastructure supporte la croissance et les pics de charge.
  • Observabilité & Monitoring : Mettre en œuvre et affiner les alertes basées sur les symptômes et des stratégies de surveillance complètes en utilisant des plateformes comme Datadog, afin d’assurer une visibilité élevée sur la santé du système.
  • Amélioration Continue & Postmortems : Animer des revues sans blâme après incidents pour identifier les causes profondes et mettre en place des corrections techniques pérennes afin de prévenir la récurrence.
  • Sécurité & Conformité : Collaborer avec les équipes de sécurité cloud pour appliquer les bonnes pratiques de sécurité, gérer les contrôles d’accès et répondre aux incidents ou vulnérabilités de sécurité.
  • Support de la relation client
  • Interface avec d’autres parties prenantes pour définir un plan d’amélioration de la solution
  • Vous aurez la responsabilité de la disponibilité du service de la solution.

Connaissances

Java
Cloud public
NoSQL
Anglais
CI/CD

Formation

Ingénieur ou équivalent

Outils

Docker
Kubernetes
Jenkins
GitLab
Helm
Datadog

Description du poste

Lieu : Sophia Antipolis, France

Construisons ensemble un avenir de confiance

Thales est un leader mondial des hautes technologies spécialisé dans trois secteurs d’activité : Défense & Sécurité, Aéronautique & Spatial, et Cyber & Digital. Il développe des produits et solutions qui contribuent à un monde plus sûr, plus respectueux de l’environnement et plus inclusif. Le Groupe investit près de 4,5 milliards d’euros par an en Recherche & Développement, notamment dans des domaines clés de l’innovation tels que l’IA, la cybersécurité, le quantique, les technologies du cloud et la 6G. Thales compte près de 85 000 collaborateurs dans 65 pays.

Nos engagements, vos avantages
  • Une réussite portée par notre excellence technologique, votre expérience et notre ambition partagée
  • Un package de rémunération attractif
  • Un développement des compétences en continu : parcours de formation, académies et communautés internes
  • Un environnement inclusif, bienveillant et respectant l’équilibre des collaborateurs
  • Un engagement sociétal et environnemental reconnu
Votre quotidien

Au coeur de la Silicon Valley de la région PACA, notre site regroupe nos activités développe des sonars de pointe équipant les sous-marins et les bâtiments de surface ainsi que des activités de services numériques. Pionnier dans le domaine des produits de simulation, le site mobilise une expertise approfondie en acoustique et en traitement du signal.

Nous recherchons un Ingénieur Site Reliability Engineer afin d'assurer un haut niveau de service et d'excellence opérationnelle pour le développement d'une solution télécom innovante et ambitieuse (forte disponibilité, contraintes de haute performance) déployée dans le cloud public.

Ce produit nécessite la mise en place d'une équipe SRE dédiée.

Fonctions Essentielles
  • Automatisation & Infrastructure as Code : Concevoir, construire et maintenir une infrastructure évolutive en utilisant des outils tels que Terraform, Ansible et Kubernetes. Développer des pipelines CI/CD automatisés via GitLab pour réduire le travail manuel répétitif.
  • Disponibilité & Ingénierie de la Fiabilité : Définir et surveiller les Objectifs de Niveau de Service (SLO) et les Indicateurs de Niveau de Service (SLI). Gérer les "Error Budgets" afin d'équilibrer la vitesse d'intégration des nouvelles fonctionnalités avec la stabilité de la plateforme.
  • Gestion des Incidents & Support en Astreinte : Participer aux rotations d’astreinte 24/7 pour fournir une réponse d’urgence et effectuer des diagnostics approfondis des problèmes en production.
  • Performance & Planification de la Capacité : Réaliser des analyses de performance système, identifier les goulets d’étranglement et planifier la capacité pour garantir que l’infrastructure supporte la croissance et les pics de charge.
  • Observabilité & Monitoring : Mettre en œuvre et affiner les alertes basées sur les symptômes et des stratégies de surveillance complètes en utilisant des plateformes comme Datadog, afin d’assurer une visibilité élevée sur la santé du système.
  • Amélioration Continue & Postmortems : Animer des revues sans blâme après incidents pour identifier les causes profondes et mettre en place des corrections techniques pérennes afin de prévenir la récurrence.
  • Sécurité & Conformité : Collaborer avec les équipes de sécurité cloud pour appliquer les bonnes pratiques de sécurité, gérer les contrôles d’accès et répondre aux incidents ou vulnérabilités de sécurité.
  • Support de la relation client
  • Interface avec d’autres parties prenantes pour définir un plan d’amélioration de la solution
  • Vous aurez la responsabilité de la disponibilité du service de la solution.
Votre Profil
Formation Ingénieur Ou Équivalent Vous Disposez
  • Au moins 5 ans d'expérience en tant que SRE
  • Compétences en développement Java requises.
  • Vous êtes familier avec le Cloud Public (GCP, AWS), les conteneurs et microservices (Docker, Kubernetes, Java), CI/CD et automatisation (Jenkins, GitLab, Helm), bases de données NoSQL.
  • Vous êtes fluent en anglais.
Certification

La certification Architecte Cloud GCP est un plus.

  • Vous avez déjà mis en place la surveillance produit et l’infrastructure sous-jacente.
  • Vous avez une expérience de développement dans un contexte de systèmes distribués et/ou de haute disponibilité.
  • Vous êtes familier avec le développement de microservices.
  • Vous avez participé à la définition d’architectures, structures de données, algorithmes avec des contraintes de performance, sécurité, fiabilité, etc.
  • Certification architecte cloud public.
  • Vous vous intéressez aux aspects Site Reliability Engineer : CI/CD, automatisation, monitoring et observabilité, amélioration continue.
  • Vous êtes un ingénieur développeur accompli, polyvalent et capable de gérer plusieurs tâches.

Thales, entreprise Handi-Engagée, reconnait tous les talents. La diversité est notre meilleur atout.

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Site Reliability Engineer (F/H)
Site Reliability Engineer (F/H)

Thales • La Ciotat

Sur place
EUR 45 000 - 60 000
Ingénieur SRE (F/H)
Ingénieur SRE (F/H)

Thales • La Ciotat

Sur place
EUR 70 000 - 100 000
Ingénieur logiciel DevOps F/H
Ingénieur logiciel DevOps F/H

Thales • Valbonne

Sur place
EUR 60 000 - 90 000
Responsable Engineering – Site Reliability Engineering (SRE) H/F
Responsable Engineering – Site Reliability Engineering (SRE) H/F

Thales • La Ciotat

Sur place
EUR 90 000 - 120 000
Ingénieur Plateforme DevOps
Ingénieur Plateforme DevOps

Thales • Rennes

Sur place
EUR 65 000 - 90 000
Ingénieur Cloud-DevOps (H/F)
Ingénieur Cloud-DevOps (H/F)

Thales • Valbonne

Sur place
EUR 65 000 - 90 000
Formation continue
Équilibre vie pro/perso
Environnement inclusif
Ingénieur Cloud & DevSecOps (H/F)
Ingénieur Cloud & DevSecOps (H/F)

Thales • Toulouse

Hybride
EUR 55 000 - 85 000
Restaurant d'entreprise
Espaces verts et terrasses
Campus Labège
+2
Ingénieur CloudOps Confirmé - H/F
Ingénieur CloudOps Confirmé - H/F

Thales • Rennes

Sur place
EUR 70 000 - 100 000
Rémunération attractive
Formation continue
Environnement inclusif
+1
Software Solutions Engineer – Java Fullstack / React (F/H)
Software Solutions Engineer – Java Fullstack / React (F/H)

Thales • Valbonne

Sur place
EUR 45 000 - 65 000
Rémunération attractive
Développement des compétences
Environnement inclusif
+1
Ingénieur Cloud GCP H/F
Ingénieur Cloud GCP H/F

Thales • Vélizy-Villacoublay

Sur place
EUR 55 000 - 90 000
Rémunération attractive
Formation continue
Environnement inclusif
+1