SRE COMPUTE

Thales Group

Paris

Sur place

EUR 70 000 - 110 000

Plein temps

14 jours+
Générateur de candidature

N’envoyez pas un CV générique — générez un CV et une lettre de motivation adaptés à ce poste précis.

Passez les filtres ATS

Avantages offerts par ce poste

Expérience sur GCP

Résumé du poste

Thales Group recherche un Ingénieur SRE Compute dans le cadre d'un partenariat avec Google Cloud. Vous assurez le maintien en condition opérationnelle, l'exploitation et la gestion des plateformes Compute (GCE, GKE, Vertex AI…), en 24/7 et en astreinte.

Vous participerez à l'amélioration continue, documenterez les flux et collaborerez avec les experts GCP à travers le monde. Diplômé d'une grande école ou Master, vous avez au moins 3 ans d'expérience et un bon niveau d'anglais.

Qualifications

  • Diplômé(e) d'une grande école d'ingénieurs ou titulaire d'un Master.
  • Au moins 3 ans d'expérience en SRE et automatisation.
  • Anglais courant requis; profil junior accepté en alternance.

Responsabilités

  • Monitoring SLI/SLO : surveiller disponibilité, échelle, latence et efficacité des services GCP Compute et traiter les incidents de production.
  • Gestion d'infrastructure : gérer le parc de machines et les stacks compute (Borg, control plane) pour performance optimale.
  • Diagnostic et résolution d'incidents : assurer la fiabilité 24/7 et assurer des astreintes nocturnes par roulement.
  • Collaboration d'équipe : travailler avec des experts GCP à travers le monde pour mitiger et résoudre les incidents.
  • Automation & Connaissance : documenter les connaissances pour uniformiser les flux et améliorer les playbooks.
  • Revues Post-incident : conduire post-mortem et tirer des leçons pour amélioration continue.

Connaissances

SRE
Automatisation

Formation

Master ou diplôme d'ingénieur

Description du poste

QUI SOMMES-NOUS ?

S3NS est né du partenariat industriel entre Thales, leader mondial de la cyber sécurité, et Google Cloud, leader mondial des solutions cloud. Nous avons pour ambition d’offrir le meilleur des deux mondes à l’ensemble des organisations soucieuses de protéger leurs données sensibles (institutions publiques, OIV, OSE…). C’est-à-dire une solution équivalente à Google Cloud Platform (incluant à la fois les services IaaS et PaaS de GCP) et respectant les exigences du label SecNumCloud. Une première offre, ‘Contrôles locaux avec S3NS’, est déjà disponible depuis février 2023 pour permettre à nos clients de bénéficier d’un premier niveau de transparence et contrôles additionnels, et d'accélérer la trajectoire vers le cloud de confiance.

Votre Quotidien

En tant qu'Ingénieur(e) SRE Compute, votre mission sera au cœur de l'exploitation de notre univers GCP : Vous serez responsable du maintien en condition opérationnelle, de l'exploitation et de la gestion de l'ensemble des plateformes Compute (GCE, GKE, Vertex AI…), au sein d'un environnement équivalent à l'univers GCP. Vous gérerez les incidents de production 24h/24 et 7j/7, et développerez une compréhension approfondie des services techniques qui constituent l'épine dorsale des services GCP utilisés par des millions de clients. Grâce à notre partenariat privilégié, Google nous partage ses connaissances et vous ouvre les portes de sa pile technique interne (Borg, Colossus, Spanner, Sawmill, etc.). Vous bénéficierez d'un programme de formation accéléré et intensif, dispensé au contact direct des experts Google et de nos équipes S3NS déjà formées par leurs soins, pour maîtriser des technologies d'exception habituellement réservées aux ingénieurs internes de Google.

Responsabilités Clés :
  • Monitoring SLI/SLO : Surveiller la disponibilité, l'évolutivité, la latence et l'efficacité des services souverains GCP liés au COMPUTE en traitant les incidents de production.
  • Gestion d'Infrastructure : Gérer le parc de machines et les stacks de compute sous-jacentes (Borg et les différents control plane de Google) pour garantir une performance optimale.
  • Diagnostic et Résolution d'incidents : Garantir la fiabilité maximale de la plateforme. Afin d'assurer un maintien en condition opérationnelle 24/7 de notre cloud, le poste implique des permanences en journée ainsi que des astreintes de nuit par roulement.
  • Collaboration d'équipe : Collaborer avec des experts des services GCP à travers le monde pour aider à mitiger et à résoudre les incidents.
  • Automatisation & Connaissance : Documenter les connaissances pour s'assurer que tous les SRE S3NS travaillent avec la même information, standardiser les flux de résolution et améliorer les playbooks opérationnels.
  • Revues Post-incident : Après un incident, réunir les équipes pour effectuer un post-mortem, comprendre les causes, tirer des leçons et encourager l'amélioration continue.

Conformément aux exigences de qualification SecNumCloud de nos services, délivrée par l'ANSSI, ce poste est soumis à des exigences de sécurité renforcées. Le candidat retenu devra se soumettre à une enquête de sécurité menée par nos services, conformément à notre politique de sécurité du personnel.

Votre Profil Ce qui vous passionne et vous motive :
  • L'innovation technologique, le Cloud, et l'exploitation de services et d'infrastructures en mode "as code".
  • L'excellence opérationnelle à grande échelle : L'exploitation et la haute disponibilité (≥ 99,99 %) de bases de données critiques et de moteurs analytiques à forte volumétrie.
  • L'ADN de l'ingénierie Compute chez Google : La curiosité d'explorer comment un hyperscaler gère des millions de cœurs et l'envie de maîtriser plus de 20 ans d'innovation en systèmes distribués (GCE, GKE, Borg, Colossus, Spanner, etc.).
  • L'impact au sein d'un collectif d'experts : La perspective de rejoindre une équipe spécialisée au cœur des enjeux Compute (parc de machines, control plane, virtualisation et orchestration).
Expérience :

Diplômé(e) d'une école d'ingénieur ou titulaire d'un Master. Au moins 3 ans d'expérience en SRE et automatisation des opérations. Poste ouvert aux profils juniors justifiant d'une expérience significative en alternance dans un périmètre similaire. Exposition à un environnement international avec un bon niveau d’anglais requis.

Bonus:
  • Une expérience précédente sur GCP est un plus mais votre soif d'apprendre notre propre Cloud est primordiale !

Le mot de l'équipe « Envie de rejoindre une équipe passionnée à taille humaine ? Intégrez notre équipe SRE Compute : un collectif de 7 ingénieurs au cœur du moteur de notre cloud de confiance. Votre mission est critique : piloter le parc de machines et les stacks de compute sous-jacentes (Borg, control plane). Si vous aimez l'infrastructure pure et les systèmes à grande échelle, venez faire vibrer votre expertise avec nous ! »

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

SRE COMPUTE
SRE COMPUTE

Thales • Paris

Sur place
EUR 70 000 - 110 000
SRE COMPUTE
SRE COMPUTE

S3NS • Paris

Sur place
EUR 75 000 - 110 000
Formation accélérée Google
Équipe à taille humaine
SRE DATA
SRE DATA

Thales Group • Paris

Hybride
EUR 60 000 - 95 000
Lead SRE Network
Lead SRE Network

Thales Group • Paris

Hybride
EUR 70 000 - 90 000
Environnement de travail collaboratif
Formation continue
SRE Trusted Platform
SRE Trusted Platform

Thales Group • Paris

Hybride
EUR 45 000 - 65 000
S3NS - Cloud and Security Engineer F/H
S3NS - Cloud and Security Engineer F/H

Thales • France

Sur place
EUR 40 000 - 55 000
S3NS - Cloud and Security Engineer F/H
S3NS - Cloud and Security Engineer F/H

Thales Group • Paris

Hybride
EUR 45 000 - 75 000
Technical Support Engineer
Technical Support Engineer

Thales • Paris

Sur place
EUR 40 000 - 60 000
SRE Compute: Maître de l'Infrastructure Cloud
SRE Compute: Maître de l'Infrastructure Cloud

S3NS • Paris

Sur place
EUR 75 000 - 110 000
Formation accélérée Google
Équipe à taille humaine
SRE Compute Engineer - Cloud Infra & 24/7 Ops
SRE Compute Engineer - Cloud Infra & 24/7 Ops

Thales • Paris

Sur place
EUR 70 000 - 110 000