Site Reliability Engineer (F/H/N)

OVHcloud

Paris

Sur place

EUR 70 000 - 110 000

Plein temps

Il y a 2 jours
Soyez parmi les premiers à postuler
Générateur de candidature

N’envoyez pas un CV générique — générez un CV et une lettre de motivation adaptés à ce poste précis.

Passez les filtres ATS

Résumé du poste

OVHcloud recherche un Site Reliability Engineer (F/H/N) pour rejoindre l’équipe Delivery & Operations dans le Sovereign Group. Vous industrialiserez et fiabiliserez la livraison des plateformes souveraines via GitOps et IaC, consoliderez Kubernetes et assurerez disponibilité et sécurité en production.

Vous diagnostiquerai les incidents avec Prometheus, Grafana et OpenTelemetry, et contribuerez à l’automatisation du BAU.

Qualifications

  • Maîtrise des fondamentaux Linux, réseaux et cloud-native.
  • Expérience en gestion d’orchestrateurs de conteneurs en production (Kubernetes) et pratiques SRE (SLI/SLO, astreintes, incidents).
  • Maîtrise des outils CI/CD en mode GitOps (FluxCD, ArgoCD) et de l’IaC (Terraform, Ansible, Git).
  • Développement en Python et/ou Go pour outils et services robustes.
  • Connaissance du durcissement d’infrastructure et sécurité réseau/système.
  • Utilisation d’outils IA pour optimiser les opérations.
  • Bon niveau d’anglais en environnement international.
  • Esprit critique et proactivité face aux résultats IA.

Responsabilités

  • Industrialiser et fiabiliser la livraison des plateformes via GitOps et IaC.
  • Maintenir et faire évoluer Kubernetes et les opérateurs.
  • Assurer disponibilité, performance et sécurité en production en suivant SLI/SLO et budgets d’erreur.
  • Diagnostiquer les incidents avec Prometheus, Grafana et OpenTelemetry, et automatiser le BAU.
  • Rédiger la documentation technique et les runbooks; participer aux audits SecNumCloud.
  • Intégrer et opérer des briques d’IA pour améliorer l’observabilité et le self-healing.

Connaissances

Linux
Kubernetes
GitOps
Python
Go
Terraform
Ansible
Anglais

Outils

FluxCD
ArgoCD
Prometheus
Grafana
OpenTelemetry

Description du poste

Site Reliability Engineer (F/H/N)
Au sein de votre équipe #OneTeam

  • Rejoindre le département IT, Technology & Product, qui conçoit, développe et opère les produits, les services et les infrastructures d’OVHcloud.
  • Intégrer l’équipe Delivery & Operations dans le Sovereign Group, en charge de la livraison industrialisée et de l’exploitation en production de trois plateformes souveraines (SNC Cloud Platform, OPCP, BMPOD SNC).
Vos principales responsabilités
  • Industrialiser et fiabiliser la livraison des plateformes (provisioning, configuration, GitOps avec FluxCD, Ansible, Terraform).
  • Maintenir et faire évoluer le socle Kubernetes ainsi que les opérateurs gérant le cycle de vie des plateformes.
  • Garantir la disponibilité, la performance et la sécurité en production en pilotant les SLI/SLO et les budgets d’erreur.
  • Déttecter, diagnostiquer et corriger les anomalies via Prometheus, Grafana et OpenTelemetry.
  • Traiter la cause racine des incidents, automatiser le BAU et participer à la rotation d’astreinte.
  • Assurer le durcissement (hardening), le patch management et participer aux audits de conformité (SecNumCloud).
  • Rédiger et versionner la documentation technique et les runbooks.
  • Intégrer et opérer avec des briques d’IA (copilotes de diagnostic, agents, RAG, triage d’alertes) pour augmenter l’équipe au quotidien.
Votre futur impact

Dans 6 mois

  • Vous maîtriserez le périmètre d’exploitation des plateformes souveraines et participerez en autonomie à la rotation d’astreinte.
  • Vous aurez contribué à l’industrialisation des livraisons d’infrastructure via nos pipelines GitOps et d’IaC.
  • Vous commencerez à utiliser et enrichir nos copilotes et outils d’IA d’exploitation au quotidien.
Et dans 1 an
  • Vous jouerez un rôle clé dans l’architecture et la fiabilité à long terme des plateformes cloud souveraines.
  • Vous serez autonome pour concevoir et déployer des agents ou workflows IA complexes améliorant l’observabilité et le self-healing.
  • Vous contribuerez activement aux démarches d’audit et de qualification de haut niveau de sécurité (SecNumCloud).
Compétences requises :
  • Vous maîtrisez les fondamentaux de Linux, du réseau (TCP/IP, DNS) et l’écosystème cloud-native.
  • Vous avez une expérience solide en gestion d’orchestrateurs de conteneurs en production (idéalement Kubernetes) et en pratiques SRE (SLI/SLO, astreintes, gestion d’incidents).
  • Vous maîtrisez les outils de CI/CD en mode GitOps (FluxCD, ArgoCD) ainsi que l’IaC et l’automatisation (Terraform, Ansible, Git).
  • Vous développez en Python et/ou en Go pour créer des outils et services robustes.
  • Vous avez des notions de durcissement d’infrastructure (hardening) et connaissez les mécanismes de sécurité réseau et système.
  • Vous utilisez au quotidien des outils d’IA pour optimiser vos opérations.
  • Vous êtes à l’aise en anglais pour évoluer dans un environnement international.
  • Vous êtes proactif, responsable, exigeant sur la qualité, team player et doté d’un esprit critique face aux résultats produits par l’IA.
C’est un +
  • Vous avez une expérience dans l’intégration de modèles de langage (RAG, prompt engineering, frameworks d’agents, MCP) ou le déploiement OpenStack / Bare Metal.
  • Vous connaissez les normes de qualification ou certification : SecNumCloud, PCI DSS, ISO 27001, HDS.
  • Vous avez opéré des charges GPU / serveurs d’inférence (vLLM, Triton) ou participé à des projets Open Source.
Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Site Reliability Engineer (F/H/N)
Site Reliability Engineer (F/H/N)

OVH GmbH • Paris

Hybride
EUR 70 000 - 110 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance ancienneté
+2
SRE Managed Kubernetes H/F/N
SRE Managed Kubernetes H/F/N

OVH GmbH • France

Hybride
EUR 90 000 - 130 000
Actionnariat salarié
Subventions vacances et sport
Berceau et crèche d'entreprise
+2
SRE Managed Kubernetes H/F/N
SRE Managed Kubernetes H/F/N

OVH GmbH • Nantes

Hybride
EUR 70 000 - 110 000
Télétravail hybride
Actionnariat salarié
Soutien vacances et sport
+5
Site Reliability Engineer - Object Storage F/H/N
Site Reliability Engineer - Object Storage F/H/N

OVH GmbH • Roubaix

Sur place
EUR 40 000 - 60 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Programme de reconnaissance de l'ancienneté
+3
Site Reliability Engineer - Network Observability - F/H/N
Site Reliability Engineer - Network Observability - F/H/N

OVH GmbH • France

Sur place
EUR 70 000 - 110 000
Hybrid remote work
Employee stock plan
Vacations and sports subsidies
+2
Senior Software Developer Go - Cloud-Native H/F/N
Senior Software Developer Go - Cloud-Native H/F/N

OVH GmbH • France

Hybride
EUR 70 000 - 110 000
Télétravail hybride
Plan d'actionnariat salarié
Subventions vacances et sport
+5
Software Engineer - Network Observability F/H/N
Software Engineer - Network Observability F/H/N

OVH GmbH • Paris

Hybride
EUR 90 000 - 130 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+6
Architecte Logiciel & Infrastructure - Network - F/H/N
Architecte Logiciel & Infrastructure - Network - F/H/N

OVHcloud • Lille

Sur place
EUR 90 000 - 125 000
Ingénieur SRE Storage & AIOps H/F/N
Ingénieur SRE Storage & AIOps H/F/N

OVH GmbH • Paris

Sur place
EUR 85 000 - 120 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+6
Software Engineer Senior - Network Orchestration F/H/N
Software Engineer Senior - Network Orchestration F/H/N

OVHcloud • Paris

Sur place
EUR 70 000 - 110 000