SRE Managed Kubernetes H/F/N

OVH GmbH

France

Hybride

EUR 90 000 - 130 000

Plein temps

Il y a 7 heures
Soyez parmi les premiers à postuler
Générateur de candidature

Obtenez une réponse de cet employeur — un CV et une lettre de motivation adaptés exactement à ce qu’on recherche pour ce poste.

Passez les filtres ATS

Avantages offerts par ce poste

Actionnariat salarié
Subventions vacances et sport
Berceau et crèche d'entreprise
Formation et certification en ligne
Couverture médicale et sociale

Résumé du poste

OVHcloud recherche un Site Reliability Engineer (Public Cloud) pour intégrer l'équipe Kubernetes managé et assurer la fiabilité de la plateforme globale. Vous développerez, opérerez et améliorerez une plateforme Kubernetes distribuée, assurant disponibilité, performance et sécurité.

Vous collaborerez avec les équipes pour automatiser les déploiements, mettre en place l’observabilité et l’AIOps, et participerez à la rotation d’astreinte après période de montée en compétence.

Qualifications

  • Maîtrise des technologies IaaS (réseau, load balancing) et infrastructures distribuées.
  • Bonne connaissance de GNU/Linux (Debian-like).
  • Expérience en automatisation d'infrastructure et scripting (Golang/Python, Bash).
  • Connaissances en supervision, observabilité et outils de tracing.
  • Connaissance des chaînes agentiques et workflows autonomes; prompt engineering est un plus.

Responsabilités

  • Garantir disponibilité, performance et résilience de la plateforme haute disponibilité.
  • Concevoir, faire évoluer et maintenir des architectures distribuées robustes, scalables et sécurisées.
  • Développer des mécanismes d'automatisation, de supervision et d'auto-remédiation (Infrastructure as Code, scripts, controllers Kubernetes).
  • Définir et faire évoluer les pratiques de supervision, d'observabilité et d'AIOps (métriques, logs, alerting, tracing distribué, détection d'anomalies, corrélation d'événements et analyse prédictive).
  • Participer aux analyses d'incidents majeurs, implémenter les actions correctives durables et exploiter les capacités de l'IA pour accélérer l'identification des causes racines, la résolution des incidents et l'amélioration continue de la fiabilité du produit

Connaissances

Kubernetes admin
Observability/AIOps
Automation scripting
Prompt engineering

Outils

Kubernetes
GNU/Linux
Infrastructure as Code

Description du poste

1. Échange avec notre Talent Acquisition Specialist: Magali

2. Entretien avec le Manager: Francois

3. Cas pratique (si pertinent)

4. Rencontre avec un pair, un membre de l'équipe ou de la direction

5. Débriefing ensemble

  • Une politique de télétravail hybride
  • Un plan d'actionnariat salarié
  • Un programme de reconnaissance de l'ancienneté
  • Des subventions vacances et sport
  • Berceau et crèche d'entreprise (selon site)

Mais aussi :

  • Des équipes multiculturelles
  • Des locaux bien équipés
  • Une plateforme de formation et de certification en ligne
  • Une offre d'accompagnement médical et social digitalisée pour vous et votre famille

OVHcloud valorise la diversité des personnes qu’elle embauche et accompagne.

La diversité pour nous, c’est favoriser un milieu de travail où les différences individuelles sont reconnues, appréciées et respectées de façon à développer le plein potentiel et les forces de chacune et chacun.

Soyez libre d’être vous-même!

L'intelligence artificielle réinvente nos métiers au quotidien.

Rejoignez-nous pour explorer ses immenses possibilités et coconstruire l'avenir !

Nous savons que les femmes peuvent parfois s'abstenir de postuler si elles ne répondent pas à 100% des critères d'une offre.

Nous souhaitons clarifier : nos fiches de poste sont des repères, pas des barrières. Nous avons hâte de recevoir votre candidature.

Vous voulez contribuer à des projets uniques pour construire ensemble le cloud libre ? Allons-y! Chez OVHcloud, nous sommes animés par la même volonté, celle de construire l’avenir ensemble pour défendre la liberté d’innover.

Découvrez l'acteur majeur du cloud libre et responsable

  • Intégrer la Product Unit Public Cloud, au sein de l'équipe en charge de la conception, de l'évolution et de l'exploitation de l'offre Kubernetes managé.
  • Développer et opérer une plateforme Kubernetes utilisée par un grand nombre de clients, reposant sur des infrastructures distribuées complexes. La fiabilité, la performance, la disponibilité, la sécurité et l'évolutivité sont des enjeux structurants de cette plateforme.
  • En tant que Site Reliability Engineer expérimenté, intervenir au cœur du fonctionnement de la plateforme Kubernetes (control plane, controllers, reconciliation loops, API server, etcd) afin de garantir la stabilité et l'évolutivité du produit.
  • Contribuer à l'industrialisation, à l'automatisation et à l'amélioration continue des mécanismes de fiabilité. Après une période de formation et de montée en compétence, intégrer la rotation d'astreinte de l'équipe afin d'assurer la continuité de service à nos clients.
  • Au sein d'OVHcloud, adopter une approche de développement augmentée par l'IA, où l'IA générative est intégrée aux pratiques quotidiennes : conception, développement, tests, revue de code et documentation.
Vos principales responsabilités
  • Garantir la disponibilité, la performance et la résilience de la plateforme haute disponibilité
  • Concevoir, faire évoluer et maintenir des architectures distribuées robustes, scalables et sécurisées
  • Développer des mécanismes d'automatisation, de supervision et d'auto-remédiation (Infrastructure as Code, scripts, controllers Kubernetes)
  • Définir et faire évoluer les pratiques de supervision, d'observabilité et d'AIOps (métriques, logs, alerting, tracing distribué, détection d'anomalies, corrélation d'événements et analyse prédictive)
  • Participer aux analyses d'incidents majeurs, implémenter les actions correctives durables et exploiter les capacités de l'IA pour accélérer l'identification des causes racines, la résolution des incidents et l'amélioration continue de la fiabilité du produit
Votre futur impact

Dans 6 mois

Vous aurez pris vos marques au sein de l'équipe Public Cloud et assimilé le fonctionnement interne de la plateforme Kubernetes managée.

Vous aurez participé au maintien en condition opérationnelle et aux évolutions du control plane (controllers, API server, etcd), tout en automatisant les processus clés.

Vous aurez intégré l'IA générative dans vos routines quotidiennes de développement, de revue de code et de résolution d'incidents.

Vous aurez pris en main les mécanismes d'observabilité et d'AIOps pour améliorer la détection proactive des anomalies.

Et dans 1 an

  • Vous aurez joué un rôle clé dans la montée en charge et la résilience globale de la plateforme Kubernetes sur des infrastructures distribuées complexes.
  • Vous serez pleinement intégré à la rotation d'astreinte et garantirez la continuité de service pour l'ensemble de nos clients.
  • Vous aurez fiabilisé et automatisé les mécanismes d'auto-remédiation et apporté des améliorations durables sur l'architecture distribuée.
Compétences requises :

Vous maîtrisez les technologies IaaS (réseau, load balancing), les serveurs, le stockage, la virtualisation et les infrastructures distribuées

Vous avez déjà manipulé Kubernetes en tant que client Vous disposez d'une bonne connaissance de GNU/Linux (Debian-like)

Vous avez une expérience en automatisation d'infrastructure (Infrastructure as Code) et des connaissances en scripting (Golang/Python, Bash)

Vous possédez des connaissances approfondies des principes de supervision, d'observabilité et une expérience avec les outils de tracing system

Vous avez une bonne compréhension des règles de sécurité informatique Vous avez une expérience en prompt engineering et une bonne compréhension des principes des chaînes agentiques et workflows autonomes (orchestration d'agents, gestion d'outils/fonctions, boucles de rétroaction)

C'est un +

  • Vous communiquez sur le travail de l'équipe (vous pourriez être amené à participer à des meet-up ou conférences si vous le souhaitiez).
Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Senior Software Developer Go - Cloud-Native H/F/N
Senior Software Developer Go - Cloud-Native H/F/N

OVH GmbH • France

Hybride
EUR 70 000 - 110 000
Télétravail hybride
Plan d'actionnariat salarié
Subventions vacances et sport
+5
Site Reliability Engineer (F/H/N)
Site Reliability Engineer (F/H/N)

OVH GmbH • Paris

Hybride
EUR 70 000 - 110 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance ancienneté
+2
Site Reliability Engineer - Network Observability - F/H/N
Site Reliability Engineer - Network Observability - F/H/N

OVH GmbH • France

Sur place
EUR 70 000 - 110 000
Hybrid remote work
Employee stock plan
Vacations and sports subsidies
+2
Site Reliability Engineer - Object Storage F/H/N
Site Reliability Engineer - Object Storage F/H/N

OVH GmbH • Roubaix

Sur place
EUR 40 000 - 60 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Programme de reconnaissance de l'ancienneté
+3
Ingénieur SRE Storage & AIOps H/F/N
Ingénieur SRE Storage & AIOps H/F/N

OVH GmbH • Paris

Sur place
EUR 85 000 - 120 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+6
Software Engineer VPC - F/H/N
Software Engineer VPC - F/H/N

OVH GmbH • Roubaix

Sur place
EUR 65 000 - 90 000
Télétravail hybride
Plan d'actionnariat salarié
Subventions vacances et sport
+3
Software Engineer - Network Observability F/H/N
Software Engineer - Network Observability F/H/N

OVH GmbH • Paris

Hybride
EUR 90 000 - 130 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+6
Software Engineer Senior - Network Orchestration F/H/N
Software Engineer Senior - Network Orchestration F/H/N

OVHcloud • Paris

Sur place
EUR 70 000 - 110 000
Architecte Logiciel & Infrastructure - Network - F/H/N
Architecte Logiciel & Infrastructure - Network - F/H/N

OVHcloud • Lille

Sur place
EUR 90 000 - 125 000
Architect Network PaaS - F/H/N
Architect Network PaaS - F/H/N

OVH GmbH • Roubaix

Sur place
EUR 90 000 - 130 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+6