SRE Baremetal H/F/N

OVHcloud

Roubaix

Sur place

EUR 60 000 - 95 000

Plein temps

Il y a 9 jours
Générateur de candidature

Démarquez-vous pour ce poste — générez un CV personnalisé et une lettre de motivation en environ une minute.

Passez les filtres ATS

Résumé du poste

OVHcloud recherche un SRE Baremetal H/F/N pour rejoindre l’équipe Baremetal Operations, afin d’assurer une haute disponibilité et une restauration rapide des services et infrastructures avec des solutions d’observabilité et d’IA générative.

Vous analyserez les incidents via AIOps, déploierez l’auto-remédiation et développerez des outils pour optimiser les environnements BareMetal et cloud/hybrides, tout en participant aux post-mortems et aux astreintes selon les besoins.

Qualifications

  • Compétences solides en Unix/Linux, scripting Bash et développement en Python ou Go.
  • Maîtrise des pratiques AIOps (analyse prédictive, détection d’anomalies ML, corrélation d’événements) et Prompt Engineering avec des assistants de code.
  • Bonne connaissance des bonnes pratiques CI/CD et des méthodes Agile, sens du service client et réactivité.
  • Paramètres analytiques — esprit critique face aux suggestions IA pour prioriser les actions.
  • Bon niveau d’anglais écrit et oral, contexte international.

Responsabilités

  • Analyser et résoudre les incidents en s’appuyant sur des outils d’AIOps et corrélation des logs; identifier les causes racines et automatiser leur traitement.
  • Concevoir et implémenter des mécanismes d’auto-remédiation pour réduire le MTTR.
  • Mettre en place des indicateurs et des alertes basés sur l’analyse prédictive des anomalies.
  • Traiter les demandes transmises par les équipes support client et les équipes opérationnelles.
  • Créer et suivre les PostMortem en cas d’incident majeur, en utilisant l’IA pour accélérer l’analyse.
  • Assurer la continuité de service 24h/24 avec astreintes après montée en compétences.
  • Déployer et maintenir le parc BareMetal et les infrastructures cloud/hybrides.
  • Développer des outils et patchs pour gérer les infrastructures et optimiser l’utilisation d’assistants de code.

Connaissances

Unix/Linux
Networking
Bash
Python
Go
AIOps
Prompt Engineering
CI/CD
Agile
Anglais

Outils

Kubernetes
Terraform
DevOps tools

Description du poste

SRE Baremetal H/F/N

Au sein de votre équipe #OneTeam
  • Intégrer l’équipe Baremetal Operations en charge du maintien en conditions opérationnelles des infrastructures et des services du périmètre par une approche proactive et prédictive, en assurant un haut niveau de disponibilité et une restauration automatisée ou rapide des services en cas d’incident.
  • Construire un service hautement qualitatif en participant au développement, à l’automatisation et au déploiement de nouvelles solutions de supervision intelligente (observabilité, corrélation automatique des logs). Ces projets viseront la création et l’optimisation des outils existants en intégrant des technologies d’IA générative et prédictive pour maximiser l’efficacité opérationnelle et la qualité de service.
Vos principales responsabilités
  • Analyser et résoudre les incidents en s’appuyant sur des outils d’AIOps (analyse avancée et corrélation de logs multi-sources), identifier les causes racines et automatiser leur traitement.
  • Concevoir et implémenter des mécanismes d’auto-remédiation pour réduire le MTTR.
  • Mettre en place des indicateurs et des alertes basés sur l’analyse prédictive des anomalies pour intervenir avant l’impact utilisateur.
  • Traiter les demandes transmises par les équipes support client ou d’autres équipes opérationnelles.
  • Créer et assurer le suivi des PostMortem en cas d’incident majeur, en exploitant l’IA pour documenter et accélérer l’analyse post-incident.
  • Assurer la continuité de service 24h/24 (avec participation à des périodes d’astreintes, après une montée en compétence suffisante).
  • Déployer et maintenir le parc interne BareMetal et les infrastructures cloud/hybrides.
  • Développer des outils, des patchs et des fonctionnalités pour gérer les infrastructures, en maximisant l’usage d’assistants de code.
Votre futur impact
Dans 6 mois
  • Vous aurez pris vos marques au sein de l’équipe Baremetal Operations et appréhendé notre infrastructure ainsi que nos services. Vous comprendrez les défis actuels liés à la haute disponibilité et commencerez à manipuler nos outils d’AIOps.
  • Vous aurez participé à l’analyse et à la résolution des premiers incidents, en contribuant à l’identification des causes racines et en vous familiarisant avec nos mécanismes d’auto-remédiation.
  • Vous aurez établi des relations avec les équipes support et les autres entités opérationnelles pour fluidifier le traitement des demandes et la gestion des alertes prédictives.
  • Vous aurez exploré nos environnements de développement et de scripting (Python, Go, Bash) afin de proposer vos premières optimisations de code assistées par IA.
Et dans 1 an
  • Vous aurez joué un rôle clé dans le déploiement de nouvelles solutions de supervision intelligente et l’intégration de technologies d’IA générative/prédictive au sein de nos outils d’exploitation.
  • Vous aurez partagé votre expertise en pratiques AIOps et Prompt Engineering avec l’équipe, en automatisant une part significative des processus de traitement des anomalies et des PostMortem.
  • Vous aurez interagi avec l’ensemble de l’écosystème technique d’OVHcloud, en assurant des astreintes en toute autonomie et en maintenant le parc BareMetal au meilleur niveau de performance et de scalabilité.
Compétences requises :
  • Vous possédez de solides connaissances en système et réseau (Unix, Cisco/Arista), maîtrisez le scripting (Bash) et le développement dans au moins un langage parmi Python ou Go.
  • Vous maîtrisez la culture et les pratiques AIOps (analyse prédictive, détection d’anomalies par ML, corrélation d’événements) ainsi que les techniques de Prompt Engineering avec l’utilisation d’assistants de code.
  • Vous êtes à l’aise avec les bonnes pratiques CI/CD, les méthodes agiles, et faites preuve de réactivité, de rigueur ainsi que d’un fort sens du service client.
  • Vous avez une bonne capacité de prise de recul, un sens analytique aiguisé et un esprit critique face aux suggestions des outils d’IA pour gérer les priorités face à des situations complexes.
  • Vous disposez d’un anglais de bon niveau (écrit et oral), indispensable pour évoluer dans notre contexte international.
C’est un +
  • Vous connaissez Kubernetes, Terraform et les outils/méthodes DevOps.
    • Vous avez une expérience avec des plateformes d’observabilité intégrant des modules IA, une connaissance du référentiel ITIL v3/v4 ou une première expérience en maintenance d’infrastructures IT.
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

SRE Baremetal H/F/N
SRE Baremetal H/F/N

OVH GmbH • France

Hybride
EUR 60 000 - 90 000
Télétravail hybride
Actionnariat salarié
Vacances et sport
+5
Ingénieur SRE Storage & AIOps H/F/N
Ingénieur SRE Storage & AIOps H/F/N

OVH GmbH • Paris

Sur place
EUR 85 000 - 120 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+6
Site Reliability Engineer - Object Storage F/H/N
Site Reliability Engineer - Object Storage F/H/N

OVH GmbH • Roubaix

Hybride
EUR 40 000 - 60 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Programme de reconnaissance de l'ancienneté
+3
Site Reliability Engineer - Network Observability - F/H/N
Site Reliability Engineer - Network Observability - F/H/N

OVH GmbH • France

Hybride
EUR 70 000 - 110 000
Hybrid remote work
Employee stock plan
Vacations and sports subsidies
+2
Software Engineer - Network Observability F/H/N
Software Engineer - Network Observability F/H/N

OVH GmbH • Paris

Sur place
EUR 75 000 - 110 000
Télétravail hybride
Plan d'actionnariat salarié
Crèche d'entreprise (selon site)
+2
Site Reliability Engineer VMware - F/H/N
Site Reliability Engineer VMware - F/H/N

OVH GmbH • Roubaix

Hybride
EUR 70 000 - 110 000
Télétravail hybride
Actionnariat salarié
Reconnaissance de l'ancienneté
+5
Site Reliability Engineer - Network Observability - F/H/N
Site Reliability Engineer - Network Observability - F/H/N

OVHcloud • Paris

Sur place
EUR 70 000 - 100 000
Techlead Site Reliability Engineer - Data Platform
Techlead Site Reliability Engineer - Data Platform

OVH GmbH • Paris

Hybride
EUR 70 000 - 90 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Programme de reconnaissance de l'ancienneté
+3
Tech Lead AI H/F/N
Tech Lead AI H/F/N

OVH GmbH • Bouriandre

Hybride
EUR 85 000 - 120 000
Télétravail hybride
Actionnariat salarié
Reconnaissance de l'ancienneté
+2
Coordinateur Maintenance en Datacentre H/F/N
Coordinateur Maintenance en Datacentre H/F/N

OVH GmbH • Roubaix

Sur place
EUR 45 000 - 65 000
Une politique de télétravail hybride
Un plan d'actionnariat salarié
Un programme de reconnaissance de l''l
+2