Site Reliability Engineer - Backup F/H/N

OVHcloud

Lille

Sur place

EUR 70 000 - 105 000

Plein temps

Il y a 2 jours
Soyez parmi les premiers à postuler

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Résumé du poste

OVHcloud recherche un Site Reliability Engineer pour renforcer l'équipe Backup & Disaster Recovery. Vous serez responsable de la fiabilité, de l'observabilité et de l'automatisation des plateformes de sauvegarde.

Travaillant dans un environnement Agile international, vous collaborerez avec le Technical Leader et le Product Owner et utiliserez l'IA générative pour améliorer les processus et les déploiements.

Qualifications

  • Expérience de minimum 2 ans en tant que SRE, DevOps Engineer, Software Engineer dans un écosystème de production à grande échelle.
  • Solide maîtrise des environnements Linux et des réseaux (TCP/IP, DNS, load balancing).
  • Compétences en développement / scripting (Python, Go, Bash) appliquées à l'automatisation.
  • Expertise en Infrastructure as Code (Ansible, Terraform) et CI/CD.
  • Expérience des outils d'observabilité (Prometheus, Grafana, ELK ou équivalents).
  • Intéressé par l'IA et l'utilisation à grande échelle.
  • Anglais fluide ou natif est obligatoire.

Responsabilités

  • Définir, mettre en place et maintenir les SLIs, SLOs et l'Error Budget Management de nos produits basé sur Veeam Backup & Replication, Zerto, Plakar.
  • Concevoir et améliorer l'observabilité de nos plateformes : monitoring, alerting, logging et tracing, avec une approche orientée symptômes et expérience client.
  • Automatiser les opérations récurrentes (réduction du toil) via l'Infrastructure as Code et le développement d'outillage interne.
  • Participer aux développements liés à nos projets.
  • Participer à la gestion des incidents : diagnostic, résolution, astreinte, et animation des post-mortems blameless avec suivi des actions correctives.
  • Contribuer à la conception d'architectures modernes, scalables et résilientes, en apportant la vision fiabilité dès la phase de design (capacity planning, tests de charge, chaos engineering).
  • Fiabiliser et industrialiser les chaînes de déploiement (CI/CD) de l'équipe.
  • Partager les pratiques SRE avec vos pairs et votre réseau (autres équipes SRE, support, ...).
  • Rechercher les meilleures technologies et idées disponibles au sein ou en dehors de la compagnie pour vos projets.
  • Concevoir, développer et faire évoluer des APIs REST et services backend, dans une approche API-first, en exploitant pleinement les capacités de l'IA générative.
  • Concevoir et déployer des workflows agentiques et des techniques de Prompt Engineering avancées pour automatiser et fiabiliser l'ensemble du cycle de vie logiciel, de la génération de code au monitoring d'exploitation.

Connaissances

Linux
Réseaux TCP/IP
Python
Go
Bash
Infrastructure as Code
Terraform
Ansible
CI/CD
Prometheus
Grafana
ELK
Kubernetes
Anglais courant

Outils

VMware vSphere
VMware Cloud Director
Veeam
Zerto
Plakar
Kubernetes

Description du poste

Vous voulez contribuer à des projets uniques pour construire ensemble le cloud libre ? Allons-y!

Chez OVHcloud, nous sommes animés par la même volonté, celle de construire l’avenir ensemble pour défendre la liberté d’innover.

OVHcloud est un acteur mondial et le leader européen du Cloud opérant plus de 450 000 serveurs dans 43 centres de données sur 4 continents à destination de 1,6 million de clients dans plus de 140 pays. Fer de lance d'un Cloud de confiance et pionnier d'un Cloud durable au meilleur ratio performance-prix, le Groupe s’appuie depuis plus de 20 ans sur un modèle intégré qui lui confère la maîtrise complète de sa chaîne de valeur : de la conception de ses serveurs, à la construction et au pilotage de ses centres de données, en passant par l’orchestration de son réseau de fibre optique. Cette approche unique lui permet de couvrir en toute indépendance l’ensemble des usages de ses clients en leur faisant profiter des vertus d’un modèle raisonné sur le plan environnemental avec un usage frugal des ressources et d'une empreinte carbone atteignant les meilleurs ratios de l'industrie. OVHcloud propose aujourd’hui des solutions de dernière génération alliant performance, prévisibilité des prix et une totale souveraineté sur leurs données pour accompagner leur croissance en toute liberté.

Au sein de votre équipe #OneTeam
  • Vous rejoindrez notre équipe Backup, responsable de la gestion des solutions de Backup et Disaster Recovery au sein d'OVHcloud.
  • En tant que Site Reliability Engineer, vous serez en charge de la fiabilité, de l'observabilité et de l'automatisation de nos plateformes de sauvegarde et de reprise d'activité. Vous serez amené à travailler sur des développements liés à des projets également.
  • Vous travaillerez conjointement avec notre Technical Leader, qui gère la direction technique et les conceptions techniques de l'équipe, et avec notre Product Owner, qui définit le produit et le backlog. Vous travaillerez dans une équipe internationale au sein d'un environnement Agile.
  • Au sein d'OVHcloud, nous adoptons une approche de développement augmentée par l'IA, où l'IA générative est intégrée aux pratiques quotidiennes : conception, développement, tests, revue de code et documentation.
Vos principales responsabilités
  • Définir, mettre en place et maintenir les SLIs, SLOs et l'Error Budget Management de nos produits basé sur Veeam Backup & Replication, Zerto, Plakar.
  • Concevoir et améliorer l'observabilité de nos plateformes : monitoring, alerting, logging et tracing, avec une approche orientée symptômes et expérience client.
  • Automatiser les opérations récurrentes (réduction du toil) via l'Infrastructure as Code et le développement d'outillage interne.
  • Participer aux développements liés à nos projets.
  • Participer à la gestion des incidents : diagnostic, résolution, astreinte, et animation des post-mortems blameless avec suivi des actions correctives.
  • Contribuer à la conception d'architectures modernes, scalables et résilientes, en apportant la vision fiabilité dès la phase de design (capacity planning, tests de charge, chaos engineering).
  • Fiabiliser et industrialiser les chaînes de déploiement (CI/CD) de l'équipe.
  • Partager les pratiques SRE avec vos pairs et votre réseau (autres équipes SRE, support, ...).
  • Rechercher les meilleures technologies et idées disponibles au sein ou en dehors de la compagnie pour vos projets.
  • Concevoir, développer et faire évoluer des APIs REST et services backend, dans une approche API-first, en exploitant pleinement les capacités de l'IA générative.
  • Concevoir et déployer des workflows agentiques et des techniques de Prompt Engineering avancées pour automatiser et fiabiliser l'ensemble du cycle de vie logiciel, de la génération de code au monitoring d'exploitation.
Votre futur impact

Dans 6 mois :

  • Vous aurez pris en main l'environnement technique, les pipelines CI/CD et l'architecture de la plateforme Backup & Disaster Recovery.
  • Vous aurez contribué à la définition des premiers SLI/SLO ainsi qu'à l'amélioration de l'observabilité sur l'un de nos produits clés.
  • Vous aurez participé au développement logiciel sur certains projets de l'équipe.
  • Vous avez intégré l'IA générative dans vos processus quotidiens de développement et d'automatisation.

Et dans 1 an :

  • Vous serez autonome sur la gestion, la fiabilité et la résolution d'incidents complexes sur nos plateformes en production.
  • Vous aurez automatisé une part significative des tâches récurrentes toil via l'IaC et l'outillage interne.
  • Vous jouerez un rôle moteur dans la conception d'architectures résilientes et le déploiement de workflows agentiques avancés.
Compétences requises :
  • Expérience de minimum 2 ans en tant que SRE, DevOps Engineer, Software Engineer dans un écosystème de production à grande échelle.
  • Solide maîtrise des environnements Linux et des réseaux (TCP/IP, DNS, load balancing).
  • Compétences en développement / scripting (Python, Go, Bash) appliquées à l'automatisation.
  • Expertise en Infrastructure as Code (Ansible, Terraform) et CI/CD.
  • Expérience des outils d'observabilité (Prometheus, Grafana, ELK ou équivalents).
  • Intéressé par l'IA et l'utilisation à grande échelle.
  • Anglais fluide ou natif est obligatoire.
C'est un +
  • Connaissance des solutions de Backup et Disaster Recovery (Veeam, Zerto, Plakar).
  • Connaissance des environnements de virtualisation (VMware vSphere, VMware Cloud Director) et de Kubernetes.
  • Connaissance des concepts de stockage (objet, bloc, snapshots, immutabilité).
  • Connaissance des mesures de sécurité (certifications, chiffrement, hardening).
  • Empathie, l'envie de découvrir / partager et motivation sont fortement attendus.

OVHcloud valorise la diversité des personnes qu’elle embauche et accompagne. La diversité, pour OVHcloud, c’est favoriser un milieu de travail où les différences individuelles sont reconnues, appréciées et respectées de façon à développer le plein potentiel et les forces de chacune et chacun. Soyez libre d’être vous-même !

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Software Engineer / SRE - F/H/N
Software Engineer / SRE - F/H/N

OVHcloud • Lille

Sur place
EUR 65 000 - 90 000
Architecte Logiciel & Infrastructure - Network - F/H/N
Architecte Logiciel & Infrastructure - Network - F/H/N

OVHcloud • Lille

Sur place
EUR 90 000 - 140 000
Techlead Site Reliability Engineer - Data Platform
Techlead Site Reliability Engineer - Data Platform

OVH GmbH • Paris

Hybride
EUR 70 000 - 90 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Programme de reconnaissance de l'ancienneté
+3
Software Engineer - Network Observability F/H/N
Software Engineer - Network Observability F/H/N

OVHcloud • Paris

Sur place
EUR 70 000 - 110 000
Site Reliability Engineer - Network Observability F/H/N
Site Reliability Engineer - Network Observability F/H/N

OVHcloud • Rennes

Sur place
EUR 45 000 - 60 000
Site Reliability Engineer - Object Storage F/H/N
Site Reliability Engineer - Object Storage F/H/N

OVH GmbH • Roubaix

Hybride
EUR 40 000 - 60 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Programme de reconnaissance de l'ancienneté
+3
Escalation manager H/F/N
Escalation manager H/F/N

OVH GmbH • France

Hybride
EUR 65 000 - 90 000
Télétravail hybride
Actionnariat salarié
Reconnaissance ancienneté
+6
IT Technical Leader - F/H/N
IT Technical Leader - F/H/N

OVH GmbH • Nantes

Hybride
EUR 55 000 - 75 000
Politique de télétravail hybride
Plan d'actionnariat salarié
Programme de reconnaissance de l'ancienneté
+2
Ingénieur SRE Storage & AIOps H/F/N
Ingénieur SRE Storage & AIOps H/F/N

OVH GmbH • Paris

Hybride
EUR 85 000 - 120 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+6
Software Engineer VPC - F/H/N
Software Engineer VPC - F/H/N

OVH GmbH • Roubaix

Hybride
EUR 65 000 - 90 000
Télétravail hybride
Plan d'actionnariat salarié
Subventions vacances et sport
+3