Site Reliability Engineer

OVH GmbH

Paris

Hybrid

EUR 90,000 - 130,000

Full time

4 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

OVHcloud recherche un SRE Senior pour piloter Keystone et l’identité du Public Cloud. Vous assurerez l’authentification, l’autorisation et la fédération d’identité entre Keystone et l’IAM OVHcloud, tout en garantissant fiabilité, sécurité et évolutivité.

Vous développerez en Python et Go, automatiserez les déploiements avec Terraform et Helm et contribuerez activement aux pratiques DevOps et à la sécurité des API.

Qualifications

  • Expertise en authentification, autorisation et fédération d’identité.
  • Maîtrise des protocoles et technologies d’identité (OIDC, SAML, LDAP).
  • Expérience avec des services distribués et haute disponibilité.

Responsibilities

  • Opérer et fiabiliser OpenStack Keystone dans un cloud public à grande échelle.
  • Garantir la haute disponibilité et les performances multi‑régions.
  • Concevoir et réaliser des migrations sans interruption de service.
  • Évoluer les modèles d’authentification et d’autorisation (RBAC, fédération).
  • Intégrer Keystone avec l’IAM OVHcloud et assurer la sécurité des API.

Skills

authentification
autorisation
fédération d’identité
OpenStack Keystone
Python
Go
Terraform
Helm
Git
CI/CD

Tools

Terraform
Helm
Git
CI/CD

Job description

Au sein de votre équipe #OneTeam

Chaque appel aux API du Public Cloud OVHcloud passe par les services opérés par votre future équipe.L’équipe est notamment responsable de OpenStack Keystone, le service d’identité du Public Cloud qui assure l’authentification des appels API, ainsi que des mécanismes de contrôle permettant de vérifier, à l’entrée, que chaque utilisateur ou service dispose des droits nécessaires.

Ces composants se situent sur un chemin critique : leur disponibilité conditionne directement celle du Public Cloud et leur niveau de sécurité est essentiel à la protection de la plateforme.

Keystone est intégré à l’IAM d’OVHcloud, opéré par une autre équipe. L’un des principaux enjeux consiste donc à assurer une intégration fiable, sécurisée et scalable entre ces différents systèmes d’identité à l’échelle du Public Cloud.

Dans une logique de séparation des responsabilités, l’équipe est indépendante des équipes exploitant directement les infrastructures : les équipes qui définissent et contrôlent les accès ne sont pas celles qui administrent les ressources auxquelles ces accès donnent droit.

En tant que SRE Senior, votre expertise portera principalement sur Keystone, l’Identity & Access Management et le contrôle d’accès aux API. Vous contribuerez à la fiabilité, à la sécurité et à l’évolution de services distribués critiques utilisés à grande échelle.

Une astreinte 24/7 est assurée par rotation au sein de l’équipe et fait l’objet d’une contrepartie selon les dispositions en vigueur chez OVHcloud.

Vos principales responsabilités

Opérer et fiabiliser OpenStack Keystone dans un environnement Public Cloud distribué à grande échelle.

Garantir la haute disponibilité, la cohérence multi-régions et la performance du service sur le chemin critique d’authentification.

Concevoir et réaliser des migrations et évolutions sans interruption de service.

Faire évoluer les modèles d’authentification et d’autorisation : permissions fines, scopes projet, domaine et région, RBAC et fédération d’identité.

Assurer l’intégration et la fédération d’identité entre Keystone et l’IAM d’OVHcloud.

Industrialiser les politiques d’autorisation à travers des approches de Policy as Code, des tests automatisés et des mécanismes de non-régression.

Contribuer à la sécurisation des API, notamment à travers le filtrage applicatif, le WAF, le rate limiting et la détection des menaces.

Définir, suivre et améliorer les SLO des services opérés.

Participer au run et à l’astreinte, analyser les incidents et contribuer aux analyses de causes racines.

Automatiser les opérations récurrentes afin d’améliorer la fiabilité, la sécurité et l’efficacité opérationnelle.

Développer et maintenir les composants de la stack en Python et Go.

Concevoir et maintenir les infrastructures et configurations as code avec notamment Terraform et Helm.

Maintenir des standards DevOps élevés en matière de qualité de code, tests, CI/CD, documentation, sécurité et traçabilité.

Contribuer à l’amélioration continue des pratiques techniques et accompagner la montée en compétences de l’équipe.

Votre futur impact
Dans les 6 mois

Maîtrise du périmètre : comprendre l’architecture de Keystone, son intégration avec l’IAM OVHcloud et les mécanismes de contrôle d’accès aux API.

Autonomie : être autonome sur la stack et capable d’intervenir efficacement sur les services en production.

Astreinte : participer sereinement à la rotation d’astreinte et prendre en charge les incidents sur votre périmètre.

Fiabilité : avoir mené un premier chantier significatif de fiabilisation, de résilience ou de durcissement de Keystone.

Sécurité : maîtriser les principaux modèles d’authentification, d’autorisation et de fédération utilisés par la plateforme.

DevOps : contribuer de manière autonome aux déploiements, automatisations et pipelines de la stack avec Terraform, Helm et les outils CI/CD.

Collaboration : avoir établi des relations de travail efficaces avec les équipes IAM, sécurité, infrastructure et Public Cloud.

Expertise : être reconnu comme un référent interne sur OpenStack Keystone et les problématiques d’identité du Public Cloud.

SLO : délivrer de manière prédictible tout en garantissant les objectifs de disponibilité, de performance et de fiabilité des services.

Sécurité des API : être un appui technique solide sur les problématiques d’authentification, d’autorisation et de sécurisation des API.

Résilience : contribuer directement à l’amélioration de la haute disponibilité et de la résilience des services critiques d’identité.

Industrialisation : avoir renforcé l’automatisation des politiques, des tests de sécurité et des mécanismes de contrôle d’accès.

Leadership technique : challenger les choix d’architecture et contribuer aux orientations techniques de l’équipe.

Transmission : faire grandir l’équipe à travers le mentoring, le partage de connaissances et l’amélioration des standards d’ingénierie.

Amélioration continue : contribuer activement à l’évolution des pratiques SRE, DevOps et sécurité de l’équipe.

Compétences requises

Expertise en authentification, autorisation et fédération d’identité.

Maîtrise des protocoles et technologies d’identité tels que OIDC, SAML et LDAP.

Bonne compréhension des modèles RBAC, notamment dans des environnements multi-projets et multi-régions.

Expérience significative dans l’exploitation de services distribués, stateful et critiques en production.

Solides compétences en développement avec Python et Go, les deux langages faisant partie de la stack à maintenir.

Très bonne maîtrise de Linux.

Expérience significative en automatisation des opérations et infrastructures.

Maîtrise des architectures hautement disponibles et des principes de résilience.

Expérience des approches Infrastructure as Code / Configuration as Code et des tests de résilience.

Maîtrise de Terraform et Helm, utilisés de manière importante au quotidien.

Expérience avec les pipelines CI/CD et les workflows basés sur Git.

Expérience avec les contrôles de sécurité automatisés intégrés aux processus de développement et de déploiement.

Forte sensibilité aux enjeux de sécurité, conformité, auditabilité et traçabilité dans un environnement de cloud public.

Capacité à intervenir efficacement sur des incidents critiques en production.

Maîtrise professionnelle de l’anglais à l’oral et à l’écrit (niveau B2 minimum).

Atouts

Expérience pratique avec OpenStack Keystone en environnement de production.

Expérience avec un autre Identity Provider (IdP) ou service IAM opéré à grande échelle.

Connaissance des approches Policy as Code, notamment OPA/Rego ou technologies équivalentes.

Connaissance de la sécurité applicative appliquée aux API : WAF, risques OWASP, rate limiting et contrôles d’accès.

Expérience dans les mécanismes de détection et de réponse aux incidents de sécurité.

Connaissance des systèmes de SIEM, des règles de détection, l’alerting et la qualification d’incidents.

Expérience dans des architectures cloud distribuées et multi-régions.

Expérience avec des environnements nécessitant un niveau élevé de sécurité, de conformité et de traçabilité.

Utilisation d’outils d’IA appliqués au développement, à l’automatisation et aux opérations SRE.

Rigueur et grand sens du détail : sur ce périmètre, une erreur de configuration peut avoir un impact direct sur la sécurité de la plateforme.

Autonomie et fort sens de l’ownership sur votre périmètre.

Esprit critique et capacité à challenger les choix techniques de manière constructive.

Sang-froid et capacité à garder une approche structurée lors d’incidents critiques.

Fort sens des responsabilités face à des services essentiels au fonctionnement du Public Cloud.

Capacité à collaborer efficacement avec différentes équipes techniques et sécurité.

Fiabilité et sens du collectif dans un environnement international.

Capacité à partager votre expertise et à accompagner la montée en compétences des autres membres de l’équipe.

Curiosité technologique et goût prononcé pour l’apprentissage continu.

Aisance avec les outils d’IA appliqués au développement, au diagnostic et à l’exploitation.

Capacité à évoluer dans un environnement technique complexe, critique et en constante évolution.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

OVHcloud • Paris

On-site
EUR 90,000 - 120,000
Site Reliability Engineer (F/H/N)
Site Reliability Engineer (F/H/N)

OVH GmbH • Paris

Hybrid
EUR 70,000 - 110,000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance ancienneté
+2
SRE HPC AI Infrastructure H/F/N
SRE HPC AI Infrastructure H/F/N

OVH GmbH • Lyon

On-site
EUR 110,000 - 140,000
Télétravail hybride
Plan d'actionnariat salarié
Subventions vacances et sport
+1
Senior Software Developer Go - Cloud-Native H/F/N
Senior Software Developer Go - Cloud-Native H/F/N

OVH GmbH • France

Hybrid
EUR 70,000 - 110,000
Télétravail hybride
Plan d'actionnariat salarié
Subventions vacances et sport
+5
Site Reliability Engineer (F/H/N)
Site Reliability Engineer (F/H/N)

OVHcloud • Paris

On-site
EUR 70,000 - 110,000
IT Technical Lead Fullstack JS - F/H/N
IT Technical Lead Fullstack JS - F/H/N

OVH GmbH • Roubaix, Lyon, Paris

On-site
EUR 70,000 - 100,000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+2
SRE HPC AI Infrastructure H/F/N
SRE HPC AI Infrastructure H/F/N

OVHcloud • Lyon

On-site
EUR 90,000 - 150,000
Software Developer Golang
Software Developer Golang

OVH GmbH • Lyon

On-site
EUR 45,000 - 75,000
SRE Managed Kubernetes H/F/N
SRE Managed Kubernetes H/F/N

OVH GmbH • France

Hybrid
EUR 90,000 - 130,000
Actionnariat salarié
Subventions vacances et sport
Berceau et crèche d'entreprise
+2
Ingénieur Opérations Cloud et Infrastructure
Ingénieur Opérations Cloud et Infrastructure

Nomadia • Paris

On-site
EUR 70,000 - 100,000