Site Reliability Engineer & AI SRE (F/H)

SmartRecruiters, Inc.

Levallois-Perret

Sur place

EUR 90 000 - 130 000

Plein temps

Il y a 42 heures
Soyez parmi les premiers à postuler
Générateur de candidature

Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.

Passez les filtres ATS

Résumé du poste

Devoteam Innovative Tech France recrute un Site Reliability Engineer (SRE) & AI SRE pour concevoir des écosystèmes résilients et assurer la haute disponibilité des plateformes IA en production. Vous piloterez l'architecture Cloud (Landing Zones), les pratiques SRE (SLI/SLO, canary), et l'automatisation CI/CD avec Terraform, Anible et GitOps.

Diplômé(e) Bac+5 et 5 ans d'expérience, vous définirez la culture de fiabilité, la sécurité IA et la conformité RGPD tout en accompagnant les équipes

Qualifications

  • Diplômé·e Bac+5 en informatique (ou équivalent).
  • Minimum 5 ans d'expérience sur des environnements de production à grande échelle, avec expertise SRE et/ou MLOps.
  • Maîtrise des Kubernetes, Cloud (AWS/GCP/Azure/Privé) et des architectures de Landing Zones.
  • Pratique avancée d'IaC (Terraform, Ansible) et GitOps (ArgoCD/Flux).
  • Connaissance de la sécurité et conformité IA (AI Act, RGPD) et gouvernance des modèles d'IA.

Responsabilités

  • Concevoir des écosystèmes Cloud résilients et assurer haute disponibilité des plateformes IA.
  • Définir et piloter les engagements SLI/SLO, côté sécurité et gouvernance des IA.
  • Mener analyses RCA et tests Chaos Engineering en production.
  • Automatiser via CI/CD, IaC et pipelines GitOps pour réduire toil.
  • Assurer la sécurité et conformité IA, gestion des secrets et accès aux modèles.

Connaissances

Kubernetes
Cloud platforms
SRE / MLOps
CI/CD
Terraform
Ansible
GitOps
Python
Go
Bash
AI governance

Formation

Bac+5 informatique

Outils

Kubernetes
Terraform
Ansible
GitOps
ArgoCD/Flux
Python
Go
Bash
GPU Scheduling

Description du poste

Description de l'entreprise

Devoteam Innovative Tech France accompagne nos clients dans leurs stratégies de modernisation de plateformes en s'appuyant sur les plus grands Cloud providers du marché et sur des technologies modernes innovantes.

Notre communauté

+ de 1000 collaborateurs experts de leur domaine répartis sous forme de Tribes et Squads, travaillant sur des projets multi-cloud et cloud hybride impactants

Des expertises techniques liées aux enjeux du secteur IT : Hybrid Platform, Cloud & DevOps Platform, FinOps & Agile@scale, Project et SysOps Automation

Un environnement technologique stimulant, à travers nos partenaires : Gitlab, OVHcloud, VMware, SUSE, Dynatrace, Hashicorp, VEEAM, etc.

Une vraie communauté de Tech enthousiastes qui partagent leurs savoirs : événements, Friday Talks sur des sujets techniques, rédaction d'articles...

Pour en savoir plus sur nos trajectoires de carrière, découvrez le parcours de Nisrine !

Description du poste

Vos missions principales: En tant que Site Reliability Engineer (SRE) & AI SRE, vous concevez des écosystèmes résilients, définissez la culture de fiabilité et garantissez la haute disponibilité, la sécurité et l'automatisation des infrastructures critiques et des plateformes d'IA en production pour nos clients grands comptes :

Architecture & Résilience : Architecturer des socles Cloud (Landing Zones) et des plateformes distribuées haute disponibilité supportant aussi bien les applications critiques que les charges de travail d'IA (Kubernetes, GPU Scheduling, NVIDIA MIG, autoscaling).

Culture SRE & Gouvernance : Définir et piloter les engagements de service (SLI/SLO, Error Budgets), promouvoir le modèle "You build it, you run it", et implémenter la gouvernance des modèles d'IA (traçabilité, gestion des biais et hallucinations).

Gestion des Incidents & Chaos Engineering : Mener des analyses de causes profondes (RCA) assistées par l'AIOps lors d'incidents complexes (panne GPU, corruption de données) et éprouver les architectures via le Chaos Engineering.

Sécurité & Conformité IA : Déployer les stratégies de sécurité applicatives/infra et veiller à la conformité technique aux réglementations en vigueur (AI Act, RGPD, auditabilité).

Automatisation & CI/CD : Réduire la charge d'exploitation (toil) via l'automatisation et l'IaC (Terraform, Ansible, Python, Go, Bash), et moderniser les pipelines de déploiement continu (GitOps, Canary, Blue/Green).

Formation & expérience :

Diplômé·e Bac+5 en informatique (ou équivalent).

Minimum 5 ans d'expérience globale sur des environnements de production à grande échelle, incluant une expertise reconnue en ingénierie SRE et/ou MLOps.

Compétences techniques indispensables :

Infrastructures & Conteneurs : Maîtrise de Kubernetes (K8s, GPU Scheduling, MIG), du Cloud (AWS, GCP, Azure, Privé/Souverain) et des architectures de Landing Zones.

Automatisation & IaC : Pratique avancée de Terraform, Ansible, GitOps (ArgoCD/Flux) et scripting (Python, Go, Bash).

Fiabilité & Observabilité SRE : Maitrise de la gestion des SLI/SLO/Error Budgets, de l'AIOps, du Chaos Engineering et des processus RCA.

Sécurité & Conformité IA : Connaissances des enjeux juridiques et de la sécurisation des plateformes d'IA (AI Act, RGPD, gestion des secrets et des accès aux modèles).

Qualités personnelles :

Leadership, esprit de mentorat et capacité d'influence/évangélisation auprès des équipes (Dev, Ops, Data).

Sens de l'analyse, rigueur éthique et grande résistance au stress en gestion de crise.

Orientation résolution de problèmes et recherche d'efficacité.

Atouts appréciés :

Connaissances théoriques et pratiques sur les bases "Safe AI Native Foundations".

Informations complémentaires

Comment se déroule le processus de recrutement chez Devoteam ?

Il comporte 2 à 3 entretiens :

  • Talent Acquisition Interview : l'objectif est de faire le point sur vos compétences, votre niveau d'anglais et de valider vos éléments de motivation
  • Tech & Business Interview : cet entretien vise à approfondir vos compétences techniques et à vérifier leur adéquation avec nos besoins lors d'un échange avec un expert métier
  • Leadership Interview : il permet d'évaluer votre potentiel, vos ambitions et d'envisager votre évolution au sein de Devoteam.

Nous privilégions au moins un entretien en présentiel. Une prise de référence est demandée et, selon votre profil, des tests (techniques, anglais, personnalité...) peuvent vous être adressés.

Si votre candidature est retenue, nous vous faisons parvenir une proposition présentant les conditions d'embauche. En cas d'acceptation, le contrat de travail est formalisé.

Le Groupe Devoteam oeuvre pour l'égalité des chances, pour la promotion de ses collaboratrices et de ses collaborateurs au mérite et lutte activement contre toute forme de discrimination. Nous sommes convaincus que la diversité contribue à la créativité, au dynamisme et à l'excellence de notre organisation. Chaque candidature est donc considérée indépendamment de tout critère discriminatoire.

Si vous partagez notre passion pour la technologie et que vous souhaitez construire le monde numérique responsable de demain, alors vous êtes peut-être le passionné que nous recherchons chez Devoteam.

En cliquant sur le lien ci-dessus ou sur tout autre lien externe figurant dans cette publication, vous quittez ce site et accédez à un site web tiers dont les conditions d'utilisation et la politique de confidentialité s'appliquent.

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Site Reliability Engineer & AI SRE (F/H)
Site Reliability Engineer & AI SRE (F/H)

Devoteam • Levallois-Perret

Sur place
EUR 90 000 - 130 000
SRE (Site Reliability Engineer) - H/F
SRE (Site Reliability Engineer) - H/F

Devoteam • Île-de-France

Sur place
EUR 80 000 - 120 000
Ingénieur Observabilité / SRE - H/F
Ingénieur Observabilité / SRE - H/F

Devoteam • Levallois-Perret

Sur place
EUR 65 000 - 90 000
AI-Driven Company
Learning Company
50 Tribes d'expertise
Ingénieur Observabilité / SRE H/F
Ingénieur Observabilité / SRE H/F

Devoteam • Toulouse

Sur place
EUR 70 000 - 100 000
Infrastructure Automation Expert H/F
Infrastructure Automation Expert H/F

Devoteam • Levallois-Perret

Sur place
EUR 75 000 - 110 000
Learning Company
Formation continue
Infrastructure Automation Expert H/F
Infrastructure Automation Expert H/F

BlackCube Labs • Levallois-Perret

Sur place
EUR 90 000 - 120 000
Infrastructure Automation Expert H/F
Infrastructure Automation Expert H/F

Devoteam • Île-de-France

Hybride
EUR 90 000 - 130 000
Formation continue
Événements techniques & Friday Talks
Collectif de 50 tribus d’expertise
Architecte Cloud Hybride & Infrastructure (F/H)
Architecte Cloud Hybride & Infrastructure (F/H)

Devoteam • Levallois-Perret

Sur place
EUR 90 000 - 130 000
AI Security Specialist (F/H)
AI Security Specialist (F/H)

Devoteam | Cyber Trust • Levallois-Perret

Sur place
EUR 45 000 - 60 000
Certifications techniques en libre accès
Suivi de carrière par un manager tech
Événements internes et activités culturelles
AI Platform Engineer (F/H)
AI Platform Engineer (F/H)

Devoteam • Levallois-Perret

Sur place
EUR 70 000 - 100 000