Site Reliability Engineer (expérimenté, CDI)

Groupe ALTEN

France

Hybride

EUR 70 000 - 95 000

Plein temps

14 jours+
Générateur de candidature

Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.

Passez les filtres ATS

Résumé du poste

Groupe ALTEN recherche un Site Reliability Engineer expérimenté en CDI pour assurer la disponibilité et la résilience des infrastructures et des services critiques.

Vous collaborerez avec les équipes développement, infrastructure et opérations, automatiserez les déploiements et la surveillance, et participerez à l’optimisation des performances et des coûts.

Qualifications

  • Expérience en ingénierie système Linux/Unix.
  • Maîtrise des outils de monitoring et d’alerting (Prometheus, Grafana, Datadog, ELK).
  • Compétences en automatisation : scripting (Python, Bash) et CI/CD (Jenkins, GitLab CI, GitHub Actions), IaC (Terraform, Ansible).
  • Expérience avec les environnements cloud (AWS, GCP, Azure) et architectures microservices (Docker, Kubernetes).
  • Compétences en bases de données SQL/NoSQL et administration.
  • Capacité à diagnostiquer et résoudre les incidents en production.
  • Bonnes compétences de communication et travail en équipe.

Responsabilités

  • Maintien en conditions opérationnelles des systèmes et applications en production, avec amélioration de disponibilité et évolutivité.
  • Automatisation des tâches répétitives et des processus de déploiement, de surveillance et d’alerting.
  • Conception et mise en œuvre de solutions pour améliorer la fiabilité et réduire les pannes.
  • Analyse des incidents et gestion des urgences, avec réduction du MTTR et amélioration de la résilience.
  • Optimisation des performances et gestion des capacités et coûts.
  • Collaboration avec les équipes de développement pour une approche DevOps et intégration SRE en conception.
  • Création et suivi de métriques SLI/SLO/SLA pour mesurer la fiabilité.
  • Veille technologique et amélioration continue des outils et processus SRE.

Connaissances

Ingénierie système
Monitoring & alerting
Automatisation CI/CD
Cloud & microservices
Bases de données SQL/NoSQL
Gestion incidents
Communication & collaboration

Outils

Prometheus
Grafana
Datadog
ELK Stack
Terraform
Ansible

Description du poste

  • Site Reliability Engineer (expérimenté, CDI)
Site Reliability Engineer (expérimenté, CDI)
Site Reliability Engineer (expérimenté, CDI)
Description du poste

En tant que Site Reliability Engineer (SRE), vous jouerez un rôle clé dans le maintien, l’optimisation et la sécurisation des infrastructures informatiques et des systèmes de production. Vous travaillerez en collaboration avec les équipes de développement, d’infrastructure et d’opérations pour garantir une disponibilité et une résilience maximales des services et applications critiques.

Missions principales:

  • Maintien en conditions opérationnelles des systèmes et des applications en production, en optimisant leur disponibilité, performance et évolutivité.
  • Automatisation des tâches répétitives et des processus de déploiement, de surveillance et d’alerting.
  • Conception et mise en œuvre de solutions permettant d’améliorer la fiabilité des systèmes et de réduire le taux de pannes.
  • Analyse des incidents et gestion des urgences, avec pour objectif de diminuer le Mean Time To Recovery (MTTR) et d’accroître la résilience.
  • Optimisation des performances des applications et de l’infrastructure, notamment via la gestion des capacités et des coûts.
  • Collaboration avec les équipes de développement pour favoriser une approche DevOps et intégrer les pratiques SRE dès les phases de conception.
  • Création et suivi de métriques pour mesurer la fiabilité et les performances des systèmes (SLI, SLO, SLA).
  • Veille technologique pour assurer l’amélioration continue des outils et des processus SRE.

Compétences requises:

  • Expérience en ingénierie système : Linux/Unix, gestion de serveurs, stockage, et réseaux.
  • Maîtrise des outils de monitoring et d’alerting (ex. : Prometheus, Grafana, Datadog, ELK Stack).
  • Compétences en automatisation : scripting (Python, Bash, etc.), outils de CI/CD (ex. : Jenkins, GitLab CI, GitHub Actions), et infrastructure-as-code (Terraform, Ansible).
  • Expérience avec les environnements cloud : AWS, GCP, Azure ou autres services cloud, ainsi que les architectures de microservices et conteneurs (Docker, Kubernetes).
  • Compétences en bases de données : administration et optimisation de bases SQL et NoSQL.
  • Capacité à gérer les incidents : compétences en diagnostic et résolution de pannes dans un environnement de production.
  • Bonnes compétences en communication pour collaborer avec des équipes pluridisciplinaires et documenter les processus et solutions.

Compétences bonus

  • Expérience en tant que DevOpsingénieur système ou développeur logiciel
  • Connaissance des méthodologies de développement agile et des pratiques DevOps
  • Participation à la mise en place de processus d’observabilité, de monitoring et de gestion des incidents
  • Expérience dans la gestion de la disponibilité et de la performance
  • Résistance au stress et capacité à travailler efficacement en cas d’incidents critiques.
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Site Reliability Engineer (expérimenté, CDI)
Site Reliability Engineer (expérimenté, CDI)

ALTEN • Valbonne

Sur place
EUR 70 000 - 90 000
Ingénieur – Fiabilité des Sites (SRE)
Ingénieur – Fiabilité des Sites (SRE)

Jobtailor • Toulouse

Sur place
EUR 70 000 - 95 000
Engineering Manager SRE - CDI
Engineering Manager SRE - CDI

Ternair • Lille

Sur place
EUR 90 000 - 130 000
Site Reliability Engineer (Senior) – Production & Reliability
Site Reliability Engineer (Senior) – Production & Reliability

PIXID • Courbevoie

Sur place
EUR 70 000 - 95 000
Ingénieur Systèmes (SRE – Site Reliability Engineer, Devops) - (h/f)
Ingénieur Systèmes (SRE – Site Reliability Engineer, Devops) - (h/f)

emagine • Villeneuve-d'Ascq

Sur place
EUR 60 000 - 85 000
COACH SRE / LEAD SRE (IT) / Freelance
COACH SRE / LEAD SRE (IT) / Freelance

Onyx-Conseil • Paris

Sur place
EUR 90 000 - 130 000
Consultant DevOps senior (H/F)
Consultant DevOps senior (H/F)

Extia • Rouen

Hybride
Confidential
Télétravail possible
Frais de transport remboursés
Tickets restaurant
+2
Ingénieur Observabilité / SRE H/F
Ingénieur Observabilité / SRE H/F

Devoteam • Occitanie

Sur place
EUR 60 000 - 90 000
DevOps Senior H/F
DevOps Senior H/F

Extia • Rennes

Hybride
Confidential
Télétravail possible
Frais de transport pris en charge
Tickets restaurant
+8
Site Reliability Engineer
Site Reliability Engineer

Payplug • Paris

Hybride
EUR 70 000 - 100 000
Organisation de travail hybride
350€ équipements télétravail
25 CP / an et 10 RTT / an
+8