Obtenez une réponse de cet employeur — un CV et une lettre de motivation adaptés exactement à ce qu’on recherche pour ce poste.
Exotrail SA recherche un Site Reliability Engineer pour garantir la fiabilité, la disponibilité et la sécurité de sa plateforme technique. Vous piloterez l'automatisation opérationnelle et l'amélioration continue, avec une dimension Run et Build dédiée à l'évolution des infrastructures et des outils.
Vous collaborerez étroitement avec les équipes pour diffuser les bonnes pratiques SRE et DevOps. Le poste couvre des environnements cloud privés et publics, l'infrastructure as code, la supervision
Exotrail est une scale-up spatiale fondée en 2017 avec une ambition claire : fournir des solutions de mobilité pour un espace durable, sûr et accessible.
Nous développons des technologies innovantes au service des infrastructures spatiales de demain, en combinant logiciels, propulsion et services en orbite.
Chez Exotrail, nous cultivons une culture orientée impact, amélioration continue et excellence technique. Inspirés du monde du logiciel, nous privilégions l'autonomie, la responsabilité et la collaboration afin de construire des produits performants au service de nos clients.
Aujourd'hui, nous poursuivons notre croissance avec la volonté de construire une entreprise industrielle ambitieuse et durable.
En tant que Site Reliability Engineer, vous garantissez la fiabilité, la disponibilité, la sécurité et la performance de la plateforme technique d'Exotrail.
Cette plateforme héberge l'ensemble des workloads de l'entreprise, incluant des applications critiques et des environnements industriels à forte exigence.
À la croisée du développement logiciel, des opérations et de l'ingénierie système, vous contribuez à l'automatisation des opérations, à l'amélioration continue de la plateforme et à l'accompagnement des équipes dans les pratiques de fiabilité.
Le poste est majoritairement orienté Run, avec une dimension Build dédiée à l'évolution des infrastructures et des outils.
Assurer la fiabilité des plateformes
Garantir la disponibilité, la résilience et les performances des plateformes.
Opérer et maintenir les différents environnements (cloud privé, cloud public, PRA).
Définir et suivre les indicateurs de fiabilité (SLI, SLO, SLA).
Participer à l'astreinte et au maintien des services critiques.
Automatiser et industrialiser
Concevoir et faire évoluer l'Infrastructure as Code.
Maintenir les pipelines CI/CD.
Développer des outils d'automatisation et des scripts.
Participer à l'évolution des pratiques GitOps.
Renforcer la sécurité et la résilience
Piloter les stratégies de sauvegarde et de reprise d'activité.
Mettre en œuvre les bonnes pratiques de sécurité opérationnelle.
Gérer les accès, les secrets et la connectivité sécurisée.
Contribuer à la conformité et à la gestion des risques.
Améliorer l'observabilité
Développer et maintenir les outils de monitoring, de logs et de traçabilité.
Gérer les incidents critiques et conduire les analyses post-mortem.
Identifier les axes d'amélioration des performances.
Documenter les procédures et les runbooks.
Accompagner les équipes
Collaborer avec les développeurs pour intégrer la fiabilité dès la conception.
Diffuser les bonnes pratiques SRE et DevOps.
Accompagner les équipes dans la montée en compétence sur les sujets plateforme.
Infrastructure as Code : Terraform, Ansible, Helm
CI/CD : GitLab
Scripting : Python, Bash
Observabilité : Grafana, Prometheus, Loki, Zabbix, Graylog
Cloud & Virtualisation : Kubernetes, OpenStack, S3
Systèmes : Linux, Windows
Bases de données : PostgreSQL, MariaDB, ClickHouse
Réseaux : DNS, TLS, IPSec, TCP/IP
Sécurité : DevSecOps, SAST, DAST
Vous justifiez d'au moins 10 ans d'expérience sur des fonctions SRE, DevOps ou Infrastructure dans des environnements complexes ou critiques.
Vous appréciez les environnements exigent...