Une candidature complète en une minute — un CV et une lettre de motivation personnalisés, prêts à être envoyés.
PIXID, acteur majeur du SaaS RH, recherche un Site Reliability Engineer Senior pour accompagner la montée en charge de sa plateforme. basé à Courbevoie avec télétravail fréquent, vous pilotez la production, la résilience et les performances sur un socle technique moderne.
Vous intervenez sur des incidents critiques, conduisez les post-mortems, et faites évoluer l’infrastructure via l’automatisation (IaC) en collaboration avec les équipes infra, sécurité et développement.
CDI – Courbevoie / Télétravail fréquent Environnement SaaS international en croissance stable depuis 20 ans !
Rejoins PIXID, scale-up HR au croisement du SaaS, de la data et de l’expérience utilisateur, en forte croissance en Europe.
Nous accompagnons les entreprises dans la digitalisation de la gestion de leurs talents et de leurs partenaires, à travers des solutions puissantes, fiables et intuitives.
Dans ce contexte de montée en charge et d’exigue accrue sur la performance de notre plateforme, nous renforçons notre équipe en recrutant un Site Reliability Engineer Senior, au cœur de nos enjeux de production et de fiabilité.
PIXID entre dans une phase de transformation ambitieuse et renforce son équipe SRE pour accompagner la montée en puissance de sa plateforme.
Notre environnement est critique :
plus de 222 000 entreprises connectées
plus de 2,5 millions de documents échangés chaque mois
un volume de transactions estimé à 11 milliards d’euros
Dans ce contexte, la fiabilité, la performance et la sécurité ne sont pas négociables.
Tu rejoins une équipe en charge de la production, au cœur d’une infrastructure moderne, avec un rôle clé dans la stabilité et l’évolution de la plateforme.
En tant que SRE Senior, tu es garant de la disponibilité, de la résilience et de la performance des systèmes en production.
Tu interviens sur des incidents critiques, pilotes leur résolution, et contribues activement à l’amélioration continue de l’infrastructure.
Assurer la disponibilité des services en production (24/7)
Diagnostiquer et résoudre des incidents complexes multi-systèmes
Prioriser et restaurer rapidement le service en cas d’incident
Gérer simultanément plusieurs sujets dans des environnements variés
Piloter les incidents majeurs et coordonner les actions
Communiquer efficacement avec les équipes internes
Maintenir un haut niveau de rigueur et de calme en situation critique
Réaliser les post-mortems et analyses des root cause
Identifier les points de fragilité et proposer des solutions durables
Contribuer à l’amélioration des pratiques SRE et des processus
Participer à l’évolution de l’infrastructure et des outils
Automatiser les tâches récurrentes (IaC, scripting)
Collaborer avec les équipes expertes (infra, sécurité, développement)
3+ years en SRE, DevOps ou production engineering
Expérience en environnement SaaS ou plateforme à fort trafic
Expérience solide en gestion d’incidents et production
Connaissances pointues en administration de BDD (idéalement MariaDB, ou MySQL)
Linux (administration avancée)
Kubernetes (déploiement et exploitation)
VMware / virtualisation
Automatisation (Ansible, Terraform)
Bases de données (PostgreSQL/MySQL)
Connaissances réseau, stockage et CI/CD
French speaking C1
Forte capacité d’analyse et de troubleshooting
Autonomie et sens des responsabilités
Capacité à gérer la pression en production
Approche orientée amélioration continue
Offre!
Prêt.e à laisser ton empreinte dans la transformation d’un SaaS solide et bien établi sur son marché ?
Rejoins-nous et fais partie de l’aventure !
Avantages