Recevez plus de réponses des employeurs
Envoyez un CV adapté au poste en quelques minutes.
Numspot est la plateforme technologique souveraine et sécurisée, alliant innovation, flexibilité et confiance pour accélérer la transformation numérique des acteurs publics et privés. Hybride et portable, elle combine les avantages du cloud public avec une interopérabilité totale (on premise, cloud-environnements) et des standards de sécurité exigeants (ISO 27001 déjà acquis, HDS et SecNumCloud en cours).
Open source first, Numspot garantit autonomie, réversibilité et maîtrise des données, tout en répondant aux enjeux critiques de la data et de l’IA. 100 % immunisée contre les lois extraterritoriales, elle s’appuie sur un actionnariat français de référence des secteurs public et privé (Banque des Territoires, Docaposte, Dassault Systèmes et Bouygues Telecom), et des certifications reconnues pour offrir une confiance numérique absolue.
NumSpot recrute un·e Site Reliability Engineer (SRE) confirmé·e pour fiabiliser et faire monter en puissance l’ensemble des services managés PaaS de sa plateforme cloud souveraine. Le rôle est au cœur de l’industrialisation : disponibilité, performance, et capacité à diagnostiquer vite quand ça bouge en production.
Votre mission : mettre en place et faire vivre les pratiques, l’outillage et les automatismes qui permettent aux équipes Engineering de livrer des services managés stables, observables et opérables, avec des objectifs de fiabilité mesurés.
Pourquoi maintenant : l’offre PaaS s’enrichit et se déploie. Pour tenir la trajectoire, la fiabilité doit être traitée comme un produit, avec des standards (SLI/SLO), des signaux (métriques, logs, traces) et des boucles d’amélioration continue.
Vous travaillez au sein du département Engineering, en équipe avec les SRE, au contact direct des équipes de développement et des équipes en charge de l’exploitation. L’équipe Services Managés porte des services PaaS (dont Kubernetes et des bases de données managées) qui doivent être simples à consommer et robustes en production.
Dans ce rôle, vous intervenez à la fois sur le terrain (incidents, troubleshooting, amélioration de la production) et sur la structure (observabilité, automatisation, SLO, standards d’exploitation). Vous aidez à transformer des problèmes récurrents en actions concrètes : instrumentation, amélioration d’un runbook, automatisation d’une opération, ou durcissement d’une configuration.
L’objectif est de rendre les services managés plus fiables et plus faciles à opérer.
Vous avez une expérience de SRE/DevOps en production sur des systèmes distribués et vous êtes à l’aise pour intervenir sur des environnements Kubernetes et des services managés. Vous savez prioriser entre une correction immédiate et une correction durable, et vous documentez ce qui rend l’exploitation plus simple pour toute l’équipe.
Capacité à travailler sans supervision directe tout en identifiant les axes d’amélioration.
Être force de proposition sur les choix technologiques et organisationnels.
Aptitude à collaborer avec des profils variés, en favorisant la cohésion et le partage de connaissances.
Expliquer des concepts complexes de manière simple et accessible.
Nous privilégions les leaders capables de reconnaître la valeur des contributions des autres et de continuer à apprendre, peu importe leur expérience.
Nous encourageons un esprit d’entraide et de coopération entre les équipes, car nous croyons que le succès collectif surpasse les réalisations individuelles.
Vous avez une passion pour développer des solutions qui répondent non seulement aux besoins des utilisateurs, mais qui contribuent également à la défense de l’intérêt général et impactent positivement la société.
Vous êtes curieux(se) et toujours en quête d’innovation, que ce soit pour vous-même ou pour le produit.