Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.
ADVEEZ recherche un ingénieur DevOps/SRE pour soutenir les plateformes SaaS dans un cadre hybride. Vous piloterez l’infrastructure cloud, garantirez la haute disponibilité et participerez à l’industrialisation des déploiements.
Vous travaillerez sur Kubernetes managé, IaC (Terraform/Ansible) et GitLab CI/CD, avec une priorité à la sécurité, à la performance et à la multi-région, tout en accompagnant les équipes Dev et Data.
Au sein du pôle R&D, le service infrastructure et plateforme conçoit, exploite et sécurise les environnements cloud qui hébergent les plateformes SaaS Adveez ainsi que les services d’ingestion et de traitement des données issues des équipements connectés.
Vous intégrerez une équipe dynamique et pluridisciplinaire (développement backend, frontend, données, systèmes embarqués). Vous interviendrez sur l’ensemble du cycle de vie de nos plateformes, de l’automatisation des déploiements à l’exploitation en production, au sein d’une équipe ou en autonomie selon la nature et la complexité du sujet. Deux chantiers structurants vous attendent : le passage de la plateforme à une architecture multi-région et la certification ISO 27001.
Vous serez amené(e) à :
Concevoir, industrialiser et faire évoluer l’infrastructure Kubernetes managée qui héberge nos plateformes SaaS.
Participer activement à l’évolution de la plateforme vers une architecture multi-région, afin de répondre aux enjeux de proximité, de souveraineté des données et de continuité de service de nos clients internationaux.
Contribuer activement à la démarche de certification ISO 27001 : mise en œuvre des mesures techniques, production des preuves, préparation des audits et réponse aux questionnaires sécurité de nos clients.
Automatiser le provisionnement des environnements et les déploiements via l’Infrastructure as Code et les chaînes CI/CD.
Garantir la disponibilité, la performance et la scalabilité de la plateforme : haute disponibilité, sauvegardes, plans de restauration, gestion de la capacité.
Mettre en place et exploiter l’observabilité : métriques, logs, traces, tableaux de bord et alerting.
Diagnostiquer les incidents de production, en assurer la résolution et le suivi post-mortem, puis mettre en œuvre les actions correctives.
Renforcer la sécurité de la plateforme : gestion des secrets et des certificats, durcissement des configurations, maîtrise des accès, réponse aux exigences de sécurité de nos clients grands comptes.
Optimiser les coûts d’infrastructure et l’usage des ressources cloud.
Accompagner les équipes de développement dans l’industrialisation de leurs services : standards, revues d’architecture, diffusion de la culture DevOps.
Rédiger les documentations d’architecture et d’exploitation nécessaires (en adéquation avec le processus défini dans le cadre de l’ISO 9001).
Communiquer de manière proactive sur l’avancement et les points de blocage.
Le poste est basé à Colomiers (31) et implique une participation ponctuelle aux opérations de maintenance planifiées en dehors des heures ouvrées, afin de limiter l'impact sur nos clients répartis sur plusieurs fuseaux horaires. Il inclut également une participation à l'astreinte, organisée par roulement au sein de l'équipe et donnant lieu à une compensation prévue par la convention collective de la Métallurgie.
Nos plateformes traitent en continu les données de plusieurs milliers d’équipements déployés à travers le monde, pour des clients grands comptes du secteur aéroportuaire. Vous travaillerez sur des problématiques concrètes de haute disponibilité, de forte volumétrie de données, de reprise après incident et de conformité sécurité. L’environnement s’articule autour de :
Cloud et orchestration : Kubernetes managé sur OVHcloud, Docker, Helm, approche GitOps
Infrastructure as Code et automatisation : Terraform, Ansible, GitLab CI/CD
Données et middlewares : PostgreSQL à forte volumétrie, séries temporelles, Redis/Valkey, file de messages MQTT
Observabilité : stack ELK, Prometheus, Grafana, agrégation de logs, alerting
Sécurité : gestion centralisée des secrets et des certificats (Vault, PKI interne), durcissement et gestion des accès
Maîtrise de Kubernetes en production : déploiement, exploitation, dépannage, et de l’écosystème conteneurs (Docker, Helm), idéalement sur une offre managée
Solide expérience de l’Infrastructure as Code et de l’automatisation (Terraform, Ansible ou équivalents)
Maîtrise des chaînes d’intégration et de déploiement continus (GitLab CI/CD ou équivalent) et des pratiques GitOps
Bonne maîtrise de Linux et des fondamentaux réseau : DNS, TLS, routage, répartition de charge, filtrage
Expérience de l’exploitation de bases de données et middlewares en production : sauvegarde, restauration, réplication, supervision
Pratique d’au moins un langage d’automatisation (Python, Bash, Go)
Culture de l’observabilité et de la sécurité opérationnelle (supervision, gestion des secrets, gestion des vulnérabilités)
Maîtrise de l’anglais technique
Expérience concrète d’OVHcloud, en particulier de son offre Kubernetes managé et de ses spécificités d’exploitation : c’est notre environnement cible et cette expérience est particulièrement valorisée
À défaut, expérience d’un hyperscaler (AWS, GCP, Azure) ou d’un autre cloud européen (Scaleway)
Expérience de la conception ou de l’exploitation d’architectures multi-région : réplication des données, bascule, routage global
Participation à un programme de certification ISO 27001 ou à un référentiel équivalent, et sensibilité aux exigences RGPD et NIS2
Expérience des données de séries temporelles à forte volumétrie (TimescaleDB, InfluxDB ou équivalent) : modélisation, stratégies de rétention et d’agrégation, performance des requêtes
Connaissance des enjeux IoT à forte volumétrie : ingestion massive, traitement asynchrone, bus et files de messages (MQTT, Kafka ou équivalent)
Expérience de l’exploitation de plateformes multi-tenant à l’international
Rigoureux(se) et méthodique
Autonome, avec une réelle capacité d’initiative
À l’écoute et bon(ne) communicant(e), avec un bon esprit d’analyse et de synthèse
Sens du service et sang-froid en situation d’incident
Curieux(se), vous suivez l’évolution des technologies du secteur
Issu(e) d’une formation bac+5 en informatique, systèmes et réseaux ou équivalent
Une expérience significative de minimum 5 ans en DevOps, SRE ou administration de plateformes cloud
Rémunération envisagée : 50 à 55K€
Prime d’intéressement
Prime sur objectif
Carte ticket restaurant
Organisation flexible : poste hybride incluant jusqu’à deux jours de télétravail par semaine.