DevOps et Site Reliability Engineering pour une infrastructure d’actifs numériques réglementée

Onyx-Conseil

Courbevoie

Sur place

EUR 75 000 - 110 000

Plein temps

Il y a 8 jours
Générateur de candidature

Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.

Passez les filtres ATS

Résumé du poste

Onyx-Conseil recherche une experts DevOps et SRE pour concevoir et exploiter une plateforme sécurisée et hautement disponible dédiée aux actifs numériques tokenisés.

Le rôle couvre l’Infrastructure as Code avec Terraform, Kubernetes, et des pipelines CI/CD sécurisés, avec une observabilité complète et la définition des SLO/SLI et budgets d’erreur. Astreintes 24/7, runbooks et sécurité renforcée font partie du poste.

Qualifications

  • Expérience en DevOps/SRE dans un cadre financier ou réglementé.
  • Maîtrise des pratiques IaC et d’orchestrations conteneurisées.
  • Bonnes compétences en observabilité ( métriques, logs, traces) et SLO/alerting.

Responsabilités

  • Concevoir et mettre en œuvre l’Infrastructure as Code (Terraform).
  • Construire et optimiser des pipelines CI/CD sécurisés et sans interruption.
  • Architecturer des workloads conteneurisés avec Kubernetes et assurer l’observabilité complète.
  • Définir et opérer des SLO/SLI et des budgets d’erreur.
  • Mettre en place une gestion des astreintes 24/7 et des runbooks opérationnels.
  • Renforcer la sécurité et assurer la conformité dans un environnement auditable.

Connaissances

DevOps
SRE
Infrastructure as Code
Kubernetes
CI/CD
Observabilité

Outils

Terraform
Docker
CI/CD tools

Description du poste

Contexte de la mission

Nous recherchons une expertise en DevOps et Site Reliability Engineering (SRE) afin de contribuer à la construction et à l’exploitation d’une plateforme sécurisée, réglementée et hautement disponible dédiée aux instruments financiers tokenisés.

L'entreprise développe une nouvelle capacité autour des Digital Assets, destinée à supporter la tokenisation, les technologies de registres distribués (DLT) et la prochaine génération d’infrastructures des marchés financiers.

Nous recherchons une expertise en Infrastructure as Code (IaC), Kubernetes, plateformes conteneurisées et pipelines CI/CD, afin de construire des fondations scalables et de permettre des déploiements contrôlés sans interruption de service (zero downtime).

Une observabilité complète est nécessaire afin d’assurer l’exploitation d’un service disponible 24h/24 et 7j/7 : métriques, logs, traces, alerting, Service Level Objectives (SLO) et error budgets. Nous recherchons également une expertise opérationnelle sur la gestion des astreintes, la réponse aux incidents, la création de runbooks opérationnels, les postmortems et le maintien de la stabilité de la plateforme lors d’évolutions rapides des produits et technologies.

La mission devra intégrer des pratiques d’infrastructure sécurisées et auditables, adaptées à des workloads réglementés, avec une collaboration étroite avec les équipes sécurité et des contrôles rigoureux concernant l’utilisation de l’IA dans les activités d’engineering.

Nous recherchons également une expertise dans l’utilisation de l’AIOps pour la détection d’anomalies, le triage des alertes, la synthèse des incidents ainsi que le monitoring, l’exploitation et le rollback des services IA/ML intégrés aux produits.

Objectifs et livrables

L’objectif est de mettre en place une fondation opérationnelle résiliente pour une plateforme réglementée d’actifs numériques et de garantir une exploitation fiable à grande échelle.

  • Concevoir et mettre en œuvre l’Infrastructure as Code, notamment avec Terraform, pour le provisioning et la gestion de configurations versionnées et maintenables
  • Construire et optimiser des pipelines CI/CD sécurisés, couvrant intégration continue, déploiement continu, validations automatisées, approbations, auditabilité et mises en production sans interruption
  • Architecturer et exploiter des workloads conteneurisés avec Kubernetes et les technologies d’orchestration associées
  • Mettre en place une solution d’observabilité de bout en bout couvrant métriques, centralisation des logs, distributed tracing, dashboards, alerting et indicateurs de santé opérationnelle
  • Définir et opérationnaliser les SLO, SLI et error budgets en cohérence avec les exigences de fiabilité de la plateforme
  • Mettre en place un modèle d’astreinte 24/7 efficace, incluant procédures d’escalade, workflows de gestion des incidents, responsabilités et continuité de service
  • Produire et maintenir des runbooks clairs et opérationnels pour les opérations récurrentes, incidents, déploiements, reprises et scénarios de panne
  • Renforcer la sécurité de l’infrastructure : hardening, principe du moindre privilège, gestion des secrets, correction des vulnérabilités, contrôles de conformité et gestion auditable des changements
  • Utiliser des outils d’IA pour assister l’ingénierie, notamment sur l’IaC et la création des pipelines, avec une revue humaine documentée et des contrôles d’approbation avant déploiement
  • Mettre en œuvre des capacités AIOps pour la détection d’anomalies, le triage des alertes, la synthèse des incidents et la rédaction des postmortems
  • Déployer, superviser, exploiter et effectuer des rollbacks sécurisés des services IA/ML, notamment sur les aspects performance, disponibilité et monitoring opérationnel des modèles
  • Produire la documentation technique : décisions d’architecture, procédures opérationnelles, métriques de fiabilité et recommandations d’amélioration continue
  • Garantir la stabilité et la disponibilité de la plateforme malgré des évolutions rapides du produit, tout en maintenant les standards imposés par un environnement réglementé et les objectifs de zero downtime
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Développeur / Développeuse informatique (H/F)
Développeur / Développeuse informatique (H/F)

Espritek • Courbevoie

Sur place
EUR 65 000 - 90 000
INGENIEUR CLOUD. TJM 530/540
INGENIEUR CLOUD. TJM 530/540

Onyx-Conseil • Châtillon

Sur place
EUR 120 000 - 130 000
Ingénieur Devops
Ingénieur Devops

Onyx-Conseil • Valbonne

Sur place
EUR 70 000 - 110 000
Architecte Devops / SRE (h/f) (IT) / Freelance
Architecte Devops / SRE (h/f) (IT) / Freelance

Onyx-Conseil • Courbevoie

Sur place
EUR 70 000 - 100 000
Expert Infras As Code (Ansible, Terraform, Openshift, Gitlab-Ci)
Expert Infras As Code (Ansible, Terraform, Openshift, Gitlab-Ci)

PROPULSE IT • Paris

Sur place
EUR 65 000 - 90 000
Ingénieur DevOps - Socle Technique - Infogérance - Dataplateforme H/F
Ingénieur DevOps - Socle Technique - Infogérance - Dataplateforme H/F

ENOVA France • Valbonne

Sur place
EUR 70 000 - 100 000
Ingénieur(e) Réseau & Système / SRE Freelance (IT) / Freelance
Ingénieur(e) Réseau & Système / SRE Freelance (IT) / Freelance

Onyx-Conseil • Paris

Hybride
EUR 129 000 - 185 000
Ingénieur DevOps Infrastructure
Ingénieur DevOps Infrastructure

Global Experts Consulting • Nanterre

Sur place
EUR 50 000 - 70 000
Lead DevOps & SRE - Infra IaC, Kubernetes, 24/7 Resilience
Lead DevOps & SRE - Infra IaC, Kubernetes, 24/7 Resilience

Onyx-Conseil • Courbevoie

Sur place
EUR 75 000 - 110 000
DevOps Engineer IA - Projet innovation vibe coding
DevOps Engineer IA - Projet innovation vibe coding

Tricefal • France

Sur place
EUR 50 000 - 70 000