Ingénieur MLOps F/H

AP-HP

Paris

Hybride

EUR 70 000 - 100 000

Plein temps

Il y a 2 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Une candidature complète en une minute — CV personnalisé et lettre de motivation, prêts à envoyer.

Passez les filtres ATS

Avantages offerts par ce poste

Télétravail partiel
Remboursement transports 75%
Repas sur place
Formation interne

Résumé du poste

L'AP-HP, Direction des Services Numériques, recrute un ingénieur MLOps F/H pour dimensionner et déployer l'infrastructure GPU, déployer des moteurs d’inférence et construire les briques associées (RAG, embedding, API interne).

Le candidat maîtrise Terraform, Ansible et Kubernetes, et possède une expérience solide en Python, CI/CD et gestion des charges GPU, dans un environnement de santé.

Qualifications

  • Diplôme d'ingénieur ou équivalent requis.
  • 3 ans d'expérience minimum en infra, DevOps ou MLOps, avec expertise GPU.
  • Maîtrise opérationnelle de Terraform et Ansible, dépôt Git et CI/CD.

Responsabilités

  • Dimensionner et déployer le cluster GPU sur OVHcloud, en veillant au coût/mémoire/débit.
  • Industrialiser la couche GPU (drivers, runtime conteneur, Kubernetes, partage des cartes).
  • Opérer les serveurs d'inférence et gérer les versions de modèles (quantification, batching, latence).
  • Exposer une passerelle LLM interne avec API sécurisée et quotas.
  • Construire embeddings et recherche vectorielle (RAG) et évaluer la qualité des réponses.
  • Assurer la conformité données de santé et traçabilité des accès/inférences.
  • Surveiller les coûts GPU et optimiser l'utilisation des ressources.
  • Contribuer au socle commun IaC et CI pour le run de l'équipe.

Connaissances

Terraform
Ansible
Kubernetes
Python
CI/CD
GPU
MLOps
LLM
RAG
Shell

Formation

Diplôme d'ingénieur ou équivalent

Outils

Terraform
Ansible
Kubernetes
vLLM

Description du poste

Identifiant (email, de type exemple@exemple.fr)

Mots clés (ex : infirmier en soins généraux)

Informatique & Numérique - Applications - Développement

Intitulé du poste

Ingénieur MLOps F/H

Type de contrat

CDD uniquement

Présentation du service

La Direction des Services Numériques (DSN) de l’AP-HP fournit des services numériques aux patients et aux professionnels, dont le dossier patient, des systèmes pour la biologie et l’imagerie, un espace patient, des progiciels de gestion et une offre bureautique sur plus de 70 000 postes.

La Banque Nationale de Données Maladies Rares (BNDMR) : Le 2ème plan national maladies rares (PNMR2) prévoit la création d'une banque nationale de données des maladies rares. Cette action a été reconduite et amplifiée au sein du 3ème plan national (PNMR3) puis du 4ème plan national (PNMR4) en vigueur depuis 2025.

L'équipe et son périmètre : Nous opérons l'infrastructure et les plateformes qui collectent, hébergent et valorisent les données de santé des patients atteints de maladies rares : les applications métier utilisées quotidiennement dans les centres de référence, l'entrepôt de données associé, et tout le socle technique qui les porte.

L'intégralité de cette infrastructure vit sur OVHcloud, sur plusieurs régions et plusieurs environnements, et elle est décrite en code : Terraform / Terragrunt pour l'infrastructure et l'IAM, Ansible pour la configuration des machines et des services, GitLab CI pour dérouler le tout.

L'équipe a la charge complète du maintien en condition opérationnelle : réseau, DMZ et pare-feux, bastion et VPN, PKI et certificats, identités et accès, supervision et alerting, sauvegardes et restaurations, chaîne CI/CD interne.

  • - Dimensionner et déployer le cluster GPU sur OVHcloud : choix des instances et des cartes, arbitrages coût / mémoire / débit, réseau et stockage adaptés aux poids de modèles, le tout décrit en Terraform comme le reste de notre infrastructure.
  • - Industrialiser la couche GPU : drivers et pilotes CUDA, runtime conteneur GPU, opérateur GPU sur Kubernetes, partage et ordonnancement des cartes entre charges de travail, mise à l'échelle et extinction des ressources inutilisées.
  • - Opérer les serveurs d'inférence : déploiement et réglage de moteurs type vLLM ou équivalents, gestion du cycle de vie des modèles et de leurs versions, quantification, batching, mesure et optimisation de la latence et du débit.
  • - Exposer une passerelle LLM interne : API compatible avec les clients standards, authentification, quotas et suivi de consommation, journalisation — pour les applications comme pour les outils de l'équipe.
  • - Construire les briques applicatives d'appui : embeddings et recherche vectorielle, chaînes de RAG sur nos référentiels et notre documentation, évaluation de la qualité des réponses.
  • - Garantir le cadre données de santé : isolation stricte des environnements, aucune donnée sortante, traçabilité des accès et des inférences, en lien avec la sécurité et la conformité.
  • - Observer et maîtriser les coûts : métriques GPU, saturation, taux d'occupation, coût par requête et par usage — la sobriété fait partie du travail.
  • - Contribuer au socle commun : l'infrastructure GPU n'est pas une île, vous participez aussi à l'IaC, à la CI et au run de l'équipe.
Profil recherché

Idéalement, vous avez …

  • - Un diplôme d’ingénieur ou équivalent (Mathématique, Informatique, Santé publique, etc.)
  • - 3 ans d'expérience minimum en infrastructure, DevOps ou MLOps, dont une expérience significative sur des charges GPU. Un profil DevOps qui s'est spécialisé vers le GPU nous intéresse autant qu'un profil MLOps qui a gardé les mains dans l'infrastructure.

Vous maitrisez :

  • - Une pratique réelle de Terraform et d'Ansible : ce poste est un poste d'infrastructure avant d'être un poste d'IA.
  • - Une expérience concrète de déploiement de charges GPU : vous avez déjà fait tourner des modèles sur des cartes que vous administriez, et vous connaissez les pièges — mémoire, drivers, conteneurs, files d'attente.
  • - Une bonne connaissance de l'écosystème LLM open weights : serveurs d'inférence, formats et quantifications, dimensionnement mémoire d'un modèle, compromis qualité / vitesse / coût.
  • - Kubernetes en conditions réelles : déploiements, ressources et limites, stockage persistant, opérateurs.
  • - Vous codez pour de vrai : Python solide, shell, API et conteneurs — vous livrez du code lisible, testé et versionné.
  • - Un esprit d'évaluation : vous mesurez avant d'affirmer, y compris sur la qualité des sorties d'un modèle.

Vous avez une bonne connaissance :

  • - Recherche vectorielle et RAG, observabilité LLM, fine-tuning léger, sensibilité aux enjeux de confidentialité en santé.

Et humainement ? vous êtes …

  • - doté(e) de qualités relationnelles et de communication : savoir écouter, dialoguer, argumenter en s’adaptant à l’ensemble des interlocuteurs, faire preuve de maîtrise de soi et de diplomatie
  • - doté(e) d’une aisance orale et rédactionnelle
  • - organisé(e), rigoureux(se) et méthodique
  • - flexible, vous vous adaptez à votre environnement
  • - motivé(e) et êtes intéressé(e) par le domaine de la santé
  • - de nature curieuse, vous aimez découvrir et apprendre tous les jours
Temps de travail

Administratif - Forfait

Vos avantages à l'AP-HP
  • - Possibilité de télétravail si le poste le permet ;
  • - Remboursement partiel des transports en commun (75%) et/ou forfait mobilité ;
  • - Accès au restaurant du personnel à tarifs avantageux ;
  • - Un centre formation et de développement des compétences interne pour les formations management, les renforcement Métiers… ;
  • - 19 jours de RTT, en plus des 25 jours de congés;
  • - Une offre de sorties culturelles, de voyages, de centres de vacances pour les titulaires et CDD sur poste permanent (AGOSPAP), des réductions et des bons plans (HOPTISOINS) ;
  • - Pour les enfants, crèches internes, voyages culturels, séjours linguistiques et possibilité de bénéficier du supplément familial de traitement.
Localisation du poste

France, Ile-de-France, Paris (75)

Ville

Direction des Services Numériques

Entité de rattachement du publieur

La Direction des Services Numériques (DSN) de l'AP-HP est chargée de fournir des services numériques sécurisés, adaptés aux besoins des professionnels et des patients.

Son objectif est de contribuer à une meilleure prise en charge, ainsi qu'au développement de la recherche et de l'innovation, au travers de l'entrepôt de données de santé. Elle offre un support informatique unifié, en lien avec les directions des systèmes d'information des 6 groupes hospitalo-universitaires (GHU), des pôles d'intérêt commun (PIC) et des sites.

Elle développe et gère plusieurs centaines de services numériques, regroupés dans un catalogue, incluant le dossier patient informatisé, les systèmes de biologie et d'imagerie, l'espace patient mon.aphp.fr, les progiciels de gestion et de facturation, ainsi que l'offre bureautique sur plus de 70 000 postes de travail.

Elle administre également ses infrastructures avec un réseau interne, trois centres de données, avec une offre de services sur la téléphonie et sur les accès par wifi sur les sites de l'AP-HP. Elle accompagne la réutilisation des données de santé pour répondre aux besoins de pilotage de l'activité hospitalière, d'amélioration du parcours médico-administratif des patients, ou encore de la recherche et d'innovation, au travers de l'entrepôt de données de santé. Elle offre un support informatique unifié, en lien avec les directions des systèmes d'information des 6 groupes hospitalo-universitaires (GHU), des pôles d'intérêt commun (PIC) et des sites.

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Ingénieur MLOps F/H
Ingénieur MLOps F/H

Assistance publique – Hôpitaux de Paris (AP-HP) • Paris

Sur place
EUR 45 000 - 55 000
Télétravail partiel possible
Remboursement transports 75%
Restaurant du personnel
Ingénieur DevOps / SRE & Cloud F/H
Ingénieur DevOps / SRE & Cloud F/H

Assistance publique – Hôpitaux de Paris (AP-HP) • Paris

Hybride
EUR 47 000 - 55 000
Télétravail possible
Remboursement partiel des transports
Restaurant du personnel
+4
Ingénieur DevOps / SRE & Cloud F/H
Ingénieur DevOps / SRE & Cloud F/H

AP-HP • Paris

Sur place
EUR 80 000 - 110 000
Télétravail possible
Transports remboursés
Restaurant du personnel
+3
Expert Technique Stockage F/H
Expert Technique Stockage F/H

AP-HP • Paris

Hybride
EUR 48 000 - 75 000
Télétravail possible
Transports remboursés
Restaurant sur site
+4
Chef de Projet Digital Senior – Editorial & Web
Chef de Projet Digital Senior – Editorial & Web

AP-HP • Paris

Hybride
EUR 65 000 - 90 000
Télétravail après période d’essai
25 jours de congés + RTT
Tickets restaurant
+4
Chef de projet senior – digital & éditorial
Chef de projet senior – digital & éditorial

AP-HP • Paris

Hybride
EUR 65 000 - 90 000
Télétravail après période d’essai
25 jours de congés + RTT
Tickets restaurant
+4
Assistant administratif des services SPVF et SLGAI F/H
Assistant administratif des services SPVF et SLGAI F/H

AP-HP • Île-de-France

Sur place
EUR 32 000 - 42 000
Assistant administratif des services SPVF et SLGAI F/H
Assistant administratif des services SPVF et SLGAI F/H

Assistance publique – Hôpitaux de Paris (AP-HP) • Paris

Sur place
EUR 32 000 - 42 000
Remboursement Navigo 75%
15 jours RTT + 25 jours congés
Tickets restaurants 10€ / jour
+2
Chef de projet digital senior – éditorial et pilotage projets
Chef de projet digital senior – éditorial et pilotage projets

AP-HP • Paris

Hybride
EUR 70 000 - 90 000
Tickets restaurant
Navigo remboursé 75%
Formation continue
+2
Coordinatrice d'études cliniques F/H
Coordinatrice d'études cliniques F/H

AP-HP • Paris

Sur place
EUR 43 000 - 58 000
Télétravail
Hoptisoins