Ingénieur MLOps GPU & Infra - Orchestration et LLM

CENTRE DE LA FORMATION ET DU DÉVELOPPEMENT DES COMPÉTENCES

Île-de-France

Sur place

EUR 55 000 - 90 000

Plein temps

Il y a 3 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.

Passez les filtres ATS

Résumé du poste

Le CENTRE DE LA FORMATION ET DU DÉVELOPPEMENT DES COMPÉTENCES recherche un ingénieur Infra GPU en Île-de-France pour dimensionner et déployer un cluster GPU sur OVHcloud, optimiser les coûts et les performances via Terraform et Kubernetes.

Vous industrialiserez la couche GPU (drivers, runtime conteneur, orchestrateur) et opérerez les serveurs d'inférence, QoS et évolutions des modèles, tout en exposant une passerelle LLM interne et des API sécurisées.

Responsabilités

  • Dimensionner et déployer le cluster GPU sur OVHcloud en choisissant instances, cartes et équilibre coût/mémoire/débit.
  • Industrialiser la couche GPU (drivers, runtime conteneur, opérateur GPU sur Kubernetes, partage et ordonnancement des cartes).
  • Opérer les serveurs d'inférence et gérer le cycle de vie des modèles, quantification et batching.
  • Exposer une passerelle LLM interne avec API, authentification et quotas.
  • Construire les briques d'appui (embeddings, recherche vectorielle, RAG).
  • Garantir le cadre données de santé (isolation, traçabilité, conformité).
  • Surveiller et maîtriser les coûts (métriques, taux d'occupation, coût par requête).
  • Contribuer au socle commun (IaC, CI, run de l'équipe).

Connaissances

Gestion GPU
Terraform
Kubernetes
CUDA
Linux

Outils

Docker
CI/CD

Description du poste

Le CENTRE DE LA FORMATION ET DU DÉVELOPPEMENT DES COMPÉTENCES recherche un ingénieur Infra GPU en Île-de-France pour dimensionner et déployer un cluster GPU sur OVHcloud, optimiser les coûts et les performances via Terraform et Kubernetes.

Vous industrialiserez la couche GPU (drivers, runtime conteneur, orchestrateur) et opérerez les serveurs d'inférence, QoS et évolutions des modèles, tout en exposant une passerelle LLM interne et des API sécurisées.

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Ingénieur MLOps GPU – Infrastructure & LLM Santé
Ingénieur MLOps GPU – Infrastructure & LLM Santé

Assistance publique – Hôpitaux de Paris (AP-HP) • Paris

Sur place
EUR 45 000 - 55 000
Télétravail partiel possible
Remboursement transports 75%
Restaurant du personnel
Ingénieur MLOps GPU — Santé, Infra & Données Sécurisées
Ingénieur MLOps GPU — Santé, Infra & Données Sécurisées

Siège de l'AP-HP • Paris

Sur place
EUR 45 000 - 55 000
Ingénieur MLOps GPU & Infra — LLM et K8s
Ingénieur MLOps GPU & Infra — LLM et K8s

AP-HP - Direction des Services Numériques (DSN) • Paris

Sur place
EUR 70 000 - 110 000
Ingénieur MLOps F/H
Ingénieur MLOps F/H

CENTRE DE LA FORMATION ET DU DÉVELOPPEMENT DES COMPÉTENCES • Île-de-France

Sur place
EUR 55 000 - 90 000
Ingénieur MLOps GPU – Infra & Santé | Télétravail Possible
Ingénieur MLOps GPU – Infra & Santé | Télétravail Possible

AP-HP • Paris

Hybride
EUR 70 000 - 100 000
Télétravail partiel
Remboursement transports 75%
Repas sur place
+1
Ingénieur MLOps IA & GPU/Kubernetes CI/CD
Ingénieur MLOps IA & GPU/Kubernetes CI/CD

OCI Informatique • Mundolsheim

Sur place
EUR 60 000 - 90 000
Tickets Restaurant
Mutuelle santé
Welcome Pack
AI Platform Engineer - LLM Ops on OpenShift GPUs
AI Platform Engineer - LLM Ops on OpenShift GPUs

France Travail • Levallois-Perret

Sur place
EUR 67 000 - 100 000
Ingénieur MLOps F/H
Ingénieur MLOps F/H

AP-HP - Direction des Services Numériques (DSN) • Paris

Sur place
EUR 70 000 - 110 000
DevOps GPU Engineer for On-Prem AI Platforms
DevOps GPU Engineer for On-Prem AI Platforms

Metaline • France

Hybride
EUR 70 000 - 90 000
Leader Technique IA & Infra GPU
Leader Technique IA & Infra GPU

OVHcloud • Lyon

Sur place
EUR 90 000 - 140 000