Open Source / Red Hat IA Platform Engineer (H/F)

France Travail

Levallois-Perret

Sur place

EUR 67 000 - 100 000

Plein temps

Il y a 2 jours
Soyez parmi les premiers à postuler
Générateur de candidature

N’envoyez pas un CV générique — générez un CV et une lettre de motivation adaptés à ce poste précis.

Passez les filtres ATS

Résumé du poste

France Travail recherche un AI Platform Engineer pour piloter l’ingénierie des plateformes IA génératives en Île-de-France. Vous concevrez, déployerez et opérerez des environnements d’entraînement, fine-tuning et serving, intégrant l’orchestration LLM et des approches multi-agent.

Le poste porte sur des architectures haute performance, des flux d’optimisation GPU et des pipelines MLOps, avec un focus sécurité et souveraineté des données.

Qualifications

  • Expérience dans le déploiement et l’exploitation de plateformes IA générative (LLMs, SLMs, vision).
  • Maîtrise de Kubernetes/OpenShift et orchestration GPU pour l’entrainement et le serving.
  • Connaissance d’outils Llama Stack et pipelines MLOps pour production.

Responsabilités

  • Concevoir, déployer et opérer des plateformes permettant d’entraîner, fine-tuner et servir des modèles IA sécurisés.
  • Orchestrer les workflows RAG et les pipelines multi-agents.
  • Assurer sécurité, gouvernance et observabilité des stacks IA.

Connaissances

Kubernetes
OpenShift
LLMOps
GPU optimisation
Cloud computing

Outils

NVIDIA GPU Operator
KServe
ModelMesh
Milvus
Qdrant
Kubeflow

Description du poste

En , l'enjeu de l'Intelligence Artificielle en entreprise a basculé du prototypage vers l'ingénierie d'infrastructure, le serving haute performance et la maîtrise des coûts GPU. En tant qu'AI Platform Engineer, vous serez au cœur de cette convergence entre Platform Engineering (Kubernetes / OpenShift) et LLMOps. Vous concevrez, déploierez et opérerez les plateformes industrielles permettant d'entraîner, fine-tuner, orchestrer et servir des modèles d'IA générative (LLM, SLM, vision) sécurisés et souverains. 1Orchestration & Serving LLM Haute Performance (High-Throughput Inference)Déployer, optimiser et opérer les moteurs d'inférence de pointe : vLLM (PagedAttention, Prefix Caching, continuous batching), LLMD, LiteLLM Proxy, SGLang, TGI et Triton Inference Server.Implémenter des architectures de Multi-LoRA Serving (S-LoRA) pour mutualiser un modèle de fondation unique et servir à chaud des dizaines d'adaptateurs métier sur un même GPU.Mettre en œuvre le serving déclaratif serverless via KServe et ModelMesh sur Red Hat OpenShift AI (RHOAI).2Orchestration Matérielle, Batch Scheduling & GPU FinOpsDéployer et configurer le NVIDIA GPU Operator, la Container Device Interface (CDI) et la Dynamic Resource Allocation (DRA).Maximiser l'utilisation de la VRAM via le découpage NVIDIA MIG (Multi-Instance GPU) et le vGPU time-slicing.Déployer et configurer Kueue pour le batch scheduling multi-tenant, la gestion fine des files d'attente de jobs GPU (ClusterQueue / LocalQueue) et le fair-sharing des quotas de calcul entre équipes.Bâtir des architectures d'autoscaling élastique pilotées par le KV-Cache et les métriques de requêtes en attente avec KEDA et Prometheus.3Frameworks Agentiques, Pipelines RAG & Écosystème Llama StackStandardiser les briques d'IA générative d'entreprise en déployant le Llama Stack Operator et l'interfaçage avec les APIs unifiées d'inférence, de sécurité et d'agents.Industrialiser des architectures RAG avancées et des workflows multi-agents avec LangChain, LangGraph et LlamaIndex.Déployer et opérer des bases de données vectorielles distribuées à haute résilience (Milvus Distributed, Qdrant, pgvector, ChromaDB) adossées à OpenShift Data Foundation (Ceph / ODF).Déployer et sécuriser des passerelles Model Context Protocol (MCP) en environnement Zero-Trust.4Fine-Tuning Souverain & Calcul DistribuéIndustrialiser les pipelines d'alignement et de fine-tuning open source avec InstructLab (méthode LAB) et RHEL AI sur modèles souverains et open-weights (IBM Granite 3.x, Mistral AI, Llama 3.x / 4, DeepSeek).Orchestrer les entraînements et traitements distribués avec KubeRay, Ray Serve, Kueue et Kubeflow Pipelines.5Sécurité, Gouvernance & Observabilité (IA Act Ready)Intégrer des garde-fous éthiques et de sécurité : NeMo Guardrails, TrustyAI (explicabilité et détection des biais).Mettre en place l'observabilité LLMOps complète avec OpenTelemetry (suivi de la latence TTFT / TPOT, traçabilité des tokens, auditabilité et FinOps IA).Automatiser l'ensemble de la stack en GitOps (ArgoCD / OpenShift GitOps) et Ansible Automation Platform.

Type de contrat Intérim - 1 Mois
Contrat travail

Expérience
  • Débutant accepté
Informations complémentaires
  • Secteur d'activité : Activités des agences de placement de main-d'œuvre
Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Open Source / Red Hat IA Platform Engineer (H/F)
Open Source / Red Hat IA Platform Engineer (H/F)

SmartRecruiters, Inc. • Levallois-Perret

Sur place
EUR 90 000 - 130 000
Mutuelle d’entreprise
Tickets restaurant
Télétravail hybride
AI Platform Engineer | LLMOps on OpenShift & GPUs
AI Platform Engineer | LLMOps on OpenShift & GPUs

SmartRecruiters, Inc. • Levallois-Perret

Hybride
EUR 90 000 - 130 000
Mutuelle d’entreprise
Tickets restaurant
Télétravail hybride
Lead Engineer OpenShift AI / MLOps (H/F)
Lead Engineer OpenShift AI / MLOps (H/F)

Step-Up • Gémenos

Sur place
EUR 90 000 - 120 000
Mutuelle santé 70%
Mobilité douce encouragée
Formations internes
+3
Senior Data & AI Ops (H/F)
Senior Data & AI Ops (H/F)

NumSpot • Courbevoie

Sur place
EUR 65 000 - 85 000
Ingenieur DevOps Plateforme GPU - F/H
Ingenieur DevOps Plateforme GPU - F/H

Groupe Avanista • Guyancourt

Sur place
EUR 95 000 - 120 000
Télétravail 2j/sem
Ingénieur·e DevOps GPU (F/H/X)
Ingénieur·e DevOps GPU (F/H/X)

METALINE • Guyancourt

Sur place
EUR 85 000 - 120 000
Devops IA Mistral
Devops IA Mistral

Onyx-Conseil • Montpellier

Sur place
EUR 70 000 - 110 000
DevSecOps - AgentOps confirmé - H/F - Bordeaux
DevSecOps - AgentOps confirmé - H/F - Bordeaux

Atos • Bordeaux

Sur place
EUR 70 000 - 110 000
MLOps (H/F) Freelance
MLOps (H/F) Freelance

Cherry Pick • Paris

Sur place
EUR 70 000 - 110 000
Architecte Plateforme IA / LLMOps (IT) / Freelance
Architecte Plateforme IA / LLMOps (IT) / Freelance

Free-Work • Paris

Sur place
EUR 90 000 - 140 000