Open Source / Red Hat IA Platform Engineer (H/F)

SmartRecruiters, Inc.

Levallois-Perret

Hybride

EUR 90 000 - 130 000

Plein temps

Il y a 4 jours
Soyez parmi les premiers à postuler
Générateur de candidature

N’envoyez pas un CV générique — générez un CV et une lettre de motivation adaptés à ce poste précis.

Passez les filtres ATS

Avantages offerts par ce poste

Mutuelle d’entreprise
Tickets restaurant
Télétravail hybride

Résumé du poste

STARTX | Part of Devoteam recherche un AI Platform Engineer pour piloter l’ingénierie de plateformes Kubernetes/OpenShift et LLMOps, en orchestrant et servant des modèles d’IA générative sur des infrastructures GPU haute performance.

Vous concevrez, déployerez et opérerez des pipelines RAG, KServe et LangChain, tout en optimisant les coûts GPU et le FinOps, avec des exigences de sécurité et d’observabilité dans un cadre hybride et international.

Qualifications

  • Formation d’ingénieur ou équivalent Bac+5.
  • Expérience confirmée en plateformes Kubernetes/Cloud Native.
  • Passion pour l’IA générative et LLMOps.

Responsabilités

  • Concevoir, déployer et opérer des plateformes IA générative sur Kubernetes/OpenShift.
  • Mettre en œuvre le serving et l’orchestration des modèles IA générative.
  • Optimiser les workloads GPU et les coûts FinOps associée.
  • Intégrer les architectures RAG et pipelines LLM.
  • Assurer sécurité, gouvernance et observabilité IA Act Ready.

Connaissances

Kubernetes
OpenShift
LLMOps
GPU FinOps
Python
GitOps

Formation

Bac+5 ingénieur

Outils

Kubernetes
OpenShift
KServe
LangChain
LlamaIndex
Milvus

Description du poste

Description de l'entreprise

Devoteam est un leader du conseil en stratégie digitale, plateformes technologiques, cybersécurité et transformation IA. Avec 11 000 collaborateurs en Europe, Moyen-Orient et Afrique, Devoteam met depuis 30 ans la Technologie au service de l’Homme et accélère la transition des grands comptes vers l'IA d'entreprise.

Zoom sur STARTX | Part of Devoteam, le Centre d'Excellence Cloud Native & IA Open Source de Devoteam.

STARTX | Part of Devoteam est l'élite Open Source et Cloud Native de Devoteam. Premier et partenaire historique Red Hat en France (depuis plus de 20 ans), STARTX rassemble des architectes et consultants de référence intervenant sur les architectures les plus critiques du marché (Kubernetes, OpenShift, automatisation, souveraineté numérique et plateformes d'IA générative).

Rejoindre STARTX | Part of Devoteam, c’est vivre l’agilité et l’exigence technique d’une boutique d’ingénierie d’élite, adossée à l’envergure, aux moyens GPU et aux projets d’innovation majeurs du groupe Devoteam.

Description du poste

En 2026, l’enjeu de l’Intelligence Artificielle en entreprise a basculé du prototypage vers l’ingénierie d’infrastructure, le serving haute performance et la maîtrise des coûts GPU.

En tant qu'AI Platform Engineer, vous serez au cœur de cette convergence entre Platform Engineering (Kubernetes / OpenShift) et LLMOps. Vous concevrez, déploierez et opérerez les plateformes industrielles permettant d'entraîner, fine-tuner, orchestrer et servir des modèles d'IA générative (LLM, SLM, vision) sécurisés et souverains.

Déployer, optimiser et opérer les moteurs d'inférence de pointe : vLLM (PagedAttention, Prefix Caching, continuous batching), LLMD, LiteLLM Proxy, SGLang, TGI et Triton Inference Server.

Implémenter des architectures de Multi-LoRA Serving (S-LoRA) pour mutualiser un modèle de fondation unique et servir à chaud des dizaines d'adaptateurs métier sur un même GPU.

Mettre en œuvre le serving déclaratif serverless via KServe et ModelMesh sur Red Hat OpenShift AI (RHOAI).

Orchestration Matérielle, Batch Scheduling & GPU FinOps

Déployer et configurer le NVIDIA GPU Operator, la Container Device Interface (CDI) et la Dynamic Resource Allocation (DRA).

Maximiser l'utilisation de la VRAM via le découpage NVIDIA MIG (Multi-Instance GPU) et le vGPU time-slicing.

Déployer et configurer Kueue pour le batch scheduling multi-tenant, la gestion fine des files d'attente de jobs GPU (ClusterQueue / LocalQueue) et le fair-sharing des quotas de calcul entre équipes.

Bâtir des architectures d'autoscaling élastique pilotées par le KV-Cache et les métriques de requêtes en attente avec KEDA et Prometheus.

Frameworks Agentiques, Pipelines RAG & Écosystème Llama Stack

Standardiser les briques d'IA générative d'entreprise en déployant le Llama Stack Operator et l'interfaçage avec les APIs unifiées d'inférence, de sécurité et d'agents.

Industrialiser des architectures RAG avancées et des workflows multi-agents avec LangChain, LangGraph et LlamaIndex.

Déployer et opérer des bases de données vectorielles distribuées à haute résilience (Milvus Distributed, Qdrant, pgvector, ChromaDB) adossées à OpenShift Data Foundation (Ceph / ODF).

Déployer et sécuriser des passerelles Model Context Protocol (MCP) en environnement Zero-Trust.

Fine-Tuning Souverain & Calcul Distribué

Industrialiser les pipelines d'alignement et de fine-tuning open source avec InstructLab (méthode LAB) et RHEL AI sur modèles souverains et open-weights (IBM Granite 3.x, Mistral AI, Llama 3.x / 4, DeepSeek).

Orchestrer les entraînements et traitements distribués avec KubeRay, Ray Serve, Kueue et Kubeflow Pipelines.

Sécurité, Gouvernance & Observabilité (IA Act Ready)

Intégrer des garde-fous éthiques et de sécurité : NeMo Guardrails, TrustyAI (explicabilité et détection des biais).

Mettre en place l'observabilité LLMOps complète avec OpenTelemetry (suivi de la latence TTFT / TPOT, traçabilité des tokens, auditabilité et FinOps IA).

Automatiser l'ensemble de la stack en GitOps (ArgoCD / OpenShift GitOps) et Ansible Automation Platform.

Issu(e) d’une formation d’ingénieur ou équivalent (Bac+5), vous avez une expérience confirmée en ingénierie de plateformes Kubernetes/Cloud Native et êtes passionné(e) par l'écosystème de l'IA générative et du LLMOps.

Compétences Techniques Clés :

Socle Plateforme & Conteneurs : Maîtrise approfondie de Kubernetes et Red Hat OpenShift (4.x), Operators (OLM), GitOps (ArgoCD), Linux/RHEL, Podman/Docker.

Plateformes & Frameworks IA : Expérience ou maîtrise de Red Hat OpenShift AI (RHOAI), vLLM, LLMD / LiteLLM, KServe, LangChain / LangGraph, LlamaIndex, Kueue, Kubeflow / Ray.

Accélération & Stockage : Notions solides sur les GPUs NVIDIA (GPU Operator, CUDA, MIG), stockage distribué pour l'IA (S3/Ceph/ODF) et bases vectorielles (Milvus, Qdrant, pgvector).

Développement & Automatisation : Python (PyTorch, SDKs IA, APIs FastAPI/REST), Bash, YAML, Ansible.

Une connaissance d'OpenClaw est un plus !

Certifications (Fortement valorisées) :

Rigueur d'ingénierie, curiosité pour les dernières avancées open source (papers, nouveaux modèles, runtimes).

Capacité à vulgariser des architectures d'IA complexes auprès de décideurs et d'équipes de Data Science.

Esprit d'équipe, autonomie et goût pour les projets d'innovation à fort impact.

Informations complémentaires

Accès illimité aux formations & certifications : Abonnement personnel Red Hat Learning Subscription (RHLS Enterprise) avec passages d'examens

Environnements de pointe : Accès à de vrais clusters GPU d'expérimentation, des POCs clients ambitieux et une relation privilégiée avec les ingénieries de Red Hat, NVIDIA, IBM et Mistral AI.

Flexibilité & Qualité de vie : Télétravail hybride maîtrisé, locaux modernes et événements tech réguliers (Tech Days, Red Hat Summit, conférences).

Package complet : Rémunération attractive (fixe + variable), mutuelle d’entreprise de premier rang, carte ticket restaurant, indemnités télétravail et équipement matériel haut de gamme (MacBook Pro M-Series).

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Open Source / Red Hat IA Platform Engineer (H/F)
Open Source / Red Hat IA Platform Engineer (H/F)

France Travail • Levallois-Perret

Sur place
EUR 67 000 - 100 000
Tech Lead AI H/F/N
Tech Lead AI H/F/N

OVH GmbH • France

Hybride
EUR 75 000 - 110 000
Télétravail hybride
Plan d’actionnariat salarié
Subventions vacances et sport
+4
Ingenieur DevOps Plateforme GPU - F/H
Ingenieur DevOps Plateforme GPU - F/H

Groupe Avanista • Guyancourt

Sur place
EUR 95 000 - 120 000
Télétravail 2j/sem
ML platform senior DevOps engineer Frelance
ML platform senior DevOps engineer Frelance

Cherry Pick • Paris

Sur place
EUR 75 000 - 100 000
Senior AI Engineer H/F - CDI
Senior AI Engineer H/F - CDI

Converteo • Paris

Sur place
EUR 70 000 - 120 000
Équilibre vie pro/perso
Formation interne (School)
Télétravail flexible
+4
Lead Engineer OpenShift AI / MLOps (H/F)
Lead Engineer OpenShift AI / MLOps (H/F)

Step-Up • Gémenos

Sur place
EUR 90 000 - 120 000
Mutuelle santé 70%
Mobilité douce encouragée
Formations internes
+3
Senior Data & AI Ops (H/F)
Senior Data & AI Ops (H/F)

NumSpot • Courbevoie

Sur place
EUR 65 000 - 85 000
Ingénieur Cloud & MlOps
Ingénieur Cloud & MlOps

le1817 • Lyon

Hybride
EUR 70 000 - 110 000
Mutuelle Alan premium
Tickets restaurant
IT Technical Lead Fullstack JS - F/H/N
IT Technical Lead Fullstack JS - F/H/N

OVH GmbH • Roubaix, Lyon, Paris

Sur place
EUR 70 000 - 100 000
Télétravail hybride
Plan d'actionnariat salarié
Reconnaissance de l'ancienneté
+2
Solution Architect - AI Augmented
Solution Architect - AI Augmented

WeScale • Île-de-France

Sur place
EUR 75 000 - 90 000
Congés 25 jours + RTT
Jours supplémentaires avec l’anciennet
Prime vacances et cooptation
+6