Consultant(e) AI Platform Engineer

Quickscale AI

Paris

Sur place

EUR 90 000 - 120 000

Plein temps

14 jours+

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Avantages offerts par ce poste

Mutuelle prise en charge 100%
Bonus de performance
Formations continues
Télétravail flexible
Bureaux WeWork — centre de Paris

Résumé du poste

Quickscale AI, une société de conseil spécialisée dans le développement d'agents IA sur mesure, recherche un LLMOps / AI Platform Engineer pour industrialiser les solutions IA de nos clients à grande échelle. Paris-based et en télétravail flexible, vous participez à la mise en place et à la supervision des plateformes IA.

Vous déployez, mettez à l'échelle et monitoriez les modèles en production sur des environnements cloud et on-premise, avec des profils seniors vous accompagnant dans votre

Qualifications

  • 1+ an d'expérience en ingénierie de plateforme, DevOps, MLOps, SRE ou administration système Linux.
  • Bases solides sur Kubernetes — concepts (pods, services, deployments, ingress) maîtrisés.
  • Bonne compréhension des LLM et des enjeux de leur industrialisation (inférence, latence, coût).
  • Bonne culture générale IA / ML.

Responsabilités

  • Contribuer à l’industrialisation d’une plateforme d’inférence LLM à grande échelle (cloud, on-premise, hybride).
  • Opérer des infrastructures Kubernetes pour des workloads IA (CPU, GPU).
  • Mettre en place l’observabilité des systèmes IA : monitoring, logging, alerting, cost tracking.
  • Contribuer à l’optimisation des performances et des coûts des systèmes d’inférence.
  • Accompagner les équipes internes clients dans les bonnes pratiques MLOps / LLMOps.

Connaissances

Platform engineering
Kubernetes
Linux
LLM/IA deployment
MLOps
Observability
Automation

Description du poste

Quickscale AI est une société de conseil spécialisée dans le développement d'agents IA sur mesure pour des secteurs exigeants : finance, juridique, conformité, marketing.

Nous aidons nos clients à concevoir et déployer des solutions d'IA fiables, auditées et réellement utilisées en production.

Notre équipe combine excellence technique, rigueur scientifique et sens produit.

Nous croyons à une IA utile, explicable et responsable, au service de la transformation des organisations.

Rejoignez-nous pour façonner l'avenir de l'IA en Entreprise !

Votre rôle
Qui sommes-nous ?

Quickscale AI est une société de conseil spécialisée dans le développement d'agents IA sur mesure pour des secteurs exigeants : finance, juridique, conformité, marketing.

Nous aidons nos clients à concevoir et déployer des solutions d'IA fiables, auditées et réellement utilisées en production.

Notre équipe combine excellence technique, rigueur scientifique et sens produit.

Nous croyons à une IA utile, explicable et responsable, au service de la transformation des organisations.

Rejoignez-nous pour façonner l'avenir de l'IA en Entreprise !

Votre rôle

En tant que LLMOps / AI Platform Engineer, vous participez à l'industrialisation des solutions IA de nos clients : déploiement, mise à l'échelle et monitoring des modèles en production.

Vous intervenez sur des plateformes IA à grande échelle, souvent dans des environnements exigeants (souveraineté, sécurité, on-premise), aux côtés de profils seniors qui vous accompagnent dans votre montée en compétences.

Vous évoluez à l'interface entre :

  • l'ingénierie plateforme (Kubernetes, cloud, on-premise),
  • l'écosystème LLM (serving, orchestration, observabilité),
  • et les équipes data / IA / métier de nos clients.

C'est un rôle idéal pour un·e ingénieur·e passionné·e par l'infrastructure et l'IA, qui souhaite construire une expertise pointue sur les sujets LLMOps aux côtés de profils confirmés.

Vos missions

Projets clients

  • Contribuer au déploiement de plateformes d'inférence LLM à grande échelle (cloud, on-premise, hybride).
  • Opérer des infrastructures Kubernetes pour des workloads IA (CPU, GPU).
  • Participer à la mise en place de l'observabilité des systèmes IA : monitoring, logging, alerting, cost tracking.
  • Contribuer à l'optimisation des performances et des coûts des systèmes d'inférence.
  • Accompagner les équipes internes clients dans les bonnes pratiques MLOps / LLMOps.

Exemples de missions

  • Contribution à l'industrialisation d'une plateforme d'inférence LLM pour un acteur public de premier plan.
  • Mise en production d'agents IA métiers dans une banque d'investissement, sur infrastructures GPU self-hosted.
  • Optimisation de systèmes d'inférence IA pour une maison de luxe déployant des agents en boutique.

R&D & transmission

  • Contribution aux frameworks et bonnes pratiques Quickscale.
  • Montée en compétences continue sur l'écosystème LLM / agentique en évolution rapide.
  • Participation aux revues techniques et au partage de bonnes pratiques au sein de l'équipe.
Profil recherché

Compétences techniques essentielles

  • 1+ an d'expérience en ingénierie de plateforme, DevOps, MLOps, SRE ou administration système Linux.
  • Bases solides sur Kubernetes — vous êtes à l'aise avec les concepts (pods, services, deployments, ingress) et curieux·se d'aller plus loin.
  • Bonne maîtrise de Linux (administration, scripting, troubleshooting).
  • Compréhension de ce qu'est un LLM et des enjeux de son industrialisation (inférence, latence, coût).
  • Bonne culture générale IA / Machine Learning.
  • Envie forte d'approfondir les sujets d'industrialisation IA en environnement exigeant (production, souveraineté, sécurité).

Compétences appréciées (nice to have)

  • Expérience avec vLLM, TGI, Ollama ou d'autres frameworks d'inférence LLM.
  • Expérience avec LiteLLM, LangServe, ou d'autres passerelles LLM.
  • Connaissance des solutions d'observabilité IA (Langfuse, LangSmith, Arize).
  • Connaissance de l'écosystème agentique (LangChain, LangGraph, LlamaIndex).
  • Expérience GPU sur cloud (AWS, GCP, Azure) et/ou on-premise (Nvidia).

Posture & soft-skills

  • Fort potentiel technique et forte capacité d'apprentissage.
  • Curiosité forte sur l'écosystème IA en évolution rapide.
  • Rigueur, sens de la fiabilité et de la traçabilité des systèmes.
  • Autonomie progressive : capable de prendre en main des sujets et savoir quand demander de l'aide.
  • Goût pour le travail en équipe, l'entraide et le partage.
  • Envie de progresser rapidement au contact de profils expérimentés.
Pourquoi nous rejoindre
  • Environnement entrepreneurial avec un impact direct sur des chantiers IA structurants.
  • Un rôle central à l'intersection de la plateforme, du MLOps et de l'IA générative.
  • Montée en compétences accélérée aux côtés de profils seniors expérimentés.
  • Missions variées et exigeantes avec des clients prestigieux (secteur public, finance, luxe).
  • Haut niveau d'autonomie progressive et responsabilités croissantes.
  • Télétravail flexible (jusqu'à 4 jours par semaine), accès à des bureaux WeWork en plein centre de Paris.
  • Bonus de performance.
  • Formations continues, conférences, veille active.
  • Mutuelle prise en charge à 100 %.
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Consultant(e) Senior AI Engineer
Consultant(e) Senior AI Engineer

Quickscale AI • Paris

Hybride
EUR 60 000 - 90 000
Télétravail flexible
Bureaux WeWork à Paris
Bonus de performance
+1
Consultant(e) Senior Data Engineer
Consultant(e) Senior Data Engineer

Quickscale AI • Paris

Hybride
EUR 60 000 - 90 000
Bonus de performance
Formations continues
Télétravail jusqu'à 4 jours/semaine
+1
LLM Engineer
LLM Engineer

CLEEVEN • Auvergne-Rhône-Alpes

Sur place
EUR 85 000 - 110 000
Consultant Senior MLOPS Engineer
Consultant Senior MLOPS Engineer

Talan Group • Paris

Hybride
EUR 50 000 - 70 000
Télétravail jusqu’à 5 jours
Tickets restaurant
Prime vacances
+2
AI Engineer / Agentic AI Engineer
AI Engineer / Agentic AI Engineer

Accenture • Paris

Hybride
EUR 45 000 - 65 000
Formations avancées
Accès à des technologies de pointe
Environnement international
Applied Gen AI Engineer
Applied Gen AI Engineer

Devoteam • Levallois-Perret

Hybride
EUR 70 000 - 110 000
Rémunération compétitive
Mutuelle
Tickets restaurant
+2
AI Developer
AI Developer

5 Degrés • Paris

Sur place
EUR 60 000 - 70 000
Locaux en plein cœur de Paris
Formation Udemy illimitée
Tickets restaurants
+3
AI Engineer — MLOps & Industrialisation | Paris
AI Engineer — MLOps & Industrialisation | Paris

Mpdata • Boulogne-Billancourt

Hybride
EUR 45 000 - 65 000
AI Engineer H/F - CDI
AI Engineer H/F - CDI

Converteo • Paris

Sur place
EUR 60 000 - 80 000
Équilibre vie pro / vie perso
Formation continue
Politique de télétravail flexible
+1
LLMOps & Observability Engineer
LLMOps & Observability Engineer

Darwin Partners • Annecy

Hybride
EUR 70 000 - 110 000
Télétravail 2 jours/semaine