Machine Learning Engineer

Arkane Cloud

Lyon

Sur place

EUR 70 000 - 120 000

Plein temps

14 jours+
Générateur de candidature

Une candidature sur mesure pour ce poste — un CV et une lettre de motivation personnalisés qui correspondent à l’offre.

Passez les filtres ATS

Avantages offerts par ce poste

Mutuelle à 100%
Tickets Restaurant
RTT

Résumé du poste

Arkane Cloud recherche un ingénieur Machine Learning expérimenté pour déployer et optimiser des modèles IA sur son infra GPU Kubernetes, avec des templates réutilisables et des APIs compatibles OpenAI.

Vous travaillerez sur la mise en production, le benchmarking et le sizing GPU, ainsi que sur l’évolution de la plateforme serverless et l’accompagnement client.

Qualifications

  • 5 ans+ d'expérience en Machine Learning Engineering, avec mise en production.
  • Maîtrise de Python et PyTorch, connaissance de l’écosystème Hugging Face.
  • Expérience production de modèles (vLLM, TensorRT-LLM, SGLang, Triton ou équivalent).

Responsabilités

  • Mise en production et amélioration de l’inférence de modèles IA sur une infra Kubernetes GPU.
  • Réaliser des benchmarks et dimensionnement GPU et pricing pour l’équipe produit et commerciale.
  • Contribuer à l’offre serverless GPU et à l’expérience développeur des SDK et APIs.
  • Automatiser le cycle de vie des modèles (versioning, tests, observabilité) en collaboration avec les DevOps et l’équipe plateforme.

Connaissances

Python
PyTorch
Hugging Face
Kubernetes
CI/CD
NVIDIA GPUs

Outils

vLLM
TensorRT-LLM

Description du poste

Nous attendons une présence sur site deux jours consécutifs tous les quize jours (mercredi/jeudi). Tous les frais sont pris en charges par l'entreprise

Vous avez déjà eu envie de mettre les mains dans le moteur du cloud GPU et de l'IA ? On a un poste qui devrait vous plaire !

Chez Arkane Cloud, on construit un Cloud Service Provider spécialisé dans les infrastructures GPU dédiées à l'IA : instances GPU haute performance, plateforme serverless pour les workloads IA, déploiement et hébergement de modèles en production.

Notre mission

Rendre le déploiement d'applications et de modèles IA radicalement plus simple, pour une communauté d'entrepreneurs, de startups et de développeurs IA.

On est une petite équipe en forte croissance, avec des défis techniques costauds à résoudre au quotidien. On cherche un(e) Machine Learning Engineer expérimenté(e) pour rejoindre l'aventure dès maintenant. Vous arriverez tôt : ce que vous posez aujourd'hui, c'est ce sur quoi toute l'équipe va s'appuyer demain.

Ce que vous ferez
  • Mise en production & performance d'inférence. Vous déploierez et optimiserez des modèles IA open-source (LLM, VLM, génération d'images et de vidéos) sur notre infra Kubernetes GPU, avec des templates réutilisables et des APIs compatibles OpenAI. Vous tunerez les moteurs d'inférence (vLLM, SGLang, TensorRT-LLM, ComfyUI) pour pousser le débit, réduire la latence et le coût par token.

  • Benchmark & sizing GPU. Vous concevrez des campagnes de benchmark reproductibles, vous en tirerez des recommandations de sizing GPU et de pricing, documentées pour les équipes produit et commerciale.

  • Plateforme serverless. Vous contribuerez à notre offre serverless GPU (scale-to-zero, autoscaling, routing, isolation multi-tenant) et à l'expérience développeur autour de nos SDK et APIs.

  • MLOps & collaboration. Vous automatiserez le cycle de vie des modèles (versioning, tests, observabilité avec Prometheus/Grafana), en lien étroit avec les équipes DevOps et plateforme, et vous accompagnerez nos clients stratégiques sur leurs sujets d'intégration.

Votre profil

5 ans+ d'expérience en Machine Learning Engineering, avec une vraie expérience de mise en production. Vous êtes à l'aise en Python et PyTorch, vous connaissez l'écosystème Hugging Face, et vous avez déjà servi des modèles en prod (vLLM, TensorRT-LLM, SGLang, Triton ou équivalent). Vous maîtrisez Kubernetes et les pipelines CI/CD, et vous comprenez bien le fonctionnement des GPU NVIDIA.

Un plus :

de l'expérience sur du serverless/event-driven, du fine-tuning (LoRA, DeepSpeed, FSDP), des contributions open-source, ou une appétence pour les modèles de génération d'images/vidéos.

Pourquoi nous rejoindre

Une infra GPU dernière génération à disposition, des projets qui comptent vraiment pour l'IA de demain, et une petite équipe où votre impact se voit immédiatement. Si l'aventure vous tente, venez en discuter avec nous.

Avantages :
  • Mutuelle à 100%
  • Tickets Restaurant
  • RTT.
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

MLOps Engineer (H/F/X)
MLOps Engineer (H/F/X)

Shadow • Paris

Sur place
EUR 100 000 - 140 000
Tech Lead AI H/F/N
Tech Lead AI H/F/N

OVH GmbH • France

Hybride
EUR 75 000 - 110 000
Télétravail hybride
Plan d’actionnariat salarié
Subventions vacances et sport
+4
MLOps Engineer (H/F/X)
MLOps Engineer (H/F/X)

Shadow • Paris

Hybride
EUR 90 000 - 130 000
IA Engineer (H/F) – Vertex AI & GCP
IA Engineer (H/F) – Vertex AI & GCP

ALTEN • Boulogne-Billancourt

Sur place
EUR 52 000 - 78 000
Applied Gen AI Engineer
Applied Gen AI Engineer

Devoteam • Levallois-Perret

Hybride
EUR 70 000 - 110 000
Rémunération compétitive
Mutuelle
Tickets restaurant
+2
AI Engineer Senior
AI Engineer Senior

Agorastore • Montreuil-sur-Mer

Hybride
EUR 55 000 - 85 000
6,5 semaines de vacances par an
Mutuelle de qualité
Tickets restaurant SWILE
+4
AI Engineer (H/F)
AI Engineer (H/F)

5 Degrés • Toulouse

Sur place
EUR 48 000 - 60 000
Tickets restaurants
Mutuelle/prévoyance
Accès au Comité d’Entreprise
+4
Ingénieur MLOps – Île-de-France (H/F) - Paris, France (H/F)
Ingénieur MLOps – Île-de-France (H/F) - Paris, France (H/F)

Astek • Paris

Sur place
EUR 70 000 - 95 000
Accélérateur d’expérience
Projets techniquement passionnants
Parcours professionnel sur mesure
+2
Ingenieur DevOps Plateforme GPU - F/H
Ingenieur DevOps Plateforme GPU - F/H

Groupe Avanista • France

Hybride
EUR 70 000 - 100 000
AI Engineer Expérimenté
AI Engineer Expérimenté

Business At Work • Lyon

Sur place
EUR 60 000 - 90 000