Principal LLM Inference Architect for Sovereign AI

Atos SE

Bordeaux

Sur place

EUR 120 000 - 180 000

Plein temps

Il y a 5 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Démarquez-vous pour ce poste — générez un CV et une lettre de motivation personnalisés en environ une minute.

Passez les filtres ATS

Résumé du poste

Bull recherche un(e) Staff/Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration avec la plateforme matérielle BullSequana. Vous dirigerez techniquement l'ingénierie hands-on, en étroite collaboration avec Data, IA, et les équipes matériel et delivery.

Ce rôle exige une expertise avancée en serving de modèles ML/AI, une forte expérience en architectures distribuées et une capacité à influencer l'architecture produit tout en livrant des résultats

Qualifications

  • Expérience significative en ingénierie ML/AI et serving de modèles en production.
  • Maîtrise des plateformes de serving natives Kubernetes et d'inférence distribuée.
  • Connaissances des architectures de modèles open-weight et optimisations de performance.

Responsabilités

  • Concevoir et optimiser la plateforme de serving pour LLM avec vLLM et llm-d.
  • Gérer le cycle de vie des modèles et les pipelines multimodaux (audio, STT, TTS, OCR).
  • Assurer fiabilité, observabilité et benchmarking (Prometheus, Grafana).
  • Apporter des données de dimensionnement pour les appels d'offres et le pre-sales.

Connaissances

Expérience ML/AI 7+ ans
Python avancé
Go
Anglais technique

Outils

vLLM
llm-d
TensorRT-LLM
NVIDIA Dynamo
Kubernetes
Prometheus
Grafana

Description du poste

Bull recherche un(e) Staff/Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration avec la plateforme matérielle BullSequana. Vous dirigerez techniquement l'ingénierie hands-on, en étroite collaboration avec Data, IA, et les équipes matériel et delivery.

Ce rôle exige une expertise avancée en serving de modèles ML/AI, une forte expérience en architectures distribuées et une capacité à influencer l'architecture produit tout en livrant des résultats

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Principal LLM Inference Engineer Architecting Sovereign AI
Principal LLM Inference Engineer Architecting Sovereign AI

Atos • Valbonne

Sur place
EUR 120 000 - 190 000
Senior LLM Inference Architect - Sovereign AI Platform
Senior LLM Inference Architect - Sovereign AI Platform

Bull • Valbonne

Sur place
EUR 120 000 - 150 000
Staff LLM Inference Engineer — Sovereign AI Platform
Staff LLM Inference Engineer — Sovereign AI Platform

Bull • Bezons

Sur place
EUR 110 000 - 170 000
Senior LLM Inference Engineer – Distributed AI Serving
Senior LLM Inference Engineer – Distributed AI Serving

Atos SE • Bezons

Sur place
EUR 120 000 - 190 000
Senior LLM Inference & Serving Architect
Senior LLM Inference & Serving Architect

Atos • Bezons

Sur place
EUR 120 000 - 160 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Bull • Valbonne

Sur place
EUR 120 000 - 150 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Atos • Valbonne

Sur place
EUR 120 000 - 190 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Bull • Bezons

Sur place
EUR 110 000 - 170 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Atos • Bezons

Sur place
EUR 120 000 - 160 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Atos SE • Bordeaux

Sur place
EUR 120 000 - 180 000