Senior LLM Inference Architect - Sovereign AI Platform

Bull

Valbonne

Sur place

EUR 120 000 - 150 000

Plein temps

Il y a 3 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.

Passez les filtres ATS

Résumé du poste

Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter l'inférence LLM sur BullSequana AI. Vous travaillerez sur une pile Kubernetes-native, l'inférence distribuée et l'intégration avec le matériel BullSequana, en collaboration avec les équipes Data, Services IA et Foundation.

Le rôle exige une expertise pointue en serving de modèles ML/AI à grande échelle, avec une orientation vers la réduction des coûts par token et la latence, tout en assurant des déploiements sécurisés en

Qualifications

  • 7+ ans d'expérience en ingénierie ML/AI servant des modèles en production.
  • Maîtrise des plateformes de serving natives Kubernetes et d'inférence distribuée.
  • Bonne compréhension des architectures open-weight et des méthodes d'optimisation.
  • Maîtrise de l'anglais technique à l'oral et à l'écrit.

Responsabilités

  • Concevoir et optimiser la plateforme de serving LLM sur vLLM et llm-d.
  • Gérer les pipelines multimodaux et les embeddings pour l'inférence distribuée.
  • Assurer fiabilité, observabilité (Prometheus/Grafana) et benchmarking.
  • Soutenir les activités d'avant-vente et dimensionnement.

Connaissances

Expérience ML/AI
Kubernetes
Anglais technique

Outils

llm-d
vLLM
TensorRT-LLM
NVIDIA Dynamo
KServe

Description du poste

Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter l'inférence LLM sur BullSequana AI. Vous travaillerez sur une pile Kubernetes-native, l'inférence distribuée et l'intégration avec le matériel BullSequana, en collaboration avec les équipes Data, Services IA et Foundation.

Le rôle exige une expertise pointue en serving de modèles ML/AI à grande échelle, avec une orientation vers la réduction des coûts par token et la latence, tout en assurant des déploiements sécurisés en

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Senior LLM Inference Engineer – Distributed AI Serving
Senior LLM Inference Engineer – Distributed AI Serving

Atos SE • Bezons

Sur place
EUR 120 000 - 190 000
Principal LLM Inference Engineer Architecting Sovereign AI
Principal LLM Inference Engineer Architecting Sovereign AI

Atos • Valbonne

Sur place
EUR 120 000 - 190 000
Principal LLM Inference Architect for Sovereign AI
Principal LLM Inference Architect for Sovereign AI

Atos SE • Bordeaux

Sur place
EUR 120 000 - 180 000
Staff LLM Inference Engineer — Sovereign AI Platform
Staff LLM Inference Engineer — Sovereign AI Platform

Bull • Bezons

Sur place
EUR 110 000 - 170 000
Senior LLM Inference & Serving Architect
Senior LLM Inference & Serving Architect

Atos • Bezons

Sur place
EUR 120 000 - 160 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Atos • Valbonne

Sur place
EUR 120 000 - 190 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Atos • Bezons

Sur place
EUR 120 000 - 160 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Atos SE • Bezons

Sur place
EUR 120 000 - 190 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Bull • Valbonne

Sur place
EUR 120 000 - 150 000
Principal LLM Inference Engineer - F/H
Principal LLM Inference Engineer - F/H

Bull • Bezons

Sur place
EUR 110 000 - 170 000