Une candidature complète en une minute — un CV et une lettre de motivation personnalisés, prêts à être envoyés.
Bull recherche un Staff / Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration avec la plateforme matérielle BullSequana. Vous contribuerez à un serving LLM natif Kubernetes, déployé sur des infrastructures souveraines et hybrides, en collaboration avec Data, IA, et équipes hardware.
Le rôle allie influence architecturale et exécution hands-on, avec un impact direct sur le coût par token et la latence, tout en garantissant la fiabilité et la
Bull recherche un Staff / Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration avec la plateforme matérielle BullSequana. Vous contribuerez à un serving LLM natif Kubernetes, déployé sur des infrastructures souveraines et hybrides, en collaboration avec Data, IA, et équipes hardware.
Le rôle allie influence architecturale et exécution hands-on, avec un impact direct sur le coût par token et la latence, tout en garantissant la fiabilité et la