Démarquez-vous pour ce poste — générez un CV et une lettre de motivation personnalisés en environ une minute.
Bull recherche un Staff/Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration hardware. Vous dirigerez des architectures d'inférence natives Kubernetes, avec du déploiement multi-nœuds et des pipelines multimodaux sur des infrastructures souveraines sur site, cloud ou hybride.
Le rôle combine leadership technique et travail hands-on, en collaboration avec Data, IA, Foundation et le hardware, visant à réduire le coût par token et la latence tout en
Bull recherche un Staff/Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration hardware. Vous dirigerez des architectures d'inférence natives Kubernetes, avec du déploiement multi-nœuds et des pipelines multimodaux sur des infrastructures souveraines sur site, cloud ou hybride.
Le rôle combine leadership technique et travail hands-on, en collaboration avec Data, IA, Foundation et le hardware, visant à réduire le coût par token et la latence tout en