N’envoyez pas un CV générique — générez un CV et une lettre de motivation adaptés à ce poste précis.
Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter la pile d'inférence de BullSequana AI (BSQAI) et son intégration avec la plateforme matérielle. Vous dirigerez l’ingénierie d’inférence LLM en production, en étroite collaboration avec Data, IA Services et le hardware.
Le poste requiert une expertise en serving natif Kubernetes, en architectures distribuées et en pipelines multimodaux, avec un impact direct sur coût par token et latence.
Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter la pile d'inférence de BullSequana AI (BSQAI) et son intégration avec la plateforme matérielle. Vous dirigerez l’ingénierie d’inférence LLM en production, en étroite collaboration avec Data, IA Services et le hardware.
Le poste requiert une expertise en serving natif Kubernetes, en architectures distribuées et en pipelines multimodaux, avec un impact direct sur coût par token et latence.