Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.
Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter l'inférence LLM sur BullSequana AI. Vous travaillerez sur une pile Kubernetes-native, l'inférence distribuée et l'intégration avec le matériel BullSequana, en collaboration avec les équipes Data, Services IA et Foundation.
Le rôle exige une expertise pointue en serving de modèles ML/AI à grande échelle, avec une orientation vers la réduction des coûts par token et la latence, tout en assurant des déploiements sécurisés en
Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter l'inférence LLM sur BullSequana AI. Vous travaillerez sur une pile Kubernetes-native, l'inférence distribuée et l'intégration avec le matériel BullSequana, en collaboration avec les équipes Data, Services IA et Foundation.
Le rôle exige une expertise pointue en serving de modèles ML/AI à grande échelle, avec une orientation vers la réduction des coûts par token et la latence, tout en assurant des déploiements sécurisés en