Obtenez une réponse de cet employeur — un CV et une lettre de motivation adaptés exactement à ce qu’il recherche.
Hexamind, basé à Paris, recherche un ingénieur N3 pour l’exploitation et l’optimisation des workloads IA sur un cluster on-premise air-gapped (GPU NVIDIA H200, Kubernetes). Vous serez en charge des pipelines MLOps/LLMOps et du support expert N3 sur les workloads IA.
Vous participez à l’évolution des architectures IA et à la mise en production des modèles, tout en assurant la supervision, l’observabilité et la sécurité des accès sur les plateformes IA.
Hexamind est spécialisé en intelligence artificielle appliquée. We make AI work for you.
Basés à Paris, nous intervenons sur trois métiers : le conseil et le cadrage de projets IA, le développement sur mesure d'agents IA et de solutions LLM, et l'édition de modules IA propriétaires. Nos solutions sont déployées en production chez de grands acteurs de la finance et du secteur public.
Notre conviction : l'IA doit être utile, maîtrisée et souveraine. Elle ne s'arrête pas au POC, elle entre dans les processus métier, elle est observable, gouvernée et maintenue.
Vous intervenez sur un cluster IA on-premise air-gapped (GPU NVIDIA H200, Kubernetes, stockage haute performance), hébergé dans un datacenter en Île-de-France, chez une autorité publique de premier plan sur un secteur critique. Vous êtes le niveau d'expertise N3 sur les workloads IA : ce qui n'est pas résolu en amont arrive chez vous.