N’envoyez pas un CV générique — générez un CV et une lettre de motivation adaptés à ce poste précis.
MissionHandicap recherche un expert ML pour concevoir et optimiser des modèles par fine-tuning sous contraintes de ressources. Vous mettrez en œuvre des méthodes d’alignement et d’anti-hallucination tout en préparant datasets et benchmarks.
Vous assurerez l’intégration et le déploiement via des moteurs d’inférence, dans un cadre technique axé sur Python et PyTorch. Le poste implique des techniques avancées (PEFT, LoRA, RLHF, RLAIF) et des environnements d’entraînement comme Unsloth, Axolotl et
Concevoir et réaliser le fine-tuning de modèles sous contraintes de ressources (PEFT, LoRA, QLoRA).
Garantir la fiabilité des modèles en mettant en œuvre des méthodes d'alignement avancées et anti-hallucination (RLHF/RLAIF, DPO, GRPO, PPO).
Structurer, formater et préparer des datasets pour l'apprentissage (ChatML, Alpaca).
Définir et déployer des frameworks d'évaluationstricts (LLM-as-a-judge, MMLU, création de benchmarks sur-mesure) pour mesurer les performances.
Assurer l'intégration, l'optimisation et le déploiement des modèles via des moteurs d'inférence.L environnement technique :
Langages & frameworks : Python, PyTorch.
Entraînement & PEFT : Unsloth, Axolotl, TRL.
Alignement : TRL, verl, OpenRLHF.
Inférence & déploiement : vLLM, Ollama, Triton.
Bonus : Cybersécurité (SOC/CTI, MITRE ATT&CK, analyse de logs).