Recevez plus de réponses des employeurs
Envoyez un CV adapté au poste en quelques minutes.
Braintrust is seeking experienced software engineers for a contracting engagement to build and evaluate cutting-edge LLMs. Based in Paris or London, with Europe remote possible for strong candidates, the role sits at the intersection of real-world software engineering, model evaluation, and applied AI.
You'll design coding prompts, evaluate model outputs, document failures, and run head-to-head tests between private and external models.
This is a contracting engagement - initially 6 months - with potential for long term engagement.
Location: Paris or London-based preferred; alternatively Europe remote for strong candidates
We are building and evaluating state-of-the-art large language models (LLMs) and are looking for experienced software engineers to join our evaluation and annotation team. This role sits at the intersection of real-world software engineering, model evaluation, and applied AI, and is critical to improving model reliability, reasoning, and code quality.
You will design challenging coding tasks, evaluate model outputs against rigorous benchmarks, identify failure modes, and contribute to reinforcement learning and model improvement workflows.
This is not a junior annotation role. We are looking for practitioners with deep hands-on coding experience who can think like both an engineer and an evaluator.
Il s'agit d'une mission contractuelle – initialement de 6 mois – avec possibilité de prolongation.
Lieu : Poste basé à Paris/London de préférence ; possibilité de télétravail en Europe pour les candidats les plus qualifiés.
Nous développons et évaluons des modèles de langage de grande taille (LLM) de pointe et recherchons des ingénieurs logiciels expérimentés pour rejoindre notre équipe d'évaluation et d'annotation. Ce poste se situe à l'intersection du génie logiciel, de l'évaluation de modèles et de l'IA appliquée, et est essentiel à l'amélioration de la fiabilité des modèles, du raisonnement et de la qualité du code.
Vous concevrez des tâches de programmation stimulantes, évaluerez les résultats des modèles par rapport à des benchmarks rigoureux, identifierez les modes de défaillance et contribuerez aux processus d'apprentissage par renforcement et d'amélioration des modèles.
Ce poste ne s'adresse pas aux annotateurs juniors. Nous recherchons des professionnels possédant une solide expérience pratique en programmation, capables d'adopter une approche à la fois ingénieure et évaluatrice.