Ingénieur•e expert•e évaluation de LLM

1000scholars

Talence

On-site

EUR 55,000 - 75,000

Full time

2 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

Inria recherche un expert en évaluation de LLM pour concevoir et implémenter des protocoles et benchmarks, et les intégrer dans une plateforme modulaire et sécurisée.

Vous analyserez les résultats et proposerez des recommandations méthodologiques, en participant à l’architecture logicielle et à la documentation technique.

Qualifications

  • Expérience en évaluation de modèles d'IA (métriques, protocoles expérimentaux) avec une bonne culture scientifique du domaine.

Responsibilities

  • Concevoir, structurer et implémenter les protocoles d'évaluation des modèles et systèmes basés sur des LLM et les intégrer dans l'architecture modulaire de la plateforme.

Skills

Évaluation de modèles IA
Maîtrise des LLMs
Python et écosystème ML
Bonnes pratiques de développement
Documentation technique
Anglais technique

Tools

Docker
docker-compose

Job description

Context

Suite aux priorités établies en mai 2024 par la Déclaration de Séoul pour une IA sûre, novatrice et inclusive, dont la France est signataire, le gouvernement a decidé de créer l'INESIA, un institut qui pour mission de fédérer, sans création de nouvelle structure juridique, les acteurs nationaux de l’évaluation et de la sécurité, et tout particulièrement : l’Agence nationale de la sécurité des systèmes d'information(ANSSI), le Laboratoire national de métrologie et d’essais (LNE), le Pôle d’expertise de la régulation numérique (PEReN), l’Institut national de recherche en sciences et technologies du numérique(Inria). Dans ce cadre Inria contribue principalement sur les axes de l,analyse des risques systémiques dans le champ de la sécurité nationale et l'évaluation de la performance et de la fiabilité des modèles d'IA. Ce travail se coordone strategiquement avec le programme de recherche d'Évalluation de l'IA, porté par Inria et se materialise par la conception et développement d'une plateforme d'évaluation de l'IA, en particulier des systèmes basés sur les LLM. Cette plateforme vise à fournir un environnement intégré, sécurisé et robuste permettant de soutenir les projets de recherche du programme ainsi que de développer des applications d'évaluations, telles que des campagnes de benchmarks, des exercices de red teaming ... Elle s'appuie sur des outils open source de l'écosystème IA et des développements internes. Vous rejoindrez une équipe dans une dynamique de développement rapide et itérative : la plateforme évoluera progressivement, avec des livrables opérationnels réguliers. Nous recherchons des profils capables de proposer, d'arbitrer et de transformer des besoins techniques en solutions opérationnelles. En tant qu'expert de l'évaluation de LLM, vous jouerez un rôle central dans la définition des méthodologies d'évaluation. Ce poste offre l’opportunité de participer à un projet stratégique et ambitieux, au cœur des enjeux actuels liés à la sécurité, à la transparence et à la gouvernance de l’IA, avec des dimensions techniques, scientifiques et sociétales

Assignment
  • Concevoir, structurer et implémenter les protocoles d'évaluation des modèles et systèmes basés sur des LLM et les intégrer dans l'architecture modulaire de la plateforme.
Main activities
  • Définir et implémenter des protocoles d'évaluation, des benchmarks et des métriques
  • Analyser et interpréter les résultats d'évaluation afin d'en dégager des recommandations méthodologiques
  • Participer à la définition de l'architecture logicielle de la plateforme
  • Documenter la méthodologie
Skills

Compétences nécessaires

  • Expérience en évaluation de modèles d'IA (métriques, protocoles expérimentaux) avec une bonne culture scientifique du domaine
  • Solide maîtrise du fonctionnement des LLMs
  • Très bonne maîtrise de Python et de l'écosystème ML
  • Bonnes pratiques de développement (versionnage Git, CI/CD, documentation)
  • Capacité à rédiger une documentation technique

Compétences souhaitées

  • Expérience avec des frameworks d'évaluation (Inspect, Lighteval, ...)
  • Connaissances générales sur le domaine de conception de logiciels pour l’IA, notamment en expérimentation scientifique.
  • Connaissance d'outils de déploiement d'applications Web (Docker, docker-compose, CI/CD)

Compétences appréciées

  • Maîtrise de l’anglais technique oral et écrit
  • Sensibilité aux enjeux de confiance et de sécurité de l’IA

Nous vous invitons à postuler même si vous ne répondez pas à tous les critères : nous apprécions les personnes prêtes à acquérir de nouvelles compétences.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Ingénieur•e expert•e évaluation de LLM
Ingénieur•e expert•e évaluation de LLM

Inria • Talence

Hybrid
EUR 30,000 - 34,000
Restauration subventionnée
Transports publics remboursés
Congés annuels 7 semaines + RTT
+3
Ingénieur Évaluation LLM - IA & Sécurité
Ingénieur Évaluation LLM - IA & Sécurité

Inria • Talence

Hybrid
EUR 30,000 - 34,000
Restauration subventionnée
Transports publics remboursés
Congés annuels 7 semaines + RTT
+3
AI Engineer H/F
AI Engineer H/F

Amossys • France

Remote
EUR 80,000 - 110,000
Ticket restaurant Swile
Mutuelle d’entreprise
Prime de vacances
Ingénieur IA déployé
Ingénieur IA déployé

Wevalue • Paris

On-site
EUR 85,000 - 120,000
Ingénieur IA déployé
Ingénieur IA déployé

Wevalue • Paris

On-site
EUR 90,000 - 130,000
Consultant IA sénior - Spatial - Bordeaux, France (H/F)
Consultant IA sénior - Spatial - Bordeaux, France (H/F)

Astek • Bordeaux

On-site
EUR 60,000 - 80,000
Formation continue
Accès à des projets passionnants
Accompagnement personnalisé
Consultant IA sénior – Spatial – Bordeaux, France (H/F)
Consultant IA sénior – Spatial – Bordeaux, France (H/F)

Astek • Bordeaux

On-site
EUR 90,000 - 120,000
AI Engineer — Autonomous Agents / LLMs
AI Engineer — Autonomous Agents / LLMs

URBAN LINKER • Paris

On-site
EUR 75,000 - 110,000
Développeur IA Générative & Agentique – H/F
Développeur IA Générative & Agentique – H/F

PROXIAD • Dijon

On-site
EUR 70,000 - 100,000
AI Engineer – Senior Consultant
AI Engineer – Senior Consultant

JAKALA • Paris

Hybrid
EUR 90,000 - 130,000
Télétravail jusqu’à 2 jours/semaine
Mutuelle d’entreprise
Frais de transport partagés
+1