Démarquez-vous pour ce poste — générez un CV personnalisé et une lettre de motivation en environ une minute.
École normale supérieure de Lyon recherche un spécialiste pour structurer un corpus d’entretiens et conduire les analyses associées dans le cadre d’un projet interdisciplinaire alliant sociologie et apprentissage automatique.
Le candidat devra maîtriser Python et R, avoir une expérience du traitement de grands corpus textuels en français et savoir concevoir des indicateurs calculables sur corpus pour des analyses conversationnelles et discursives.
L'École normale supérieure de Lyon produit une recherche de haut niveau dans ses 25 laboratoires et forme par la recherche quelque 2500 étudiants dont 500 doctorants. Elle compte environ 550 enseignants, enseignants-chercheurs et chercheurs et 600 personnels administratifs et techniques.
Dans le classement de Shanghai et QS, elle apparaît parmi les tous premiers établissements français en termes de performance per capita.
Son objectif est d'avoir un impact significatif en matière de recherche, d'innovation et de transfert de technologie tout en irriguant la fonction publique et le monde socio-économique de diplômés rompus à la complexité, capables de produire et transmettre des savoirs.
L'ENS de Lyon met ses ressources au service d'une vision ouverte de la société et des enjeux contemporains qu'elle veut éclairer.
Son budget annuel est d’environ 160 M €.
L'ENS de Lyon est une école dynamique, où la qualité de vie au travail, le développement durable et l’égalité professionnelle représentent des dimensions centrales.
Le projet Serisia, financé par le Programme Inria Quadrant de l’Institut national de recherche en sciences et technologies du numérique, vise à étudier comment les modèles de langage conversationnels peuvent encoder des structures sociales au fil d'interactions avec des publics socialement différenciés
Le projet articule une enquête sociologique à grande échelle, au cours de laquelle chaque personne interrogée participe à un entretien semi-directif d'une quinzaine de minutes conduit par un agent conversationnel, et une démarche expérimentale de fine-tuning visant à produire et analyser des versions adaptées d'un LLM selon différents profils sociodémographiques. Le corpus produit est inédit par sa taille comme par sa structure : plusieurs dizaines de milliers d'entretiens, sous forme de transcriptions annotées (horodatage, tours de parole, modules thématiques), appariées pour chaque répondant·e à un questionnaire sociodémographique détaillé. Les entretiens sont structurés en quatre modules thématiques successifs.
Ce projet interdisciplinaire, à la croisée de la sociologie et du machine learning, est porté par Nathan Ferret (MCF en sociologie, ENS de Lyon) et sera accueilli au Centre Max Weber en lien avec le Centre Blaise Pascal (CBP). Le poste sera rattaché à l’équipe « Dispositions, pouvoirs, cultures, socialisations », sur le site Descartes de l’ENS de Lyon.
La personne recrutée sera responsable de la structuration du corpus d'entretiens et des analyses qui en découlent. Elle sera encadrée conjointement par le porteur du projet (sociologue) et un chercheur en informatique chargé du fine-tuning des modèles.
La collecte étant encore en cours à la prise de poste, la base complète ne sera disponible qu'en cours de contrat ; une première base issue de la phase de test est exploitable dès l'arrivée. Les premiers mois servent donc à concevoir et tester la chaîne de traitement sur cette base réduite, avant de l'appliquer au corpus complet.
Master 2 ou doctorat en sociologie quantitative, humanités numériques, traitement automatique des langues, linguistique de corpus ou statistique appliquée aux sciences sociales serait un plus.
Une expérience du traitement de corpus textuels de grande taille est attendue.