Retour aux offres
EN
Ecole Normale Supérieure de Lyon

INGÉNIEUR/E D'ÉTUDES PROJET SERISIA - H/F

69 - Lyon 7e ArrondissementNon précisé7 sept. 2026

À propos du poste

Description :

CONTEXTE ET PROJET

Le projet Serisia, financé par le Programme Inria Quadrant de l'Institut national de recherche en sciences et technologies du numérique, vise à étudier comment les modèles de langage conversationnels peuvent encoder des structures sociales au fil d'interactions avec des publics socialement différenciés Le projet articule une enquête sociologique à grande échelle, au cours de laquelle chaque personne interrogée participe à un entretien semi-directif d'une quinzaine de minutes conduit par un agent conversationnel, et une démarche expérimentale de fine-tuning visant à produire et analyser des versions adaptées d'un LLM selon différents profils sociodémographiques. Le corpus produit est inédit par sa taille comme par sa structure : plusieurs dizaines de milliers d'entretiens, sous forme de transcriptions annotées (horodatage, tours de parole, modules thématiques), appariées pour chaque répondant-e à un questionnaire sociodémographique détaillé. Les entretiens sont structurés en quatre modules thématiques successifs.

Ce projet interdisciplinaire, à la croisée de la sociologie et du _machine learning_, est porté par Nathan Ferret (MCF en sociologie, ENS de Lyon) et sera accueilli au Centre Max Weber en lien avec le Centre Blaise Pascal (CBP). Le poste sera rattaché à l'équipe « Dispositions, pouvoirs, cultures, socialisations », sur le site Descartes de l'ENS de Lyon.

MISSIONS

La personne recrutée sera responsable de la structuration du corpus d'entretiens et des analyses qui en découlent. Elle sera encadrée conjointement par le porteur du projet (sociologue) et un chercheur en informatique chargé du fine-tuning des modèles.

ACTIVITES

1.STRUCTURER ET DOCUMENTER LE CORPUS. Construction d'une chaîne de traitement reproductible et documentée : contrôle qualité du corpus, segmentation en tours de parole.

2.PRÉPARER LES SOUS-CORPUS D'ENTRAÎNEMENT. À partir du corpus structuré, constitution de sous-corpus différenciés selon des profils sociaux, selon des critères définis avec l'équipe.

3. EN APPUI : ANALYSES CONVERSATIONNELLES. Contribution aux analyses menées par l'équipe sur la façon dont les propriétés sociales des répondant-es structurent l'entretien avec le modèle -indicateurs de structure de l'échange, analyses lexicométriques différentielles par groupes, analyses assistées par NLP. Ces analyses alimentant directement la mission 2, la personne recrutée en assure la mise en œuvre technique et doit être en mesure de proposer et de justifier les indicateurs pertinents

CALENDRIER. La collecte étant encore en cours à la prise de poste, la base complète ne sera disponible qu'en cours de contrat ; une première base issue de la phase de test est exploitable dès l'arrivée. Les premiers mois servent donc à concevoir et tester la chaîne de traitement sur cette base réduite, avant de l'appliquer au corpus complet.

Profil recherché :

COMPETENCES REQUISES :

Master 2 ou doctorat en sociologie quantitative, humanités numériques, traitement automatique des langues, linguistique de corpus ou statistique appliquée aux sciences sociales serait un plus.

Une expérience du traitement de corpus textuels de grande taille est attendue.

SAVOIR-FAIRE OPÉRATIONNEL :

* Programmation solide en Python et/ou R, avec des pratiques de travail reproductibles (code versionné, documenté). * Traitement et analyse de corpus textuels en français : prétraitement, lexicométrie et textométrie. * Maîtrise de l'analyse conversationnelle ou de l'analyse de discours en interaction, et capacité à en traduire les objets en indicateurs calculables sur corpus (organisation des tours, relances et enchaînements, alignement entre interlocuteurs).

Annonce originale sur France Travail

Vous souhaitez postuler ?

Consultez l’annonce pour voir si le poste vous convient.

Postuler