Le Centre Max Weber (UMR 5283, ENS de Lyon) recrute un·e ingénieur·e d'études en traitement de corpus, pour six mois, à partir du 1er novembre 2026 (date flexible). Le poste s'inscrit dans le projet SERISIA, financé par le Programme Inria Quadrant, qui étudie comment les modèles de langage conversationnels encodent des structures sociales au fil d'interactions avec des publics socialement différenciés. Le corpus comporte plusieurs dizaines de milliers d'entretiens semi-directifs d'une quinzaine de minutes, conduits par un agent conversationnel, portant sur les pratiques culturelles des répondant·es, leur rapport au travail ou aux études et leurs positions sur des sujets de société. Il est équilibré sur les axes du genre, de l'âge et de la CSP, et chaque entretien, transcrit et annoté, est apparié à un questionnaire sociodémographique détaillé. La personne recrutée en construira la chaîne de traitement, préparera les sous-corpus différenciés selon des profils sociaux, et contribuera aux analyses sur la façon dont les propriétés sociales des répondant·es structurent l'échange avec le modèle. Le profil recherché: maîtrise de Python et/ou R, de l'expérience sur des corpus textuels de grande taille, et un vrai intérêt pour les sciences sociales. Sociologie quantitative, humanités numériques, TAL, linguistique de corpus, statistique appliquée : plusieurs chemins mènent ici. Le poste est basé à l'ENS de Lyon, sur le site Descartes. Si ça vous parle, la fiche complète est sur la plateforme Softy (lien ci-dessous), où vous pouvez candidater directement, ou, de préférence, m'écrire à nathan.ferret@ens-lyon.fr ou/et mourad.ellouze@ens-lyon.fr. Les candidatures sont ouvertes jusqu'au 1er octobre, et n'hésitez pas si vous avez des questions avant de vous lancer, j'y réponds volontiers. https://ens-lyon.softy.pro/offers/220637