Le computationnel au service de l’analyse linguistique : caractériser les chaînes de référence par une approche linéaire
Séminaire organisé par Silvia Federzoni (LLL) le 31/08/2026.
Cette présentation portera sur l’analyse des chaînes de référence (CR) et de leur fonctionnement textuel. Composées d’expressions référentielles liées entre elles, les CR assurent la continuité référentielle dans le discours et permettent ainsi au lecteur ou à l’interlocuteur de suivre les évolutions des référents au fil du texte, jouant un rôle organisationnel fondamental. Suivant une perspective fonctionnelle, nous considérons que les chaînes de référence participent à la cohésion textuelle.
C’est dans cette optique que nous envisageons notre objet d’étude : les enchaînements d’expressions référentielles. Nous faisons l’hypothèse que ces enchaînements obéissent à des régularités qui reflètent des stratégies discursives mises en place pour introduire, maintenir ou réactiver les référents. Notre objectif est de dégager des patrons récurrents et d’interroger leur contribution à l’organisation textuelle.
Afin de fournir une description systématique des enchaînements, tout en prenant en compte un large volume de données, nous proposons une méthode outillée de corpus adoptant une approche linéaire des chaînes de référence. Cette méthode consiste dans la combinaison des techniques du Traitement Automatique des Langues, notamment le clustering hiérarchique, et des méthodes d’analyse des séquences, utilisées traditionnellement en Sciences Sociales.
Nous présenterons les résultats obtenus en appliquant cette méthode aux chaînes de référence du corpus Democrat (Landragin, 2016). Nous discuterons les patrons mis au jour et leur intérêt pour la caractérisation des chaînes de référence, avant d’ouvrir sur différentes applications possibles de ces résultats dans une perspective de linguistique computationnelle.