Christopher Potts
Les structures linguistiques que les modèles de langage représentent réellement — et celles qu'ils ne font que sembler représenter.
Potts aborde les modèles de langage depuis la linguistique et la philosophie, ce qui lui donne un angle inhabituel sur ce que la méthodologie d'évaluation actuelle nous autorise à conclure. Stanford Sentiment Treebank, que son groupe a co-construit il y a plus de dix ans, est encore cité dans presque tous les articles sur la classification de sentiment — en partie pour le jeu de données lui-même, en partie parce qu'il a fait de la structure compositionnelle, plutôt que de la polarité des mots, l'unité d'évaluation. Ses travaux plus récents sur des benchmarks adversariaux et dynamiques comme DynaSent défendent un point plus discret : un jeu de test statique se périme dès qu'il apparaît, parce que les modèles ultérieurs s'entraînent sur son écho dans le corpus.