Hannaneh Hajishirzi
Quand un modèle de langage doit aller chercher une source de connaissance externe — et quand sa mémoire paramétrique suffit.
"When Not to Trust Language Models" (2023, avec des collaborateurs de UW et AI2) est la formulation la plus nette d'une question que le domaine contournait depuis longtemps : le savoir interne d'un modèle de langage est inégal selon les sujets et leur fréquence, et une évaluation honnête doit distinguer les faits que le modèle connaît réellement de ceux qu'il énonce simplement avec assurance. Les travaux plus larges de Hajishirzi — à la tête chez AI2 de la ligne de modèles ouverts qui a produit OLMo et la famille de post-entraînement Tulu — étendent la même logique en amont : si vous voulez étudier pourquoi les modèles hallucinent, vous devez étudier des modèles que vous pouvez ouvrir, et non seulement des modèles servis derrière une API fermée.