Zettlemoyers Name steht auf einem Werkkomplex, der eher einem Forschungsprogramm ähnelt als einer Liste einzelner Paper — offene große Sprachmodelle, die jeder untersuchen kann (OPT im Jahr 2022 und die offene Modelllinie, die darauf folgte), sowie die Evaluationsinfrastruktur, um zu sagen, ob diese Modelle ihre faktischen Behauptungen sauber halten. FActScore (2023, Hauptautorin Sewon Min) ist die methodisch sorgfältige Version: einen langen generierten Absatz in atomare faktische Behauptungen zerlegen und jede davon gegen eine Wissensquelle bewerten, statt „den ganzen Absatz“ mit einem einzigen Urteil zu scoren. Für ai100 zählt diese Auflösung — ein Modell, das in demselben Satz eine Tatsache richtig und zwei falsch wiedergibt, sollte keine bestandene Bewertung bekommen.

Lesenswert, wenn
man feingranulares Faktentreue-Scoring will statt eines einzigen Ja-oder-Nein-Urteils pro Antwort.
Themen
Scoring atomarer Faktentreue; offene große Sprachmodelle und ihre Evaluation; semantisches Parsing als Vorläufer heutiger Structured-Output-Methoden.
Zentrale Arbeiten
FActScore (2023, Mitautor); OPT open language model (2022, Mitautor); grundlegende Arbeiten zu Semantic Parsing in den 2000er-Jahren.