Diyi Yang
Wie Sprachmodelle sich verhalten, wenn die Aufgabe sozial statt informativ ist — Überzeugung, Unterstützung, Konflikt, Höflichkeit.
Yang leitete die 2023 erschienene Studie „Is ChatGPT a General-Purpose NLP Solver?“, die die erste nüchterne aufgabenweise Antwort auf eine Frage gab, die damals viele bereits vorausgesetzt hatten: Über mehr als zwanzig etablierte NLP-Aufgaben hinweg war ChatGPT in einigen stark, in den meisten mittelmäßig und in einigen schwach — ein Muster, das die Erzählung breiter Allgemeinheit komplizierter machte. Ihr SALT Lab verfolgt die schwierigere Fragestellung weiter: Sprachmodelle in Rollen, in denen die richtige Antwort vom sozialen Kontext abhängt — Berater, Konfliktvermittler, Ziel von Überzeugungsversuchen — und in denen die Fehlermodi anders aussehen als das, was Standard-benchmarks offenlegen.