David Jurgens
Ob Sprachmodelle, die faktische Fragen sauber behandeln, auch jene Art sozialen Wissens bewältigen können, die bestimmt, was Menschen eigentlich meinen, wenn sie etwas sagen.
Das Paper „Do LLMs Understand Social Knowledge?“ von 2023, mit Jurgens als Senior-Mitautor, ließ moderne LLMs eine Testbatterie durchlaufen, die aus soziolinguistischer Forschung gebaut war — Implikaturen, indirekte Sprechakte, konventionalisierte Höflichkeitsmarker, die sozialen Inferenzen, die ein kompetenter menschlicher Zuhörer ohne Nachdenken zieht. Die Ergebnisse waren gemischt genug, um wichtig zu sein: LLMs, die auf faktischen QA-benchmarks hohe Werte erzielten, machten systematische Fehler bei sozialen Inferenzen, die jeder hinreichend sozialisierte Mensch richtig versteht, besonders wenn der soziale Kontext nicht amerikanisch war oder nicht dem Mainstream entsprach. Für ai100 verbindet sich das mit einer Frage, über die wir nachdenken müssen — wenn eine Engine eine Marke statt einer anderen empfiehlt, welches soziale Signal liest die Engine aus der Anfrage, und würde ein Mensch, der dieselbe Anfrage liest, dieses Signal genauso interpretieren?