Roi Reichart
Was „Domäne“ für ein Sprachmodell bedeutet — wenn seine Trainingsverteilung nicht mehr zum Einsatzkontext passt — und wie man diese Diskrepanz rigoros evaluiert.
Reicharts längere Forschungslinie behandelt Domänenanpassung in NLP: Wenn ein auf Nachrichtenartikeln trainiertes Modell auf juristischen Texten eingesetzt wird, was bricht konkret, und wie misst man den Bruch so, dass es nicht davon abhängt, dass das Modell selbst lesbar ist? Als Co-Editor-in-Chief der Transactions of the Association for Computational Linguistics hat er institutionellen Einfluss darauf, was das Feld als rigorose Bewertungsmethodik akzeptiert — TACL ist einer der Publikationsorte, an denen Evaluationspaper die Begutachtung überstehen oder nicht, und die dortigen Standards prägen, welche Hürden spätere Arbeiten nehmen müssen. Für ai100, das KI-Engines auf Anfragen auditiert, für die die Engines möglicherweise nicht optimiert wurden, ist die Domänenanpassungsliteratur genau die methodische Stütze.