Wenjie Li
Wie generatives Retrieval mit den anderen Generierungsaufgaben zusammenhängt — Zusammenfassung und Fragebeantwortung —, die dieselbe Systemarchitektur ebenfalls bewältigen muss.
Generatives Retrieval wurde zunächst als Nischentechnik des Information Retrieval behandelt: Man trainiert ein Sequence-to-Sequence-Modell darauf, zu einer Anfrage Dokument-IDs auszugeben. Lis Forschung, aus einem Hintergrund in Zusammenfassung und NLG kommend, rahmte das Bild neu — sobald ein System Dokument-IDs generieren kann, kann es aus derselben Architektur und denselben Gewichten des Modells auch die Zusammenfassung dieser Dokumente, konditioniert auf die Anfrage, und die Antwort auf die Anfrage, konditioniert auf die Dokumente, generieren. Für ai100 ist das wichtig, weil die Grenze zwischen „das System hat Quellen abgerufen“ und „das System hat sie zusammengefasst“ unscharf wird: Eine moderne Engine im Antwort-mit-Zitaten-Modus tut beides, und Lis Forschungslinie ist der klarste Ort, um zu sehen, warum die beiden Aufgaben schon immer ineinander verschränkt waren.