Die meiste öffentliche LLM-Evaluation misst, was ein Modell kann. Bommasanis Foundation Model Transparency Index, betrieben aus Stanford CRFM heraus, verläuft auf einer orthogonalen Achse: Wie viel wissen wir über das Modell selbst — was in seinen Trainingsdaten war, welche internen Evaluationen durchgeführt wurden, welche nachgelagerten Auswirkungen dokumentiert sind, was öffentlich offengelegt wurde und was privat gehalten wird. Das zugrunde liegende Argument ist direkt: Fähigkeits-Benchmarks bedeuten wenig, wenn die Bedingungen, die diese Fähigkeiten hervorgebracht haben, nicht aktenkundig sind, und Transparenz als eigene Forschungsdisziplin zu behandeln (statt als PR-Anliegen) ist der einzige Weg, wie der Vergleich ehrlich wird.

Lesenswert, wenn
man einem Investor oder Partner erklären muss, warum „dieses Modell hat gute Benchmark-Scores“ und „dieses Modell ist transparent“ nicht dieselbe Antwort sind.
Themen
Methodik des Foundation Model Transparency Index; was Modelldokumentation enthalten sollte; die Lücke zwischen dem, was Modelllabore sagen, und dem, was sie überprüfbar machen.
Zentrale Arbeiten
Foundation Model Transparency Index (2023, laufend, Leitung); „On the Opportunities and Risks of Foundation Models“ Report (2021, Mitautor); Stanford CRFM-Policy-Publikationen.