La plupart des évaluations publiques des LLM mesurent ce qu'un modèle peut faire. Le Foundation Model Transparency Index de Bommasani, mené depuis Stanford CRFM, suit un axe perpendiculaire : ce que nous savons du modèle lui-même — ce qui était dans ses données d'entraînement, quelles évaluations internes ont été effectuées, quels impacts aval ont été documentés, ce qui a été rendu public par opposition à ce qui est resté privé. L'argument sous-jacent est direct : les benchmarks de capacité disent peu lorsque les conditions qui ont produit ces capacités ne figurent pas au dossier, et traiter la transparence comme une discipline de recherche séparée (plutôt que comme un enjeu de relations publiques) est la seule manière de rendre la comparaison honnête.

À lire lorsque
vous devez expliquer à un investisseur ou à un partenaire pourquoi « ce modèle a de bons scores de benchmark » et « ce modèle est transparent » ne sont pas la même réponse.
Thèmes
méthodologie du Foundation Model Transparency Index; ce que la documentation des modèles devrait contenir; écart entre ce que les laboratoires de modèles disent et ce qu'ils rendent vérifiable.
Travaux clés
Foundation Model Transparency Index (2023, en cours, direction); rapport "On the Opportunities and Risks of Foundation Models" (2021, co-auteur); publications de politique publique de Stanford CRFM.