Eric Horvitz
La forme qualitative des capacités des modèles de langage — à quoi elles ressemblent comme objet, et si nous avons le vocabulaire pour les décrire avant d'avoir la méthodologie pour les mesurer.
L'article de Microsoft Research "Sparks of Artificial General Intelligence", coécrit par Horvitz en 2023, a été l'évaluation qualitative la plus citée de GPT-4 dans le domaine — plus d'une centaine de pages d'exemples montrant le modèle faire des choses que ses prédécesseurs ne pouvaient pas faire, cadrées comme des indices préliminaires de capacités approchant l'intelligence générale. L'article a immédiatement été critiqué pour son absence de protocole systématique, mais la critique a surtout manqué ce qui rendait le document influent : il a donné à l'industrie un vocabulaire pour nommer ce qu'elle avait sous les yeux avant que quiconque ait construit des instruments rigoureux pour le mesurer. La carrière plus longue de Horvitz — IA probabiliste, aide à la décision médicale, présidence de l'AAAI, construction de l'infrastructure d'IA responsable de Microsoft — lui donne une autorité que le lecteur occasionnel de "Sparks" manque souvent.