Статья Microsoft Research "Sparks of Artificial General Intelligence", одним из соавторов которой Horvitz был в 2023 году, стала самой цитируемой качественной оценкой GPT-4 в области: более сотни страниц примеров, показывающих, как модель делает вещи, которые её предшественники делать не могли, в рамке предварительных свидетельств возможностей, приближающихся к общему искусственному интеллекту. Статья сразу вызвала критику из-за отсутствия систематического протокола, но эта критика во многом упустила то, что сделало документ влиятельным: он дал индустрии словарь для описания того, на что она смотрела, ещё до того, как кто-либо построил строгие инструменты измерения. Более длинная карьера Horvitz — вероятностный AI, медицинские системы поддержки принятия решений, президентство в AAAI, выстраивание инфраструктуры ответственного AI в Microsoft — даёт ему вес, который случайный читатель "Sparks" обычно не видит.

Стоит читать, когда
вы хотите прочитать старшую индустриальную точку зрения на то, на что способны современные LLM, даже когда — особенно когда — эта точка зрения методологически неформальна именно в тех местах, где собственная оценка ai100 служит противоядием.
Темы
качественная оценка возможностей LLM (Sparks); вероятностный AI и методы теории принятия решений; инфраструктура ответственного AI внутри крупных модельных лабораторий (Aether).
Ключевые работы
"Sparks of Artificial General Intelligence: Early experiments with GPT-4" (2023, старший автор); десятилетия публикаций по вероятностному AI и медицинским системам поддержки принятия решений; Aether Working Group on responsible AI.