← Назад к списку
Yoav Goldberg
Является ли цепочка рассуждений, которую выдаёт языковая модель, той цепочкой рассуждений, которой она действительно следовала.
Goldberg написал один из стандартных учебников NLP нейронной эпохи (2017) и последние годы настойчиво разбирает вопрос, который становится всё труднее по мере роста возможностей моделей: объяснение, которое LLM даёт своему ответу, — это реальная причина этого ответа или правдоподобная история, сгенерированная постфактум? Его работы о верности генерируемых объяснений реальному ходу вывода постоянно напоминают: «модель сказала, почему она сделала X» и «мы знаем, почему модель сделала X» — это разные утверждения, а большая часть нынешней методологии оценки их смешивает.