Omer Levy
Может ли языковая модель вывести задачу только из примеров — без явного указания, что делать, — и что эта способность говорит о том, как она представляет инструкции.
Статья Levy "Instruction Induction" (2022, старший автор) перевернула стандартный эксперимент на следование инструкциям: вместо того чтобы дать модели инструкцию и наблюдать, выполняет ли она её, ей дают несколько пар input-output и просят сформулировать, какая инструкция из этих примеров следует. Результаты были одновременно обнадёживающими и тревожными: современные LLM во многих задачах умеют выводить разумные инструкции из нескольких примеров, что говорит о действительно абстрактном внутреннем представлении «задачи»; но иногда они выводят инструкции, которые тонко расходятся с человеческим намерением и меняют последующее поведение. Для ai100 это важно потому, что большинство запросов к движкам не содержат явной инструкции: движок неявно выводит задачу из контекста, и этот вывод может пойти не так, как ожидалось.