Shi был соавтором обзора галлюцинаций "Siren's Song" (2023) вместе с Yue Zhang, но подошёл к проблеме со стороны внедрения — из NLP-центра крупной китайской технологической платформы, продукты которой достигают примерно миллиарда пользователей. Та же таксономия типов галлюцинаций (фактологичность vs. верность источнику, intrinsic vs. extrinsic) читается иначе, когда вопрос операционный: какие категории реально появляются в продакшен-трафике, какие можно отсеять последующим фильтром, а какие требуют менять сам прогон обучения. Это стоит читать рядом с академической стороной того же обзора, потому что перспектива внедрения выводит на поверхность режимы отказа, которые чистая benchmark-работа пропускает.

Стоит читать, когда
вы хотите понять, какие категории галлюцинаций ломают вещи в продакшене, а какие имеют значение только в академических benchmark.
Темы
категории галлюцинаций в развёрнутых LLM-продуктах; индустриальный NLP в масштабе; разрыв между benchmark-поведением и поведением в продакшене.
Ключевые работы
"Siren's Song in the AI Ocean: A Survey on Hallucination in LLMs" (2023, соавтор); продолжающиеся публикации Tencent AI Lab NLP Center.