Yamagishi был основным организатором ASVspoof — международного challenge, который отслеживает, насколько хорошо автоматические системы умеют обнаруживать поддельную или синтетическую речь, — с первого выпуска в 2015 году. Накопленная история серии challenge — один из немногих продольных датасетов в обнаружении AI-контента, охватывающий целое технологическое поколение: от раннего конкатенативного синтеза до современного нейронного клонирования голоса. Он также соорганизует параллельный challenge VoiceMOS для оценки качества синтетической речи, что ставит его в уникальную позицию по обе стороны вопроса: насколько хорошим стал синтез и насколько это качество остаётся обнаружимым. Для ai100, по мере того как AI-движки движутся к голосовому выводу, это методологический стек для оценки того, как звучит LLM, когда LLM говорит.

Стоит читать, когда
вам нужно оценивать AI-сгенерированную речь — либо её качество, либо её обнаружимость — и нужна продольная benchmark-методология, которая отслеживала технологию на протяжении нескольких поколений.
Темы
антиспуфинг голоса (ASVspoof); оценка качества синтетической речи (VoiceMOS); продольное отслеживание прогресса синтеза речи через ежегодные challenge-и.
Ключевые работы
организация серии ASVspoof challenge (с 2015 года); соорганизация VoiceMOS challenge; большой корпус работ по синтезу речи в NII и Edinburgh CSTR.