Junichi Yamagishi
Могут ли человеческие слушатели — или автоматические детекторы — отличить AI-сгенерированную речь от настоящей человеческой, и как эта различимость меняется по мере улучшения синтеза речи.
Yamagishi был основным организатором ASVspoof — международного challenge, который отслеживает, насколько хорошо автоматические системы умеют обнаруживать поддельную или синтетическую речь, — с первого выпуска в 2015 году. Накопленная история серии challenge — один из немногих продольных датасетов в обнаружении AI-контента, охватывающий целое технологическое поколение: от раннего конкатенативного синтеза до современного нейронного клонирования голоса. Он также соорганизует параллельный challenge VoiceMOS для оценки качества синтетической речи, что ставит его в уникальную позицию по обе стороны вопроса: насколько хорошим стал синтез и насколько это качество остаётся обнаружимым. Для ai100, по мере того как AI-движки движутся к голосовому выводу, это методологический стек для оценки того, как звучит LLM, когда LLM говорит.