Yamagishi est l'organisateur principal d'ASVspoof, le défi international qui suit la capacité des systèmes automatisés à détecter la parole usurpée ou synthétique, depuis sa première édition en 2015. Le corpus accumulé par la série de défis est l'un des rares jeux de données longitudinaux en détection de contenu IA couvrant toute une génération technologique — de la synthèse concaténative ancienne au clonage vocal neuronal actuel. Il co-organise le défi parallèle VoiceMOS pour l'évaluation de la qualité de la parole synthétique, ce qui le place dans une position unique des deux côtés de la question : jusqu'où la synthèse s'est-elle améliorée, et dans quelle mesure cette amélioration reste-t-elle détectable ? Pour ai100, à mesure que les moteurs d'IA se déplacent vers la sortie vocale, c'est la pile méthodologique pour évaluer ce que donne, à l'écoute, un LLM qui parle.

À lire lorsque
vous devez évaluer une parole générée par IA — sa qualité ou sa détectabilité — et voulez une méthodologie de benchmark longitudinale qui a suivi la technologie à travers plusieurs générations.
Thèmes
anti-usurpation vocale (ASVspoof); évaluation de la qualité de la parole synthétique (VoiceMOS); suivi longitudinal des progrès de la synthèse vocale à travers des défis annuels.
Travaux clés
organisation de la série de défis ASVspoof (2015 et après); co-organisation du défi VoiceMOS; long ensemble de travaux sur la synthèse de la parole à NII et Edinburgh CSTR.