Björn Schuller
Qué tiene que evaluar la tecnología del lenguaje cuando la entrada no es texto sino habla, incluidos los signos emocionales, paralingüísticos y propios de cada hablante que los métodos de solo texto descartan.
Schuller ha organizado durante más de una década el INTERSPEECH Computational Paralinguistics Challenge: benchmarks anuales sobre emoción, sinceridad, idioma nativo, depresión y otras categorías paralingüísticas que los sistemas basados en voz captan o pasan por alto. Su extractor de características openSMILE es el toolkit sobre el que todavía se ejecuta buena parte de la investigación académica en habla afectiva, y su registro publicado cubre el lado metodológico de evaluación de ese subcampo desde sus comienzos modernos. Para ai100, a medida que los motores de IA pasan de interfaces de solo texto a productos en modo de voz, esta es la literatura que ya elaboró qué señales paralingüísticas importan, cuáles pueden medirse de forma fiable y cuáles todavía se resisten a la evaluación automatizada.