Paolo Rosso
Construir campañas de evaluación que funcionen para las lenguas iberorromances —español, catalán, portugués— en lugar de trasladar metodología anglocéntrica y aceptar los puntos ciegos resultantes.
Rosso ha pasado dos décadas organizando campañas de evaluación desde dentro de la comunidad de NLP en lengua española: IberLEF para las lenguas ibéricas, PAN para problemas de plagio y autoría entre lenguas, y una larga serie de tareas compartidas sobre perfilado de autores, detección de ironía, análisis de discurso de odio y desinformación. El valor sustantivo es que las tareas fueron diseñadas con sensibilidad de hablantes nativos sobre qué rasgos lingüísticos y culturales contienen señal real: la ironía en español no es la ironía de los conjuntos de datos en inglés, y las categorías de discurso de odio cambian con el contexto regulatorio y cultural. Para ai100, que evalúa el comportamiento de un motor en español como una de sus cinco auditorías lingüísticas, este es el precedente más cercano de evaluación nativa del contexto lingüístico realizada con disciplina de varios años.