← Volver a la lista
Yarin Gal
Cuantificar cuándo los modelos de lenguaje no saben de qué están hablando.
Gal elaboró los fundamentos de la incertidumbre bayesiana en redes neuronales profundas cuando esa literatura aún era pequeña, y en los últimos años ha apuntado el mismo instrumento a los LLM. Su artículo de 2024 en Nature sobre detección de alucinaciones mediante entropía semántica vuelve concreto el hilo conductor: una respuesta fluida y una verdadera no son la misma cosa, y la distancia entre ambas puede medirse desde fuera en lugar de pedirle al modelo que informe sobre sí mismo. El método no requiere verdad de referencia etiquetada ni acceso al interior del modelo, que es el único tipo de método que realmente se aplica a un LLM comercial cerrado.