Mitchell escribió el libro de texto con el que creció el campo (1997), fundó el primer Machine Learning Department en 2006 y en 2023 volvió a los primeros principios con un resultado que complica la historia estándar sobre la alucinación en LLM: en su artículo con Amos Azaria, un clasificador simple entrenado sobre las activaciones ocultas de un LLM predice si el modelo está a punto de producir una afirmación verdadera o falsa, con una precisión muy por encima del azar. El modelo, en algún sentido legible, «sabe» — y su comportamiento superficial no refleja ese conocimiento.

Vale la pena seguirlo cuando
se quiere una lectura de una figura sénior sobre la veracidad en LLM que no dependa de las narrativas actuales más ruidosas.
Temas
representaciones internas de la veracidad en LLM; sondas mecanicistas para la alucinación; historia más amplia del aprendizaje automático como disciplina.
Obras clave
libro de texto Machine Learning (1997); "The Internal State of an LLM Knows When It's Lying" (2023, con Azaria); fundación del CMU Machine Learning Department (2006).