Gao dirigió el artículo de 2024 "Large Language Models: A Survey": uno de los artículos de síntesis más amplios de la era de los LLM, que organiza la literatura no por artículo, sino por las preguntas que distinguen un linaje arquitectónico de otro (solo decodificador frente a codificador-decodificador, linajes de ajuste por instrucciones, variaciones del entrenamiento de alineación, extensiones de modalidad). El encuadre es inusual porque trata los LLM como un artefacto de investigación que debe clasificarse y analizarse a nivel de especie, no como una sola cosa que haya que aplaudir o rechazar. Su trayectoria más larga en IA conversacional y anclaje da profundidad a esa mirada taxonómica: ha visto qué decisiones arquitectónicas sobreviven al contacto con el despliegue y cuáles no.

Vale la pena seguirlo cuando
se quiere un mapa organizado taxonómicamente del panorama de los LLM escrito por alguien con la perspectiva de investigación industrial necesaria para saber qué distinciones importan de verdad en la práctica.
Temas
estudio a gran escala del panorama de los LLM; IA conversacional y anclaje; los linajes arquitectónicos de los modelos de lenguaje modernos.
Obras clave
"Large Language Models: A Survey" (2024, autor sénior con colaboradores); amplia trayectoria en IA conversacional y anclaje del lenguaje; publicaciones de Microsoft Research Redmond sobre modelos fundacionales.