Juanzi Li
Combinar el conocimiento estructurado de grafos de conocimiento con los patrones estadísticos que los modelos de lenguaje aprenden del texto — y qué aporta esa combinación a la evaluación.
El KEG Lab de Li en Tsinghua ha sido el hogar metodológico de una de las líneas más longevas sobre modelos de lenguaje aumentados con grafos de conocimiento: OpenKE para embeddings de KG, KEPLER para combinar KG y preentrenamiento de lenguaje, y una línea de investigación que condujo, a través de Zhipu, a la línea de LLM abiertos ChatGLM. El hilo conductor es un compromiso con modelos de lenguaje que tienen un ancla externa de conocimiento estructurado además de su memoria paramétrica, lo que hace que los sistemas resultantes sean más fáciles de auditar: se puede preguntar al modelo y se puede preguntar al KG por separado, y luego comparar. Para ai100, que audita el comportamiento de mención de marcas, la tradición de evaluación aumentada con KG es el precedente más cercano para separar «lo que dice el modelo» de «lo que respaldan sus fuentes».