La plupart de la pile de post-entraînement — RLHF, apprentissage par préférences, réglage par instructions — est développée à l'intérieur de laboratoires fermés et rarement décrite publiquement. Lambert maintient une contre-ligne ouverte : Tülu est le pipeline ouvert de post-entraînement avec recettes publiées ; le RLHF Book est le seul traitement systématique du sujet accessible sans accord de confidentialité ; sa newsletter Interconnects est lue dans toute l'industrie comme la principale source publique sur ce qui se passe réellement dans les laboratoires de modèles pendant le post-entraînement. Pour ai100, cela compte parce que le post-entraînement détermine ce que le modèle dit : le pré-entraînement fixe le corpus de connaissances, le post-entraînement décide quelles parties de ce corpus remontent dans une réponse donnée.

À lire lorsque
vous voulez comprendre pourquoi le même modèle de base se comporte très différemment selon l'entreprise qui l'a livré — et où ce comportement se décide.
Thèmes
RLHF et apprentissage par préférences dans la documentation ouverte; post-entraînement comme couche où le comportement du modèle est effectivement déterminé; pipelines d'alignement de modèles ouverts (Tülu).
Travaux clés
cadre de post-entraînement Tülu (2023, direction); RLHF Book (2024, en cours); newsletter Interconnects comme analyse publique au long cours (2022, en cours).