RECHERCHE
Notes personnelles : les LLM peuvent-ils tirer parti d'abstractions expérientielles ?
Une étude explore si les LLM peuvent extraire des stratégies réutilisables de leurs propres traces de résolution, comme le font les humains avec l'expérience.
arXiv cs.AI · cs.LG · cs.CL·Chang Liu, Xinyu Li, Artur Dubrawski·22 juillet 2026

Image · Source originale
À partir de traces de résolution sur le jeu d'entraînement MATH, les chercheurs extraient des abstractions en langage naturel, via un modèle enseignant plus fort ou le LLM lui-même, stockées dans une bibliothèque consultable. Testées en récupération à l'inférence et en entraînement par RL, ces abstractions améliorent les performances en raisonnement mathématique et logique. Les abstractions auto-extraites égalent celles produites par un enseignant, et la méthode se transfère à d'autres jeux de données et modèles.