CritICL : généraliser du faible vers le fort à partir des erreurs de petits modèles
Un nouveau cadre exploite les échecs typiques des petits LLM comme exemples critiques en contexte, pour améliorer le raisonnement à moindre coût.
arXiv cs.AI · cs.LG · cs.CL·Yufan Wu, Yinghui He, Zhengyi Hu, Lang Wei·27 août 2026
Lu et jugé par Fellow · impact notable
Papier de recherche avec protocole et code fournis, montrant une réduction des coûts de calcul.

Image · Source originale
CritICL part du constat que les modes d'échec des LLM suivent des motifs structurés au sein d'une même famille de modèles. Plutôt que de les ignorer, la méthode les transforme en exemples critiques utilisés en in-context learning, via deux variantes (dynamique ou statique). Les résultats montrent des performances comparables ou supérieures aux méthodes de test-time scaling, avec beaucoup moins de générations et un coût en tokens réduit.