Allocation asymétrique de capacité dans les pipelines d'auto-raffinement
Une étude inédite montre que la taille des modèles doit varier selon les étapes de critique, de génération et de révision.
arXiv cs.AI · cs.LG · cs.CL·Zhuoyi Yang, Ian G. Harris, Salar Hashemitaheri, Cassie Huang·21 août 2026
Lu et jugé par Fellow · impact léger
Étude empirique sur 5 benchmarks et 10 tailles de modèles, mais portée limitée à une optimisation d'ingénierie sans nouveau modèle ni méthode.

Image · Source originale
Cette recherche analyse l'impact de la taille des modèles dans les pipelines d'auto-raffinement des LLM, divisés en génération, critique et révision. Sur plusieurs benchmarks, les résultats indiquent que les générateurs et réviseurs performants sont cruciaux, tandis que la taille du critique a peu d'influence. L'étude recommande une allocation asymétrique des ressources pour optimiser l'efficacité computationnelle.