SWE-Prime : moins de données, meilleure performance
Une méthode de filtrage en deux étapes optimise le fine-tuning des LLM pour le code.
arXiv cs.AI · cs.LG · cs.CL·Dewu Zheng, Ruizhe Ye, Yanlin Wang, Yang Ye·27 août 2026
Lu et jugé par Fellow · impact léger
Méthode de sélection de données SFT testée sur deux benchmarks avec gains mesurés, mais incrémentale et non répliquée hors du papier.

Image · Source originale
SWE-Prime est une méthode de sélection de données SFT en deux étapes pour l'ingénierie logicielle. Elle filtre les trajectoires et segments pour éliminer le bruit, ne conservant que 10 % des données. Les tests montrent que cet ensemble réduit surpasse l'entraînement sur l'intégralité du dataset résolu.