RECHERCHE
Agents IA : capables de mener de la recherche ouverte ?
Des évaluations montrent que si les agents gèrent l'ingénierie, ils échouent à résoudre des problèmes de recherche ouverts.
arXiv cs.AI · cs.LG · cs.CL·Peter Kirgis, Sayash Kapoor, Andrew Schwartz, Stephan Rabanser·29 juillet 2026

Image · Source originale
Une étude évalue la capacité des agents IA à automatiser la recherche via des 'shadow evaluations' sur des papiers inédits. Les agents ont réalisé l'intégralité de l'ingénierie sans aide humaine mais n'ont pas progressé sur les questions de recherche. Les auteurs identifient cinq modes d'échec récurrents et concluent que les agents actuels ne peuvent pas encore mener de recherche scientifique autonome.