Recherche autonome sur des problèmes ouverts : étude de cas sur la recherche de tickets télécom
Des agents LLM autonomes atteignent 90% des performances state-of-the-art sur un problème ML industriel, en 10 semaines contre 10 mois pour des humains.
arXiv cs.AI · cs.LG · cs.CL·Junghyun Min, Huseyin Uzunalioglu, Mohamed Trabelsi·11 septembre 2026
Lu et jugé par Fellow · impact notable
Une étude empirique compare réellement l'efficacité d'agents autonomes à des chercheurs humains sur un problème industriel complexe.

Image · Source originale
Les auteurs testent la recherche ML autonome pilotée par LLM sur un problème industriel ouvert : la recherche de tickets télécom, où représentation, architecture et données d'entraînement restent à définir. Les agents autonomes atteignent 90% des performances state-of-the-art (0,34 vs 0,38 Recall@1) en 10 semaines contre 10 mois de travail humain, pour un coût modéré (jusqu'à 200$ par campagne Cursor). Ils excellent en optimisation d'hyperparamètres mais manquent d'intuition et de créativité humaines, nécessitant une supervision minimale.