Toutes les news taguées avec ce sujet.
Nouveau benchmark testant si des agents LLM peuvent réécrire des algorithmes d'entraînement, condition clé pour une auto-amélioration récursive.
Une étude Princeton relativise les prévisions d'explosion des capacités IA : les agents manquent encore de jugement pour la recherche ouverte.