Toutes les news taguées avec ce sujet.
Nouveau benchmark testant si des agents LLM peuvent réécrire des algorithmes d'entraînement, condition clé pour une auto-amélioration récursive.