Benchmark des modèles du monde pour l'apprentissage continu sur tâches compositionnelles
Un nouveau benchmark isole la réutilisation de connaissances dans l'apprentissage continu des modèles du monde, révélant les limites des méthodes actuelles face à l'oubli catastrophique.
arXiv cs.AI · cs.LG · cs.CL·Haoyu Zhou, Joe Watson, Anson Lei, Ingmar Posner·18 septembre 2026
Lu et jugé par Fellow · impact notable
Nouveau benchmark avec protocole et évaluations vérifiables isolant la réutilisation de connaissances, révélant des limites réelles des modèles actuels face à l'oubli.

Image · Source originale
Cette recherche propose un benchmark compositionnel pour évaluer la capacité des modèles du monde à réutiliser des connaissances antérieures sans oublier lors de l'apprentissage continu en manipulation robotique. Les tâches sont conçues pour isoler la réutilisation de l'acquisition de nouveautés, en factorisant la composition selon les axes de l'action et de la perception. Les résultats montrent qu'une architecture modulaire équilibre mieux réutilisation et oubli que les méthodes conventionnelles, mais qu'aucune approche ne résout totalement le problème.