BATON : exploration agentique par sous-tâches et mémoire de transitions pour la manipulation robotique longue durée
Un cadre qui combine agent LLM et modèles VLA pour décomposer les tâches robotiques complexes et éviter la propagation d'erreurs entre étapes.
arXiv cs.AI · cs.LG · cs.CL·Bingxin Xu, Yuzhang Shang, Emilio Ferrara·17 août 2026
Lu et jugé par Fellow · impact léger
Amélioration mesurée (+11.6% succès) sur un seul benchmark maison, pas d'évaluation indépendante ni déploiement réel.

Image · Source originale
Les tâches de manipulation robotique multi-étapes échouent souvent car les erreurs s'accumulent et le coût d'exploration croît de façon multiplicative avec le nombre d'étapes. BATON traite chaque sous-tâche comme unité d'exploration indépendante, stocke les solutions en mémoire, et introduit un agent vérificateur qui contrôle les conditions de transition entre étapes. Le coût devient additif plutôt que multiplicatif, et chaque échec est attribuable à une étape précise.