RECHERCHE
πR² : des politiques de flux réactives et temps réel pour la manipulation robotique
Une méthode pour rendre les politiques de manipulation à grands modèles réactives en temps réel, sans sacrifier l'expressivité ni le multi-action.
arXiv cs.AI · cs.LG · cs.CL·Sungjae Park, Shubham Tulsiani·28 juillet 2026

Image · Source originale
Les politiques génératives de manipulation basées sur de grands backbones souffrent d'une latence élevée qui empêche un replanning fréquent. πR² sépare le conditionnement en un canal rapide (proprioception) et un canal lent (vision-langage), et utilise un schéma de flux adaptatif à la latence pour émettre des actions en une étape de débruitage. Appliqué à GR00T-N1.7 sur une plateforme réelle xArm6+XHand, le système replanifie environ 4 fois plus vite que la base.