rMuscle : mémoire motrice pour l'inférence VLA efficiente
Un framework exploitant les similarités des tâches robotiques pour accélérer l'inférence des modèles Vision-Language-Action.
arXiv cs.AI · cs.LG · cs.CL·Kaijun Zhou, Zhiyang Li, Le Chen, Jinyu Gu·16 septembre 2026
Lu et jugé par Fellow · impact léger
Gain d'inférence 1,29-1,42x mesuré sur benchmarks, mais optimisation incrémentale limitée à un cadre technique restreint.

Image · Source originale
rMuscle est un framework d'inférence temps réel pour modèles Vision-Language-Action (VLA) inspiré de la mémoire musculaire humaine. Il exploite la similarité des exécutions répétées en robotique via un cache à deux phases : le Context Cache réutilise les tokens visuels et l'Action Cache réutilise les activations neuronales. Les tests montrent un accélération de 1,29 à 1,42x sur RTX 4090 et Jetson Thor.