Toutes les news taguées avec ce sujet.
Cortex propose une interface de planification hiérarchique reliant VLM et VLA pour réaliser des tâches robotiques complexes en plusieurs étapes.
Un nouveau modèle Vision-Language-Action permet aux robots d'opérer depuis n'importe quel angle de caméra sans nécessiter de calibration extrinsèque préalable.
Des chercheurs présentent FurnitureVLA, premier système robotique bimanuels capable d'assembler des meubles réels grâce à un modèle Vision-Language-Action.
Une méthode permet aux annotateurs de définir leurs propres axes d'évaluation en langage naturel pour guider l'apprentissage de politiques robotiques.
AutoDex automatise entièrement la collecte de données de saisie robotique en conditions réelles, multipliant par 4,8 le débit par rapport à la téléopération humaine.