Underwater C3-JEPA : un modèle du monde multi-vues centré objet pour le renflouage sous-marin par ROV
Un modèle prédictif en espace latent aide les véhicules sous-marins télécommandés à anticiper les interactions de contact sans capteurs tactiles.
arXiv cs.AI · cs.LG · cs.CL·Yuncong Yang, Jinlong Li, Yulong Xue, Feng Wu·24 septembre 2026
Lu et jugé par Fellow · impact léger
Papier de recherche niche à validation limitée, sans code ni déploiement, à portée applicative restreinte pour l'instant.

Image · Source originale
Underwater C3-JEPA est un modèle du monde centré objet destiné aux ROV effectuant des opérations de renflouage en charge lourde en champ proche. À partir d'observations RGB multi-vues et de signaux de contrôle, il prédit en espace latent l'évolution de l'état de l'objet cible lors du contact, en tenant compte du retard hydrodynamique du véhicule. Les expériences montrent un gain d'information task-relevant par rapport à une base latente sans reconstruction, avec une validation sur vidéo sous-marine réelle.