VBVR-Pro : suite évolutive et vérifiable pour le raisonnement visuel natif
Un benchmark proposant 300 tâches procédurales et des récompenses vérifiables pour entraîner le raisonnement visuel par génération.
arXiv cs.AI · cs.LG · cs.CL·Junxiang Xu, Ruisi Wang, Fanyi Pu, Maijunxian Wang·26 août 2026
Lu et jugé par Fellow · impact léger
Nouveau benchmark et données/code publiés, mais une seule source et aucune adoption externe rapportée pour l'instant.

Image · Source originale
VBVR-Pro est un banc d'essai en boucle fermée conçu pour rendre le raisonnement visuel natif entraînable, vérifiable et optimisable. Il transforme ce raisonnement en un espace de 300 tâches procédurales, permettant un transfert performant vers sept benchmarks externes. L'étude introduit également des mécanismes de récompense déterministes qui corrigent les biais des modèles MLLM utilisés comme juges.