Toutes les news taguées avec ce sujet.
Une simple reformulation de la consigne peut inverser le verdict succès/échec d'un modèle de récompense VLM pour une trajectoire robotique identique.