RECHERCHE
Pictura : self-play à grande échelle en vue égocentrique pour la conduite autonome
Un simulateur GPU multi-agents rend les vues caméra de chaque agent en temps réel, permettant d'entraîner des politiques de conduite sans observations privilégiées.
arXiv cs.AI · cs.LG · cs.CL·Yuan Yin, Elias Ramzi, Marc Lafon, Valentin Charraut·28 juillet 2026

Image · Source originale
Les chercheurs présentent Pictura, un simulateur de conduite multi-agents accéléré par GPU qui rend la vue égocentrique de chaque agent à chaque étape, éliminant l'écart entre observations privilégiées et perception réelle. Entraîné avec PPO sur 50 milliards de pas d'agent (~35M km), le modèle Alberti est la première politique de self-play entraînée directement depuis des images en perspective, sans données privilégiées. Elle approche les performances de son équivalent privilégié et surpasse ces derniers en transfert zero-shot sur le dataset Waymo Open Motion.