Generative Tutorial : instructions visuelles contextuelles en temps réel pour tâches physiques
Un framework de réalité augmentée génère des instructions visuelles adaptées à l'environnement utilisateur, surpassant les tutoriels classiques en qualité d'exécution.
arXiv cs.AI · cs.LG · cs.CL·Muzhe Wu, Zuchen Li, Xu Wang, Anhong Guo·21 septembre 2026
Lu et jugé par Fellow · impact notable
Étude utilisateur (24 participants) validant un prototype AR de génération d'instructions visuelles contextualisées, avec des résultats mesurables sur la qualité d'exécution.

Image · Source originale
Les instructions visuelles traditionnelles exigent des utilisateurs qu'ils transposent les démonstrations dans leur propre espace. Generative Tutorial génère des images d'objectifs et des vidéos de démonstration directement contextualisées dans l'environnement réel de l'utilisateur via la réalité augmentée. Une étude avec 24 participants montre une meilleure qualité d'exécution et des intervalles de confirmation plus courts qu'avec des guides pré-écrits, tout en soulevant l'impact de la ressemblance contextuelle sur la confiance et des erreurs de génération sur l'interprétation.