MGFlow : un cadre unifié pour l'entraînement distributionnel en génération visuelle en une étape
Un nouveau cadre théorique relie modélisation de distribution et flux de gradient de Wasserstein pour améliorer la génération d'images en une seule étape.
arXiv cs.AI · cs.LG · cs.CL·Chi Zhang, Haoyang Shi, Yueyi Liu, Ruichuan An·28 septembre 2026

Image · Source originale
Les chercheurs proposent un cadre théorique unifiant l'entraînement distributionnel pour la génération visuelle en une étape, reliant modélisation globale et mises à jour ponctuelles via le flux de gradient de Wasserstein. Le modèle MGFlow qui en découle, basé sur des mélanges gaussiens à granularité ajustable, atteint des résultats état de l'art sur ImageNet 256×256. Appliqué à FLUX.2 4B en post-entraînement, il produit un générateur en une étape surpassant le modèle original à quatre étapes sur GenEval et PickScore.