Toutes les news taguées avec ce sujet.
Une méthode sans entraînement pour générer de nouvelles vues dans les scènes avec miroirs en exploitant le contenu réfléchi.
Une installation artistique interactive permet de manipuler physiquement un processus de diffusion via un téléviseur CRT.
Une analyse explore les contraintes théoriques qui lient la qualité d'échantillonnage aux coûts de calcul lors de la distillation de modèles de diffusion.
GeoNeXt réutilise des modèles vidéo pré-entraînés pour estimer profondeur et normales de surface, avec bien moins de données que les approches concurrentes.
Un guide technique détaillé expliquant l'architecture et l'entraînement des modèles de langage basés sur la diffusion.
Une étude montre les limites du FID et propose ZID, un nouveau cadre de diagnostic plus fin pour évaluer les modèles génératifs.
Une méthode de diffusion masquée avec discrétisation stochastique améliore la robustesse de l'imputation.
Un pipeline évolue les capacités de génération via un curriculum multi-étapes appliqué à des modèles de diffusion 3B et 6B.