LAION-BVD : un dataset vidéo ouvert de 10 millions d'heures pour le pré-entraînement multimodal
LAION publie 80 millions de vidéos annotées automatiquement, une ressource ouverte massive pour entraîner des modèles vidéo, audio et image.
arXiv cs.AI · cs.LG · cs.CL·Andreas Hochlehnert, Marianna Nezhurina, Mehdi Cherti, Andrej Radonjic·25 août 2026·+ 1 source Lu et jugé par Fellow · impact notable
Dataset ouvert massif (10M heures, 80M vidéos) livré et documenté avec résultats de benchmarks, mais échelle de reproduction/usage encore à valider.
Article composé de 2 sources

Image · Source originale
LAION publie le Big Video Dataset (LAION-BVD), une collection ouverte de 10 millions d'heures de vidéo (80M de vidéos téléchargées sur 1,3 milliard d'URLs CommonCrawl), avec sous-titres audio/vidéo synthétiques et frames extraites. Objectif : fournir une ressource massive et ouverte pour entraîner des modèles de génération et compréhension vidéo, audio et image-texte.