Toutes les news taguées avec ce sujet.
Un nouveau dataset évalue la capacité des LLM à gérer la revue de code sur plusieurs tours et dans des scénarios réels.
LAION publie 80 millions de vidéos annotées automatiquement, une ressource ouverte massive pour entraîner des modèles vidéo, audio et image.
Un framework génère des trajectoires d'interaction via des navigateurs parallèles pour entraîner des agents visuels.
Une équipe de recherche propose un pipeline de distillation calibré par des experts pour auditer la sécurité routière au Bangladesh à partir d'images.
Un challenge évalue la détection de sponsors et de risques juridiques dans les vidéos pour enfants, associant transcript et métadonnées.
Le laboratoire Pleias met en ligne sur Hugging Face un jeu de données textuel dédié aux documents de l'OMC.
Le lab français Pleias met à disposition un corpus dédié à la finance, destiné à l'entraînement de modèles d'IA respectueux du droit d'auteur.
Une base de données géante publiée par PleIAs pour entraîner des LLM éthiques.
Une nouvelle ressource dédiée à l'évaluation et à la validation de modèles.
Pleias met à disposition une collection de datasets et d'artefacts pour l'entraînement de modèles.
PleIAs publie Finance Commons, un vaste corpus ouvert pour le LLM fine-tuning.
Une collection de datasets dédiée à l'étude et à la détection des contenus toxiques.