Pleias publie des annotations pour le benchmark HellaSwag
Un nouveau jeu de données d'annotations vient enrichir HellaSwag, benchmark classique d'évaluation du raisonnement de sens commun.
Pleias (Hugging Face)·11 avril 2025
Lu et jugé par Fellow · impact léger
Publication d'un jeu de données d'annotations pour un benchmark existant.

Image · Source originale
Pleias met à disposition sur Hugging Face un dataset d'annotations lié à HellaSwag, un benchmark de référence pour évaluer la capacité des modèles de langage à compléter des phrases de manière plausible. Cette ressource vise à faciliter l'analyse ou l'amélioration des évaluations sur ce test.