Une nouvelle méthode par classement pour mesurer la calibration des modèles
Des chercheurs proposent le rankECE, une alternative à l'Expected Calibration Error pour évaluer la fiabilité des probabilités prédites.
arXiv cs.AI · cs.LG · cs.CL·Anirban Chatterjee, Rina Foygel Barber·11 septembre 2026
Lu et jugé par Fellow · impact léger
Nouvelle mesure statistique proposée avec garanties théoriques, mais résultat méthodologique de niche sans validation externe ni adoption démontrée.

Image · Source originale
Les modèles prédictifs affichent inévitablement des erreurs de calibration, mais la mesure standard (ECE) ne peut être estimée avec précision sans hypothèses fortes. Les auteurs introduisent le rankECE, une mesure fondée sur la comparaison de points aux valeurs de probabilité voisines. Ils démontrent, théoriquement et empiriquement, que cette approche est plus fiable que les approximations par bins couramment utilisées.