La loterie FID : quantifier le hasard caché dans l'évaluation des modèles génératifs
Kyutai met en évidence une part de randomness non documentée dans le calcul du FID, métrique de référence pour évaluer les modèles génératifs d'images.
Kyutai (papers)·1 janvier 2026

Image · Générée · Gemini Nano Banana Pro
Des chercheurs de Kyutai démontrent que le score FID (Fréchet Inception Distance), standard pour évaluer les modèles génératifs, recèle une variabilité stochastique significative et sous-estimée. Selon leurs travaux, de légères différences dans les conditions d'évaluation peuvent produire des écarts notables, remettant en question la fiabilité des comparaisons entre modèles. L'étude propose une méthode pour quantifier et corriger cette randomness cachée.