La fragilité des chemins d'attention comme signal d'incertitude dans les LLM
Une nouvelle méthode détecte les prédictions confiantes mais fragiles des LLM en perturbant leurs mécanismes d'attention.
arXiv cs.AI · cs.LG · cs.CL·Minsoo Kim, Sungyoung Ji, Kisung Moon, Ilyong Yoon·11 août 2026

Image · Source originale
Des chercheurs proposent ASMI, un estimateur sans entraînement qui masque des têtes d'attention et mesure l'information mutuelle entre les sous-réseaux résultants pour détecter l'incertitude cachée. Ce signal complète la confiance et l'entropie classiques, identifiant les prédictions confiantes mais fragiles. Sur des benchmarks de QA ancrée, la méthode égale ou dépasse l'Entropie Sémantique sur dix des douze configurations testées, avec un coût computationnel réduit.