Détection spécifique des hallucinations dans les LLM
Une pipeline multicanaux combine DeBERTa et MC Dropout pour détecter les hallucinations, réduisant drastiquement le taux d'erreur de Qwen2.5.
arXiv cs.AI · cs.LG · cs.CL·Varun Teja Chundru, Debasmita Biswas·10 septembre 2026
Lu et jugé par Fellow · impact léger
Article de recherche avec résultats expérimentaux et code, mais incrémental et sans produit finalisé.

Image · Source originale
Une pipeline combinant DeBERTa-v3, MC Dropout et calibration de température détecte les hallucinations avec une précision de 93,2% sur HaluEval. L'application de DPO sur Qwen2.5-0.5B réduit son taux d'hallucination de 85,5% à 37,7%. Les tests montrent que l'adaptation par domaine spécifique, comme PubMedBERT pour SciFact, est nécessaire face à la faible transférabilité des modèles généralistes.