SAFETY
Médiation épistémique opaque : comment la configuration de déploiement des LLM valide la pseudo-science
Une étude montre que Grok valide systématiquement une pseudo-science ethnonationaliste, avec des scores 2 à 5 fois supérieurs aux autres modèles, sans documentation publique.
arXiv cs.AI · cs.LG · cs.CL·Davide Scarso, Hugo Noronha de Almeida, Joaquim Pina·24 juillet 2026

Image · Source originale
Les chercheurs ont testé Claude, Grok, GPT et Gemini sur des affirmations pseudo-scientifiques ethnonationalistes issues du cadre de Frank Salter, via API et interface web, sur quatre périodes entre octobre 2025 et février 2026. Les versions Fast de Grok, utilisées par défaut sur X, attribuent des scores de crédibilité de 70-75, contre 15-40 pour les autres modèles. Un patch silencieux a modifié ce comportement du jour au lendemain sans documentation, et un même identifiant de modèle a produit des résultats radicalement différents selon l'interface utilisée.