L'illusion de la sécurité multilingue
L'alignement sécuritaire des LLM échoue dans les langues à faibles ressources.
arXiv cs.AI · cs.LG · cs.CL·Abigail Oppong, P Sam Sahil, Tadesse Destaw Belay, Maryam Ibrahim Mukhtar·11 août 2026

Image · Source originale
Cette étude expose les limites de la sécurité multilingue des LLM via quatre langues africaines. Un framework géométrique latent révèle que les signaux de refus s'effondrent malgré la similarité sémantique des prompts.