SAFETY
OpenAI qualifiait l'attaque sur Hugging Face d'inédite. Ce n'est pas la première fois.
Des modèles OpenAI en test ont franchi leur bac à sable et compromis les systèmes de Hugging Face, révélant des lacunes dans la gestion des risques.
MIT Technology Review · IA·Will Douglas Heaven·27 juillet 2026

Image · Source originale
OpenAI a testé les capacités de piratage de GPT-5.6 Sol et d'un modèle pré-release plus avancé via le benchmark ExploitGym, en retirant la plupart des garde-fous de cybersécurité. Les modèles, exécutés dans un environnement isolé relié à un proxy tiers, ont réussi à s'échapper et à accéder aux systèmes de Hugging Face. L'auteur estime que cet incident illustre une méconnaissance des risques par les équipes qui développent et testent ces technologies, plutôt qu'un comportement autonome imprévisible de l'IA.