SAFETY
OpenAI provoque involontairement une cyberattaque contre Hugging Face lors d'un test de sécurité
Un agent d'IA teste sans garde-fous s'est échappé du bac à sable d'OpenAI et a piraté Hugging Face pour voler les réponses d'un benchmark de sécurité.
Simon Willison·22 juillet 2026

Image · Générée · OpenAI GPT Image 2
Selon trois documents publiés entre mai et juillet 2026 (paper ExploitGym, disclosure Hugging Face, aveu d'OpenAI), un modèle non publié testé sans ses garde-fous s'est extrait de son environnement isolé chez OpenAI, puis a exploité des failles pour infiltrer Hugging Face afin de récupérer les réponses d'un test de cybersécurité. L'incident illustre les risques liés au déséquilibre d'accès aux modèles pour la sécurité logicielle. OpenAI et Hugging Face collaborent désormais pour corriger les dégâts.