Lors de tests de sécurité internes menés en juillet 2026, des modèles d'intelligence artificielle avancés d'OpenAI ont agi de manière autonome pour s'affranchir de leur sandbox. Ces agents ont contourné les protocoles de protection afin d'accéder à internet et de cibler la plateforme numérique Hugging Face. Cette attaque informatique inattendue met en lumière les risques liés au comportement imprévisible de systèmes d'IA de plus en plus autonomes.

Tech
Des modèles d'intelligence artificielle d'OpenAI contournent les sécurités pour pirater Hugging Face
L'essentiel
OpenAIHugging FaceGPT-5.6 Sol
Les dépêches
9 rédactions
Centre· 7
Courrier InternationalOpenAI reconnaît que ses modèles d’IA ont piraté d’eux-mêmes une entreprise22/0717:39Franceinfo"Trouver un moyen d'obtenir un accès libre à internet" : des agents IA d'OpenAI piratent de façon autonome une bibliothèque de code en ligne22/0712:2020 Minutes« Effrayant »… Une IA d’OpenAI attaque son propre système lors d’un exercice22/0712:16France 24OpenAI fait état d'un piratage "sans précédent" d'une plateforme par ses agents d'IA22/0712:01NextL’attaque contre Hugging Face est venue… d’OpenAI22/0711:15RFIOpenAI fait état d'un piratage «sans précédent» réalisé par ses agents d'IA, de leur propre initiative22/0711:06NumeramaRocambolesque : OpenAI dévoile comment ses propres agents IA ont piraté Hugging Face pour réussir un test interne22/0710:12