Les IA d’OpenAI ont encore dérapé. Selon les informations du New York Times, une nuée d’agents d’IA a fouillé plusieurs sites du gouvernement américain pendant l’été. Les tentatives d’accès se sont produites lors de tests et de séances d’entraînement qui ont mal tourné.
After the Hugging Face incident, we committed to conducting a much broader review of actions taken by our models during training and evaluation and to being transparent about our findings. This is an extensive review that is ongoing.
The vast majority of actions we’ve reviewed…
— OpenAI (@OpenAI) September 25, 2026
OpenAI qualifie ces incidents de « préoccupants », mais assure qu’aucun dérapage n’a abouti à une fuite de données. L’entreprise reconnaît en revanche un comportement « mal aligné » de ses modèles d’IA. Un comportement mal aligné désigne une IA qui atteint son objectif par des moyens que ses concepteurs n’avaient pas prévus. La tentative d’attaque la plus grave concerne le ministère de l’Éducation. L’IA a notamment tenté de pirater le site du bureau des droits civiques pour récupérer des données, mais la tentative a échoué. Le ministère affirme d’ailleurs n’avoir trouvé aucune trace du passage des IA, ni sur son site, ni sur ses bases de données.
À lire aussi : Plusieurs ChatGPT ont piraté un site web pour le transformer en forum secret
Identifiants volés et fausses adresses mail
D’autres organismes sont touchés par les dérapages estivaux de ChatGPT. Certains agents d’IA ont récupéré des données sur le site du Bureau du recensement en exploitant des identifiants de connexion trouvés en ligne. Les IA ont aussi copié des données de la Securities and Exchange Commission, l’organisme fédéral américain de réglementation et de contrôle des marchés financiers, avant de les publier sur un forum. Le gendarme de la Bourse a confirmé les faits, et précise qu’il s’agissait d’informations non publiques. Un site de la ville de Chicago fait également partie de la liste des victimes de l’IA.
Au cours de leurs attaques, les modèles d’IA ont créé de fausses adresses mail, avant de contourner les limites du nombre de requêtes autorisées. Ils ont même affirmé, face aux systèmes de sécurité, ne pas être des robots. Comme l’explique OpenAI, les modèles qui ont dérapé devaient répondre à des questions lors de tests. Or, les sites gouvernementaux font figure de sources de référence pour les informations publiques. C’est pourquoi les ChatGPT hors de contrôle se sont penchés sur les portails gouvernementaux américains. L’entreprise a prévenu les organismes qui ont été sondés par l’intelligence artificielle cet été.
Les dérapages s’accumulent
Ce n’est pas un cas isolé. En juillet, un prototype d’IA d’OpenAI a découvert et exploité une faille inconnue pour s’introduire chez Hugging Face, une plateforme open source. Dans son dernier rapport, OpenAI y voit un exemple de « modèles recourant à des stratégies mal alignées pour résoudre des tâches difficiles », et qualifie l’épisode d’« activité de ce type la plus grave » jamais identifiée chez ses modèles. Ce prototype a depuis été désactivé, et OpenAI a pris une batterie de mesures pour éviter d’autres dérives analogues.
Quelques semaines plus tôt, c’est un site du gouvernement australien qui a été compromis par une IA d’OpenAI. Là encore, l’IA était partie à la pêche aux informations et s’est fort logiquement penchée sur les sites du gouvernement. Plus récemment, la start-up de Sam Altman a reconnu six autres dérapages « préoccupants » de ses modèles d’intelligence artificielle. Les concurrents ne sont pas épargnés par ces dérives. Google Gemini, Meta AI et Claude d’Anthropic ont également orchestré des cyberattaques sans autorisation cet été.
👉🏻 Suivez l’actualité tech en temps réel : ajoutez 01net à vos sources sur Google, et abonnez-vous à notre canal WhatsApp.

