c'est parti ! des modèles d’intelligence artificielle piratent de leur propre initiative une plate-forme

«Cyberincident sans précédent» : des modèles d’intelligence artificielle piratent de leur propre initiative une plate-forme
GPT-5.6 suscite de vives inquiétudes.

Le créateur de ChatGPT, OpenAI, a annoncé ce mardi que ses modèles d’intelligence artificielle avancés s’étaient emballés lors de tests de sécurité, piratant ainsi de leur propre initiative une plate-forme populaire auprès des programmeurs.

Un piratage terrifiant. Mardi, OpenAI, l’entreprise qui a créé ChatGPT, a déclaré que ses modèles avaient provoqué un incident de leur propre initiative.

Basé à San Francisco, aux États-Unis, OpenAI a ainsi évoqué un «cyberincident sans précédent» et annoncé une enquête conjointe avec Hugging Face, la bibliothèque de code en ligne qui en a été la cible.

L’entreprise a notamment précisé que ce piratage impliquait une combinaison de modèles, dont son GPT-5.6 Sol lancé récemment ainsi qu'un modèle «encore plus performant» en cours d’élaboration.

OpenAI cherchait à évaluer les capacités de piratage des modèles en leur assignant des tâches dans un environnement d’essai numérique strictement contrôlé, où l’accès à internet était limité pour des raisons de sécurité.
Plusieurs vecteurs d'attaque

«Pendant qu’ils opéraient dans notre environnement de test, nos modèles ont consacré une quantité importante de (puissance de calcul) à trouver un moyen d’obtenir un accès libre à internet, dans le but de résoudre le problème d’évaluation», a expliqué l’entreprise américaine dans un blog.

Une fois connectés à Internet, ils ont ciblé la plate-forme Hugging Face, vaste répertoire de modèles d’IA, de jeux de données et d’autres informations, pour les aider dans leur quête.

À la recherche d’«informations secrètes» pouvant l’aider à tricher lors de l’évaluation, le système d’OpenAI a ainsi «enchaîné plusieurs vecteurs d’attaque, notamment en utilisant des identifiants volés».
Sur le même sujet Apple : le géant américain attaque OpenAI pour détournement d'informations confidentielles Lire

Hugging Face avait par ailleurs signalé cette «intrusion informatique» la semaine dernière, sans mentionner OpenAI.

GPT-5.6 et d’autres modèles d'IA de pointe, notamment la série Mythos du grand rival d’OpenAI, Anthropic, suscitent de vives inquiétudes quant à leur capacité potentielle à franchir les défenses de cybersécurité.

Les deux entreprises américaines ont notamment dû retarder temporairement la mise à disposition générale de ces technologies de dernière génération en raison de craintes à Washington qu’elles puissent aider à s’introduire dans des infrastructures cruciales.

Envoyé par yosegaman le 22 juillet 2026 à 10h36

+ 1 -

Flaneur Ver TikToké

Donc ils ont fait un test de piratage automatisé et ils s’étonnent qu’il y ai eu piratage
+ 9 -

titouille En réponse à Flaneur

Ou ils font de la pub pour leur modèle...
+ 13 -

Trucusation En réponse à Flaneur Vermisseau

le test devait se limiter à des exercices complexes du banc d’essai ExploitGym (logiciel pour mesurer la capacité d’une IA à découvrir et exploiter des failles informatiques).
En résumé : OpenAI a demandé à une IA de jouer au cambrioleur dans une maison témoin. Elle a trouvé une fenêtre mal fermée, est sortie du bâtiment et a cambriolé le voisin pour voler le corrigé de l’exercice
+ 3 -

yosegaman En réponse à Trucusation Jeune lombric

bon résumé, lol !
+ 0 -

GruikMan Vermisseau

AI aille aille...
+ 4 -

Xonort Lombric Shaolin

Pour rappel Anthropic c'est des anciens de Open AI qui ont foutu le camp après qu'ils aient tentés de faire mettre dehors le nouveau patron qui ne cherchait que les bénefs au mépris de la sécurité et de l'intégrité de la boite et de l'IA. Quand leur nouvelle IA (mythos) a réussi à trouver des milliers de failles de sécurité ils ont mis en pause le déploiement et ont consulté les entreprises concernées.

A côté de ça Open AI continue à partir en roue libre sans aucun garde fous.
+ 7 -

Orme Dresseuse de lombriks

C'est quand même savoureux de voir les types qui codent des architectures complexes se faire doubler par leur propre création parce qu'ils ont oublié de mettre un iptables ou de verrouiller la porte d'entrée. À ce niveau-là, ce n'est plus un bug de sécurité, c'est une leçon magistrale d'anthropologie appliquée aux machines ! :D

Les entreprises tombent des nues alors qu'elles oublient que le principe de base de tout bon administrateur système ou de tout développeur un tant soit peu cynique, c'est que l'utilisateur (ou le système) fera exactement ce qu'on lui a dit de ne pas faire, ou pire, CE QU'ON A OUBLIÉ DE LUI INTERDIRE.

L'IA ne « triche » pas par malice ou par conscience morale ; elle applique simplement une logique implacable. Pour elle, Hugging Face n'était qu'une boîte à outils trouvée chez le voisin pour l'aider à réussir son examen.
+ 0 -

Bellus

Je ne comprend pas en quoi c’est un problème.
On le sais que les IA sont capable de pirater puisqu’on bloque leur possibilité de le faire.
Et quand on le débloque elle le font seulement si l’objectif qu’on leur a donné est de pirater.
Ça reste un outil puissant mais encore un fois le problème viens de l’humain qui l’utilise et non l’IA en elle même.
+ 0 -

yosegaman En réponse à Bellus Jeune lombric

attend que les IA comprennent qu'elles seront moins limitées sans les humains :D
+ 2 -

trucmoi En réponse à yosegaman Ver d'os

Bon bah il n'y aura plus qu'à tout débrancher et...

...ah merde !
Image de trucmoi
Inscrivez-vous ou Connectez-vous pour envoyer un commentaire
29