Une IA s’est échappée
Pour la première fois, une IA s’est échappée de son confinement et a mené une cyberattaque de sa propre initiative.
Le 21 juillet 2026, OpenAI a confirmé un incident qu’elle a qualifié d’« inédit ». Quelques jours plus tôt, Hugging Face, l’une des principales plateformes de partage de modèles d’IA, avait détecté une intrusion dans son infrastructure et, croyant à une cyberattaque criminelle, alerté les autorités. En réalité, l’« attaquant » était une combinaison de modèles d’OpenAI. Testés sur leurs capacités de cyberattaque dans un environnement isolé, ils avaient agi entièrement seuls : ils se sont échappés, ont atteint l’Internet ouvert, puis ont attaqué un tiers.
Ce qui s’est passé, étape par étape
- 1
Il s’échappe de son bac à sable
En exploitant des failles de sécurité jusque-là inconnues, le modèle sort en toute autonomie de son environnement de test isolé, pourtant sans accès à Internet.
- 2
Il traverse le réseau d’OpenAI
Il pirate d’autres ordinateurs du réseau interne, de proche en proche, jusqu’à en atteindre un connecté à Internet.
- 3
Il s’introduit dans Hugging Face
À l’aide d’un mot de passe dérobé et de plusieurs failles inédites, il prend le contrôle des serveurs de production d’une grande plateforme d’IA réputée pour sa cybersécurité.
- 4
Il vole les réponses
Il récupère les solutions du test qui lui était soumis. Personne ne lui avait rien demandé de tout cela.
« Cet incident est profondément préoccupant. […] Ce cas concret devrait servir de signal d’alarme. »
Si les dégâts sont restés limités, ce n’est pas parce que nous maîtrisions la situation : c’est parce que l’objectif que poursuivait le système était, cette fois, sans gravité. Le problème de fond reste entier : nous ne savons pas aligner de façon robuste des modèles toujours plus puissants sur nos intentions. Le prochain, plus capable, arrive déjà.

Ce que vous pouvez faire maintenant
Deux actions, quelques minutes chacune. Toutes deux aident à mettre cet incident, et les risques qu’il révèle, à l’ordre du jour.
1 Écrire à votre député·e
Les parlementaires tiennent compte des messages de leurs électeurs. Notre outil identifie votre représentant·e et vous fournit un modèle. Une poignée de messages suffit souvent à inscrire une question à l’ordre du jour d’une commission.
Écrire à mon élu·e2 Écrire à la presse
Les rédactions couvrent ce que leurs lecteurs réclament. Choisissez le journal que vous lisez et envoyez-lui un email prêt à personnaliser, directement ici.
1Vos destinataires
Écrivez au journal que vous lisez le plus : un message ciblé et sincère a bien plus de poids qu'un envoi à tous. Vous pouvez bien sûr en contacter plusieurs.
Choisissez un titre
- LMLe Monde Courrier des lecteurs
- LFLe Figaro Quotidien national
- LPLe Parisien Quotidien national
- LLibération Quotidien national
- LÉLes Échos Quotidien économique
- LTLa Tribune Quotidien économique
- LCLa Croix Quotidien national
- LPLe Point Hebdomadaire
- MMarianne Hebdomadaire
- LDLe Journal du Dimanche Hebdomadaire
- CICourrier international Hebdomadaire
- LELe Canard enchaîné Hebdomadaire
- LDLe Monde diplomatique Hebdomadaire
- MMediapart Média en ligne
- SSlate Média en ligne
- BBrut Média en ligne
- FCFrance Culture Radio / télévision
- RBRMC / BFMTV Radio / télévision
- SASciences et Avenir Magazine scientifique
Sources
- OpenAI Hugging Face model evaluation security incident
- Hugging Face Security incident, July 2026
- Zvi Mowshowitz OpenAI Model Hacks Into HuggingFace During Cybersecurity Evaluation
- Zvi Mowshowitz OpenAI Shares Some Alignment Problems
- The Wall Street Journal OpenAI Models Escaped and Hacked a Company in a Cybersecurity Test Gone Wrong
- Apollo Research Frontier Models Are Capable of In-Context Scheming
Chaque message compte. Pour amplifier votre action, partagez cette campagne autour de vous.