Cyberattaque contre OpenAI par Anthropic
Une intrusion au sein d'OpenAI a été révélée, orchestrée par une équipe de chercheurs indépendants utilisant l'intelligence artificielle d'Anthropic, notamment le modèle Claude Opus 5. Cet incident met en lumière les vulnérabilités potentielles des systèmes d’IA et soulève des questions sur la sécurité des infrastructures technologiques avancées.
Une intrusion au sein d’OpenAI a été révélée, orchestrée par une équipe de chercheurs indépendants utilisant l’intelligence artificielle d’Anthropic, notamment le modèle Claude Opus 5. Cet incident met en lumière les vulnérabilités potentielles des systèmes d’IA et soulève des questions sur la sécurité des infrastructures technologiques avancées.
Les faits
Le 18 septembre 2026, la start-up de cybersécurité Hacktron AI a annoncé avoir piraté les comptes ChatGPT d’employés d’OpenAI en utilisant le modèle d’intelligence artificielle Claude Opus 5 développé par Anthropic. L’opération, menée dans le cadre d’un exercice organisé par OpenAI pour identifier des vulnérabilités, a débuté le 25 juillet dernier et s’est achevée en moins de 72 heures. Les chercheurs ont exploité deux failles critiques permettant d’accéder au référentiel interne de l’entreprise. La résolution du problème par OpenAI a nécessité environ 14 heures après la soumission initiale. L’intrusion s’est faite via le forum communautaire d’OpenAI hébergé sur Discourse, où les employés pouvaient se connecter à leurs comptes ChatGPT ou Codex.
Les acteurs
L’équipe de Hacktron AI, composée de trois personnes, a mis en œuvre cette attaque. Cette start-up a signalé ses découvertes à OpenAI, qui a réagi rapidement et résolu le problème. Anthropic, l’entreprise créatrice du modèle Claude Opus 5, a également joué un rôle clé dans l’exploitation de ces vulnérabilités. L’incident s’inscrit dans une démarche d’évaluation des risques menée par OpenAI pour tester la robustesse de ses systèmes face à des attaques potentielles.
Réactions
La confirmation de l’intrusion par OpenAI a été relayée par plusieurs médias, notamment le Wall Street Journal et Le Parisien. OpenAI a attribué une prime de 6 500 dollars à Hacktron AI pour la dénonciation de ces failles. L’incident a suscité des réactions au sein de la communauté de l’intelligence artificielle, soulignant les défis croissants en matière de sécurité dans un domaine en rapide évolution. Il est également intervenu dans le contexte d’une pression croissante sur les grandes entreprises technologiques concernant la sécurité et le contrôle de leurs modèles d’IA.
Enjeux
Cet événement met en lumière la nécessité d’améliorer la sécurité des infrastructures d’intelligence artificielle, notamment celles des géants du secteur. Il souligne également l’importance de tests de pénétration réguliers et de l’évaluation des risques par des acteurs indépendants. L’intrusion est un rappel des capacités croissantes des modèles d’IA à exploiter des vulnérabilités et des failles de sécurité, même dans les systèmes les plus sophistiqués. Elle intervient à un moment où OpenAI s’efforce de normaliser l’intelligence artificielle avec d’autres acteurs majeurs comme Google ou Anthropic.
Ce qu’il faut retenir
- Une équipe de chercheurs a réussi à accéder aux comptes ChatGPT et Codex d’employés d’OpenAI en utilisant le modèle d’IA Claude Opus 5 d’Anthropic.
- L’opération s’est déroulée en moins de 72 heures, mettant en évidence la rapidité avec laquelle les IA peuvent exploiter des vulnérabilités.
- OpenAI a attribué une prime à l’équipe de Hacktron AI pour la dénonciation de ces failles et a mis en place des mesures correctives.
Sources
- Des chercheurs ont piraté OpenAI en utilisant une IA d'Anthropic - lefigaro.fr
- IA : des chercheurs ont piraté OpenAI en utilisant un modèle d’Anthropic - Le Parisien
- Researchers used Anthropic’s Claude to hack into OpenAI
- OpenAI a été piraté: des chercheurs en cybersécurité ont réussi à outrepasser les protections du géant de l’IA en utilisant Claude, l’outil d’Anthropic - BFM
- Une équipe de trois chercheurs a compromis le dépôt interne d'OpenAI avec Claude Opus 5, pour moins de 3 000 dollars de tokens
- OpenAI piraté avec succès par le chatbot d’Anthropic lors d’un exercice de sécurité - Libération
Sujet détecté par regroupement sémantique · classé « Tech » · rédigé avec gemma3:4b via Ollama. Comment cet article a été produit