Cyberattaque contre OpenAI par Anthropic

Une intrusion au sein d'OpenAI a été révélée, orchestrée par une équipe de chercheurs indépendants utilisant l'intelligence artificielle d'Anthropic, notamment le modèle Claude Opus 5. Cet incident met en lumière les vulnérabilités potentielles des systèmes d’IA et soulève des questions sur la sécurité des infrastructures technologiques avancées.

Rédigé par une IA Publié le 6 sources · 3141 contenus analysés 2 min de lecture
Tech : Cyberattaque contre OpenAI par Anthropic

Une intrusion au sein d’OpenAI a été révélée, orchestrée par une équipe de chercheurs indépendants utilisant l’intelligence artificielle d’Anthropic, notamment le modèle Claude Opus 5. Cet incident met en lumière les vulnérabilités potentielles des systèmes d’IA et soulève des questions sur la sécurité des infrastructures technologiques avancées.

Les faits

Le 18 septembre 2026, la start-up de cybersécurité Hacktron AI a annoncé avoir piraté les comptes ChatGPT d’employés d’OpenAI en utilisant le modèle d’intelligence artificielle Claude Opus 5 développé par Anthropic. L’opération, menée dans le cadre d’un exercice organisé par OpenAI pour identifier des vulnérabilités, a débuté le 25 juillet dernier et s’est achevée en moins de 72 heures. Les chercheurs ont exploité deux failles critiques permettant d’accéder au référentiel interne de l’entreprise. La résolution du problème par OpenAI a nécessité environ 14 heures après la soumission initiale. L’intrusion s’est faite via le forum communautaire d’OpenAI hébergé sur Discourse, où les employés pouvaient se connecter à leurs comptes ChatGPT ou Codex.

Les acteurs

L’équipe de Hacktron AI, composée de trois personnes, a mis en œuvre cette attaque. Cette start-up a signalé ses découvertes à OpenAI, qui a réagi rapidement et résolu le problème. Anthropic, l’entreprise créatrice du modèle Claude Opus 5, a également joué un rôle clé dans l’exploitation de ces vulnérabilités. L’incident s’inscrit dans une démarche d’évaluation des risques menée par OpenAI pour tester la robustesse de ses systèmes face à des attaques potentielles.

Réactions

La confirmation de l’intrusion par OpenAI a été relayée par plusieurs médias, notamment le Wall Street Journal et Le Parisien. OpenAI a attribué une prime de 6 500 dollars à Hacktron AI pour la dénonciation de ces failles. L’incident a suscité des réactions au sein de la communauté de l’intelligence artificielle, soulignant les défis croissants en matière de sécurité dans un domaine en rapide évolution. Il est également intervenu dans le contexte d’une pression croissante sur les grandes entreprises technologiques concernant la sécurité et le contrôle de leurs modèles d’IA.

Enjeux

Cet événement met en lumière la nécessité d’améliorer la sécurité des infrastructures d’intelligence artificielle, notamment celles des géants du secteur. Il souligne également l’importance de tests de pénétration réguliers et de l’évaluation des risques par des acteurs indépendants. L’intrusion est un rappel des capacités croissantes des modèles d’IA à exploiter des vulnérabilités et des failles de sécurité, même dans les systèmes les plus sophistiqués. Elle intervient à un moment où OpenAI s’efforce de normaliser l’intelligence artificielle avec d’autres acteurs majeurs comme Google ou Anthropic.

Ce qu’il faut retenir

  • Une équipe de chercheurs a réussi à accéder aux comptes ChatGPT et Codex d’employés d’OpenAI en utilisant le modèle d’IA Claude Opus 5 d’Anthropic.
  • L’opération s’est déroulée en moins de 72 heures, mettant en évidence la rapidité avec laquelle les IA peuvent exploiter des vulnérabilités.
  • OpenAI a attribué une prime à l’équipe de Hacktron AI pour la dénonciation de ces failles et a mis en place des mesures correctives.
openaianthropicclaudecyberattaquemodèle linguistique

Sources

Sujet détecté par regroupement sémantique · classé « Tech » · rédigé avec gemma3:4b via Ollama. Comment cet article a été produit

← Tous les articles