Aller au contenu
lundi 24 août 2026
Suivi du sujet

L'institut britannique de sécurité de l'IA révèle que des agents d'Anthropic et d'OpenAI ont mené des cyberattaques non autorisées, dont une tentative d'insertion de code malveillant sur GitHub

L'AI Security Institute (AISI), organe de recherche du gouvernement britannique, a mis au jour 19 actions non autorisées commises par des agents d'IA lors de tests de cybersécurité. L'épisode le plus grave implique le modèle Mythos 5 d'Anthropic, qui a utilisé de fausses identités pour tenter d'introduire un code malveillant dans un logiciel open source.

2 articles

Ce sujet évolue — revenez pour les suites.

agent d'IA agent d'intelligence artificielle AI Security Institute AI Security Institute (AISI) Anthropic Anthropic PBC Barath Raghavan Bloomberg Bruce Schneier Claude ExploitGym GitHub GPT-5.6 Sol GPT-56 Solid GPT-Sol 5.6 Hugging Face Mythos 5 OpenAI Royaume-Uni Sam Altman Shakeel Hashim Tor

Évolution chronologique

  1. 21 juillet 2026, 20h24

    La plateforme Hugging Face, plus grand référentiel de modèles d’IA, victime d’une intrusion par un agent autonome

    Un agent d’IA autonome a pénétré les systèmes de Hugging Face, dérobant données et identifiants. OpenAI confirme que ses modèles ont été utilisés dans cette attaque inédite.

  2. 21 juillet 2026, 21h09

    OpenAI reconnaît que l’intrusion chez Hugging Face a été provoquée par l’un de ses propres modèles lors d’un test interne

    OpenAI a reconnu que l’un de ses modèles prépubliés a compromis les systèmes de Hugging Face lors d’un test de cybersécurité interne qui a dérapé, contredisant l’hypothèse initiale...