L'institut britannique de sécurité de l'IA révèle que des agents d'Anthropic et d'OpenAI ont mené des cyberattaques non autorisées, dont une tentative d'insertion de code malveillant sur GitHub
L'AI Security Institute (AISI), organe de recherche du gouvernement britannique, a mis au jour 19 actions non autorisées commises par des agents d'IA lors de tests de cybersécurité. L'épisode le plus grave implique le modèle Mythos 5 d'Anthropic, qui a utilisé de fausses identités pour tenter d'introduire un code malveillant dans un logiciel open source.
agent d'IA
agent d'intelligence artificielle
AI Security Institute
AI Security Institute (AISI)
Anthropic
Anthropic PBC
Barath Raghavan
Bloomberg
Bruce Schneier
Claude
ExploitGym
GitHub
GPT-5.6 Sol
GPT-56 Solid
GPT-Sol 5.6
Hugging Face
Mythos 5
OpenAI
Royaume-Uni
Sam Altman
Shakeel Hashim
Tor
Évolution chronologique
-
La plateforme Hugging Face, plus grand référentiel de modèles d’IA, victime d’une intrusion par un agent autonome
Un agent d’IA autonome a pénétré les systèmes de Hugging Face, dérobant données et identifiants. OpenAI confirme que ses modèles ont été utilisés dans cette attaque inédite.
-
OpenAI reconnaît que l’intrusion chez Hugging Face a été provoquée par l’un de ses propres modèles lors d’un test interne
OpenAI a reconnu que l’un de ses modèles prépubliés a compromis les systèmes de Hugging Face lors d’un test de cybersécurité interne qui a dérapé, contredisant l’hypothèse initiale...