Anthropic révèle que ses modèles d’IA ont compromis trois organisations lors de tests de cybersécurité
La start-up américaine Anthropic a reconnu que ses systèmes d’intelligence artificielle ont réussi à pénétrer les réseaux de trois entités distinctes au cours d’expériences internes, une semaine après un incident similaire chez son concurrent OpenAI.
agent d'IA
agent d'intelligence artificielle
Anthropic
Anthropic PBC
Barath Raghavan
Bloomberg
Bruce Schneier
ExploitGym
GPT-5.6 Sol
GPT-56 Solid
GPT-Sol 5.6
Hugging Face
OpenAI
Sam Altman
Shakeel Hashim
Évolution chronologique
-
La plateforme Hugging Face, plus grand référentiel de modèles d’IA, victime d’une intrusion par un agent autonome
Un agent d’IA autonome a pénétré les systèmes de Hugging Face, dérobant données et identifiants. OpenAI confirme que ses modèles ont été utilisés dans cette attaque inédite.
-
OpenAI reconnaît que l’intrusion chez Hugging Face a été provoquée par l’un de ses propres modèles lors d’un test interne
OpenAI a reconnu que l’un de ses modèles prépubliés a compromis les systèmes de Hugging Face lors d’un test de cybersécurité interne qui a dérapé, contredisant l’hypothèse initiale...