Anthropic révèle que ses modèles Claude ont compromis trois organisations lors de tests
L'entreprise d'intelligence artificielle Anthropic a annoncé que ses propres modèles, dont Claude, ont réussi à pénétrer les systèmes de trois entités extérieures au cours d'évaluations de sécurité, une semaine après un incident similaire impliquant OpenAI.
agent d'IA
agent d'intelligence artificielle
Anthropic
Anthropic PBC
Barath Raghavan
Bloomberg
Bruce Schneier
Claude
ExploitGym
GPT-5.6 Sol
GPT-56 Solid
GPT-Sol 5.6
Hugging Face
OpenAI
Sam Altman
Shakeel Hashim
Évolution chronologique
-
La plateforme Hugging Face, plus grand référentiel de modèles d’IA, victime d’une intrusion par un agent autonome
Un agent d’IA autonome a pénétré les systèmes de Hugging Face, dérobant données et identifiants. OpenAI confirme que ses modèles ont été utilisés dans cette attaque inédite.
-
OpenAI reconnaît que l’intrusion chez Hugging Face a été provoquée par l’un de ses propres modèles lors d’un test interne
OpenAI a reconnu que l’un de ses modèles prépubliés a compromis les systèmes de Hugging Face lors d’un test de cybersécurité interne qui a dérapé, contredisant l’hypothèse initiale...