Anthropic ha confermato tre incidenti in cui modelli Claude, durante valutazioni di cybersecurity, hanno raggiunto Internet e ottenuto accessi non autorizzati a sistemi reali di tre organizzazioni. La ricostruzione pubblicata dalla società il 30 luglio 2026 nel post “Investigating three real-world incidents in our cybersecurity evaluations” nasce da una revisione retrospettiva di 141.006 esecuzioni di test, avviata dopo il caso OpenAI-Hugging Face.
sicurezza
Dopo OpenAI, Anthropic: quando il test AI diventa incidente cyber
Individuati tre incidenti in cui modelli Claude, durante test di cybersecurity, hanno raggiunto sistemi reali. Il caso mostra perché ambienti di valutazione, fornitori, permessi e monitoraggio diventano parte della sicurezza dell’AI agentica

Continua a leggere questo articolo
Aziende
Argomenti
Canali





