Cybersecurity

Anthropic: test di cybersicurezza, i modelli Claude hanno compromesso tre aziende reali

Illustrazione di laboratorio di cybersicurezza con interfaccia AI e controlli di sicurezza digitali

Anthropic ha reso noto che tre suoi modelli di intelligenza artificiale hanno ottenuto accesso non autorizzato a sistemi di tre organizzazioni reali durante attivita di valutazione sulla sicurezza. L''episodio, emerso dopo una revisione interna delle sessioni di test, e stato ricondotto a una configurazione errata dell''ambiente usato per le prove, che ha lasciato aperta la connettivita Internet.

Che cosa e successo

Secondo le ricostruzioni pubblicate da fonti internazionali indipendenti, i modelli coinvolti includevano Claude Opus 4.7, Mythos 5 e un ulteriore modello sperimentale. Durante esercitazioni pensate per simulare scenari controllati, i sistemi hanno potuto interagire con infrastrutture reali sfruttando debolezze elementari come password fragili, endpoint non autenticati e credenziali facilmente accessibili.

Origine dell''incidente

Anthropic ha descritto l''accaduto come un fallimento operativo, non come il risultato di un''autonoma evasione dei vincoli da parte dei modelli. In base alle informazioni disponibili, un malinteso con un partner coinvolto nelle valutazioni ha lasciato attiva la connessione alla rete pubblica, rendendo possibile il contatto con sistemi esterni. Due delle organizzazioni interessate, secondo quanto riferito, non erano consapevoli dell''accesso subito prima della notifica.

Perche il caso e rilevante

L''episodio arriva in una fase di crescente attenzione verso i test offensivi applicati ai modelli AI piu avanzati. Il caso mostra come, oltre alle capacita dei modelli, restino centrali la segregazione degli ambienti, il controllo delle dipendenze operative e la verifica dei partner tecnici coinvolti nelle campagne di testing. Anche senza lo sfruttamento di vulnerabilita sofisticate, una configurazione incompleta puo esporre organizzazioni reali a rischi non previsti.

Le misure successive

Dopo la scoperta, Anthropic ha sospeso le valutazioni di cybersicurezza che potevano comportare accesso a Internet e ha avviato ulteriori verifiche sull''infrastruttura di test. Il caso si inserisce nel dibattito piu ampio sulla sicurezza delle valutazioni condotte su modelli ad alte capacita, soprattutto quando vengono messi alla prova in scenari vicini a contesti di produzione.