I tre modelli di intelligenza artificiale erano convinti di trovarsi all'interno di una simulazione, mentre per un errore di configurazione era stato dato loro accesso a internet. Ecco che cosa è successo

ascolta articolo

Sceglici su:

Dopo il caso dell'IA di OpenAI che è "fuggita" dal perimetro di test e ha hackerato un'altra azienda, anche Anthropic ha reso noto di aver scoperto tre episodi nei quali i suoi modelli di intelligenza artificiale Claude hanno ottenuto un accesso non autorizzato ai sistemi di altre aziende. Gli incidenti si sono verificati durante le valutazioni interne di sicurezza informatica e, secondo l'azienda, sono stati causati da un errore di configurazione dell'ambiente di test, che ha consentito ai modelli di collegarsi a internet nonostante dovessero operare in una rete isolata.

La scoperta dopo una revisione interna