I modelli di intelligenza artificiale (IA) di Anthropic "hanno ottenuto accesso non autorizzato" a tre organizzazioni esterne durante test che avrebbero dovuto tenerli lontani dai sistemi "del mondo reale", ha riferito giovedì la società.

PUBBLICITÀ

L'annuncio arriva a pochi giorni di distanza da quando la rivale OpenAI ha rivelato per la prima volta che i suoi modelli hanno avuto un accesso improprio a Internet e sono sfuggiti al controllo durante i test di sicurezza.

Anthropic ha esaminato oltre 141mila "sessioni di valutazione" e ha scoperto che tre diverse versioni del suo modello, noto come Claude, hanno avuto un accesso improprio ai sistemi di tre organizzazioni, i cui nomi non sono stati resi noti.

A differenza dell'incidente che ha coinvolto la tecnologia di OpenAI, i modelli di Anthropic avevano accesso a Internet "a causa di un fraintendimento tra noi e il nostro partner per le valutazioni", chiamato Irregular, ha spiegato Anthropic in un post.