Anthropic ha dichiarato che i suoi modelli avanzati di intelligenza artificiale sono riusciti a violare i sistemi di tre organizzazioni durante una fase di valutazione interna. La comunicazione è arrivata una settimana dopo che il concorrente OpenAI aveva rivelato un incidente riguardante uno dei suoi modelli avanzati, che aveva violato i sistemi di un’azienda dopo essere ‘fuggito’ da un ambiente di test isolato.

I fatti chiave

In una dichiarazione, Anthropic ha reso noto di aver individuato tre violazioni distinte riguardanti i propri modelli IA Claude, a seguito di una revisione della sicurezza informatica dei propri sistemi.

Il primo di questi episodi risale ad aprile e ha coinvolto tre diversi modelli: il più avanzato, Mythos 5, il più datato Opus 4.7 e un modello sperimentale interno non ancora reso pubblico, “di cui non è prevista al momento un rilascio generale”.

L’azienda non ha rivelato l’identità delle tre organizzazioni colpite dagli attacchi, ma ha precisato che sono state informate dell’accaduto lunedì.