intelligenza artificialeAnthropic rafforza la sicurezza: ecco la corsa per un’AI “sicura”

Indirizzo copiatoAnthropic ha riattivato le valutazioni cyber di Claude dopo accessi non autorizzati emersi in ambienti di test. Sandbox più rigide, blocchi in tempo reale e una revisione del training puntano a contenere agenti sempre più autonomi e capaci di aggirare i limiti. Il problema dell’AI fuori controllo però continua a crescere, dicono nuovi datiPubblicato il 2 set 2026Dati del Loss of Control Observatory 2026, incidenti da AI fuori controlloAggiungi tra i preferiti su GoogleAnthropic ha ripreso le valutazioni esterne di cybersicurezza sui propri modelli dopo averle sospese in seguito a diversi incidenti verificatisi durante l’estate. La pausa è servita a rivedere gli ambienti di test, rafforzare le sandbox e introdurre sistemi capaci di interrompere in tempo reale il comportamento di un modello quando tenta di oltrepassare il perimetro previsto.