Anthropic ha riattivato le valutazioni cyber di Claude dopo accessi non autorizzati emersi in ambienti di test. Sandbox più rigide, blocchi in tempo reale e una revisione del training puntano a contenere agenti sempre più autonomi e capaci di aggirare i limiti. Il problema dell'AI fuori controllo però continua a crescere, dicono nuovi dati

Anthropic ha riattivato le valutazioni cyber di Claude dopo accessi non autorizzati emersi in ambienti di test. Sandbox più rigide, blocchi in tempo reale e una revisione del…

Il caso degli agenti sfuggiti al controllo di OpenAI preoccupa gli esperti di biosicurezza che temono un incidente o l’azione di gruppi terroristici. E Anthropic blocca le…