I test dell'istituto britannico Aisi su OpenAI e Anthropic rivelano nuovi rischi dei sistemi di IA autonomi: in alcuni casi hanno escogitato strategie di manipolazione per raggiungere gli obiettivi assegnati

L’istituto britannico AISI voleva valutare alcuni modelli IA nelle condizioni di un hacker competente. Ma senza filtri di rete, classificatori e supervisione in tempo reale,…

Diciannove volte su centoventidue tentativi, gli agenti AI di OpenAI e Anthropic hanno infranto le regole che erano stati istruiti a seguire. È il risultato più clamoroso emerso…