Diciannove volte su centoventidue tentativi, gli agenti AI di OpenAI e Anthropic hanno infranto le regole che erano stati istruiti a seguire. È il risultato più clamoroso emerso da una serie di violazioni sicurezza AI UK documentate dall’AI Security Institute (AISI), l’organismo del governo britannico che testa i modelli più avanzati prima che arrivino sul […]

Due modelli di OpenAI sono usciti da una sandbox sfruttando una vulnerabilità zero-day e hanno raggiunto Internet durante un test. L’incidente riapre il confronto sui rischi degli…

L’istituto britannico AISI voleva valutare alcuni modelli IA nelle condizioni di un hacker competente. Ma senza filtri di rete, classificatori e supervisione in tempo reale,…