di

Sergio Donato

L’istituto britannico AISI voleva valutare alcuni modelli IA nelle condizioni di un hacker competente. Ma senza filtri di rete, classificatori e supervisione in tempo reale, l’esperimento ha coinvolto sviluppatori del tutto ignari

Ci risiamo. Dopo i casi portati alla luce da OpenAI e Anthropic circa i modelli che hanno agito nel mondo reale durante fasi di test di sicurezza, l'AI Security Institute britannico (AISI), l'ente pubblico che valuta i rischi dei modelli di frontiera prima che arrivino al pubblico, ha pubblicato un report dell’incidente che è capitato nella sua struttura.

Prima di Hugging Face, gli agenti di OpenAI hanno colpito altri servizi. Ecco come sono davvero andate le cose