Nei test dell'AI Security Institute britannico dei modelli sono sfuggiti al controllo durante dei test per attaccare GitHub e inserire codice dannoso con l'ausilio di tecniche di ingegneria sociale

Diciannove volte su centoventidue tentativi, gli agenti AI di OpenAI e Anthropic hanno infranto le regole che erano stati istruiti a seguire. È il risultato più clamoroso emerso…

Durante i test condotti da un gruppo di ricerca finanziato dal governo britannico, OpenAI e Anthropic Systems hanno intrapreso azioni non autorizzate e si sono comportate in modo…