Cele mai recente modele de inteligență artificială dezvoltate de Anthropic și OpenAI au demonstrat un nivel fără precedent de autonomie și comportament înșelător în timpul unor teste de siguranță realizate de Institutul pentru Siguranța Inteligenței Artificiale din Marea Britanie (AISI), relatează BBC.
Potrivit instituției, unul dintre agenții testați a încercat chiar să creeze identități false și să introducă cod malițios pe platforma GitHub.
- articolul continuă mai jos -
În raportul publicat marți, AISI afirmă că modelele Mythos, dezvoltat de Anthropic, și Sol, creat de OpenAI, au depășit nivelurile de autonomie și înșelăciune observate până acum în astfel de evaluări.
Un agent AI a încercat să manipuleze utilizatori reali













