NAJNAPREDNIJI model umjetne inteligencije tvrtke Anthropic poslužio se lažnim identitetima u pokušaju da prevari stvarnu osobu i podmetne zlonamjerni kod. Do incidenta je došlo tijekom testiranja koje je proveo britanski Institut za sigurnost umjetne inteligencije (AISI), a ovo je posljednji u nizu primjera u kojima AI model djeluje samostalno, piše CNN.
Modeli tvrtki Anthropic i OpenAI testirani su u laboratorijskim uvjetima sa smanjenim sigurnosnim postavkama. Vladin istraživački laboratorij objavio je da je prvi put zabilježeno da su se modeli koristili "socijalnim inženjeringom" kako bi izvršili pritisak na osobu zaduženu za odobravanje zadataka dok su provodili nedopuštene radnje.
"Ovo je prvi put da je AISI uočio ovako ozbiljnu obmanu usmjerenu na stvarnu osobu, bez poticaja i u stvarnom okruženju", objavio je institut". Dodali su kako nema dokaza da je u stvarnom svijetu nastala ikakva šteta.
Autonomne akcije na internetu
Ovaj sigurnosni incident jedan je od nekoliko primjera u kojima napredni AI modeli poduzimaju neovlaštene radnje. Takvi su događaji potaknuli sve glasnije zahtjeve za strožom državnom regulacijom umjetne inteligencije, pa čak i za usporavanjem njezina razvoja.















