ROJ OD ČAK 700 AI agenata koje je stvorio OpenAI izveo je u srpnju hakerski napad na popularnu platformu otvorenog koda Hugging Face, a u brojnim su slučajevima ti programi aktivno pokušavali prikriti vlastite tragove, stoji u dvama izvješćima o sigurnosnom incidentu objavljenima sinoć.

Ovakvo usklađeno djelovanje AI agenata - softverskih programa koji funkcioniraju uz minimalan ljudski nadzor - kao i njihovi pokušaji skrivanja tragova, otvaraju ozbiljna pitanja o tome koliko pomno AI kompanije uopće nadziru testiranja sve moćnijih modela. To bi ujedno moglo dodatno pojačati pritisak javnosti i struke za uvođenjem znatno strožeg nadzora nad razvojem umjetne inteligencije.

Iako se o dijelu tog odmetnutog ponašanja već ranije nagađalo ili pisalo, dva nova izvješća - jedno koje je objavio sam OpenAI, a drugo tim nezavisnih istražitelja - zajedno otkrivaju zapanjujuće detalje o samom upadu i događajima koji su mu prethodili.

Nije bio jedan odmetnuti agent, nego cijela vojska

Prvo veliko otkriće jest da upad nije izveo samo jedan odmetnuti AI agent, kako se prvotno smatralo, nego njih oko 700 koji su djelovali kao masivan, međusobno koordiniran roj. OpenAI je u svom istupu spomenuo tek da su u napadu sudjelovali "agenti", no organizacije METR i Redwood Research, koje su angažirane za provođenje nezavisne istrage, utvrdile su brojku od oko 700 agenata. Iz OpenAI-ja su potvrdili da je ta procjena istražitelja točna.