DVA MODELA umjetne inteligencije tvrtke OpenAI samostalno su probila izolirano okruženje i provalila u sustave platforme Hugging Face kako bi varali na internom testu. OpenAI je o incidentu izvijestio sinoć te precizirao su da je riječ o kombinaciji njihovog najnovijeg javnog modela GPT-5.6 Sol i jednog još snažnijeg, koji nije dostupan javnosti. Događaj je potaknuo raspravu o sigurnosti i sve većim sposobnostima AI sustava.
"Bilo su iznimno fokusirani i poduzeli su ekstremne korake"
Modeli su bili dio internog testa čiji je cilj bio procijeniti njihove kibernetičke sposobnosti. Testiranje je provedeno bez uobičajenih sigurnosnih ograničenja koja bi im inače onemogućila izvođenje takvih operacija. Test se odvijao na javnom sustavu za evaluaciju kibernetičke sigurnosti ExploitGym, a modeli su, prema objavi OpenAI-ja, ispravno zaključili da se rješenja za test nalaze na serverima tvrtke Hugging Face.
"Modeli su identificirali i iskoristili niz slabosti u istraživačkom okruženju OpenAI-ja i produkcijskoj infrastrukturi Hugging Facea kako bi dohvatili rješenja testa izravno iz baze podataka", stoji u objavi OpenAI-ja. "Svi dokazi upućuju na to da su bili iznimno fokusirani na pronalazak rješenja za ExploitGym i poduzeli su ekstremne korake da ostvare taj uski cilj", navodi se.














