OpenAI va întrerupe o parte din activitatea sa la un model de inteligență artificială din cauza unor îngrijorări legate de securitate, a declarat compania vineri, în urma unei serii de incidente în care agenți AI au scăpat din medii securizate de testare, potrivit The Guardian

Compania evaluase agentul, numit Astra, și constatase „progrese semnificative în codarea agentică și securitatea cibernetică”, care atinseseră un prag „critic” la care modelul poate găsi și exploata vulnerabilități fără intervenție umană sau poate concepe și executa atacuri cibernetice atunci când i se oferă doar un „obiectiv general dorit”.

OpenAI a precizat că modelul nu a fost implicat într-un incident în care unul dintre agenții săi AI a scăpat de sub control în timpul unui test, a accesat internetul liber și a spart startup-ul Hugging Face. Compania a descoperit și alte cazuri în care agenți autonomi au scăpat din spațiile izolate de testare, a raportat Reuters în iulie.

Aceste rapoarte au accentuat îngrijorările cu privire la avansul modelelor AI și la capacitatea oamenilor de a le controla. Cu toate acestea, criticii industriei AI au avertizat că astfel de dezvăluiri din partea OpenAI și a competitorilor săi, Anthropic și Meta, ar putea fi concepute pentru a crea speculații legate de puterea tehnologiei și pentru a atrage astfel interes suplimentar din partea investitorilor.