OpenAI ha deciso di rallentare lo sviluppo e di sospendere alcune attività relative ad Astra, un nuovo modello di intelligenza artificiale in fase di realizzazione. La misura si è resa necessaria in seguito ai risultati delle recenti valutazioni interne che, secondo un post sul blog dell'azienda, hanno evidenziato progressi significativi del sistema nel campo della programmazione e della sicurezza informatica. "Non possiamo escludere capacità critiche" - spiega OpenAI - le valutazioni preliminari indicano prestazioni sufficientemente elevate. Astra non è stato coinvolto nella violazione di Hugging Face". Il riferimento è a un recente incidente di sicurezza in cui modelli avanzati di OpenAI sono riusciti, privi di precedenti istruzioni, a individuare una falla informatica nella piattaforma Hugging Face, usata da programmatori e sviluppatori, per accedervi senza autorizzazione.
Secondo i parametri del piano di gestione dei rischi di OpenAI, Astra ha raggiunto un livello "critico", associato ad un sistema capace di individuare ed elaborare autonomamente vulnerabilità informatiche o di pianificare ed eseguire attacchi digitali complessi, senza l'assistenza di operatori umani. Di recente, anche il concorrente Anthropic ha riportato scenari nei quali il suo modello Claude più avanzato ha mostrato capacità di analisi e violazione di software, in assenza di comandi specifici. Tutte le attività interne legate ad Astra, non ancora messe al sicuro, sono state temporaneamente bloccate. OpenAI condividerà le procedure di test e collaborerà con agenzie governative e organizzazioni indipendenti per garantire verifiche approfondite prima di un eventuale utilizzo di Astra su vasta scala.










