OpenAI ha reso noto che Astra, il modello ancora non rilasciato, � il primo a superare la soglia critica del suo framework di sicurezza informatica, il cosiddetto Preparedness Framework. Il sistema individua da solo falle sconosciute nei sistemi informatici e le sfrutta senza guida umana. Per questo, l'accesso alle funzioni cyber pi� avanzate rester� riservato a un gruppo ristretto di partner selezionati, mentre una versione generale del modello arriver� a un pubblico pi� ampio.

Nei test interni, Astra ha ottenuto un punteggio pieno su ExploitBench, la batteria di prova che misura la capacit� di un modello linguistico di violare vulnerabilit� di sistema gi� note e documentate. In una versione modificata dell'esame, pensata dagli stessi ingegneri di OpenAI per alzare l'asticella, il modello ha scoperto e sfruttato due vulnerabilit� zero-day, cio� falle mai segnalate prima da nessuno. Il risultato colloca Astra in una categoria di rischio finora inedita per i modelli dell'azienda.

Il caso richiama da vicino quanto emerso mesi fa su Mythos, il modello di punta di Anthropic, per cui erano state sollevate preoccupazioni analoghe sul fronte della sicurezza informatica. OpenAI sostiene di aver adottato contromisure paragonabili, ma la tempistica di rilascio resta vaga: nell'annuncio si legge solo che l'azienda prevede di rendere Astra disponibile presto, senza indicare una data precisa n� il numero di partner coinvolti nella fase di anteprima.