OpenAI ha rallentato lo sviluppo dei suoi modelli più avanzati. A undici giorni dall’annuncio con cui aveva comunicato di non poter escludere capacità cyber “Critical” per Astra, uno dei sistemi in preparazione, l’azienda ha spiegato come le preoccupazioni accumulate nelle settimane precedenti abbiano già modificato il proprio processo di ricerca. A pesare sono stati l’incidente avvenuto durante i test con Hugging Face, le evidenze preliminari sulle capacità cyber di Astra e i rapidi progressi osservati nella ricerca interna.Il 18 agosto OpenAI ha rivelato di aver sospeso per due settimane il reinforcement learning dei modelli più recenti destinati alla distribuzione. Il maggiore ciclo RL di frontiera pianificato rimane ancora fermo, mentre proseguono training ed evaluation su scala più ridotta per studiare il comportamento dei sistemi, verificare le protezioni e raccogliere ulteriori evidenze di alignment. Il dato nuovo non è quindi una conferma definitiva delle capacità Critical di Astra, che resta una valutazione preliminare, ma il fatto che quei segnali abbiano contribuito a cambiare concretamente il ritmo con cui OpenAI sviluppa i propri modelli di frontiera.Indice degli argomenti: