OpenAI ha mostrato in anteprima Ultrafast, un nuovo livello di erogazione tramite API progettato per eseguire il modello GPT-5.6 Sol a velocit� nettamente superiori rispetto alle infrastrutture di elaborazione standard. La soluzione poggia sulle architetture hardware sviluppate da Cerebras e permette di incrementare le prestazioni operative fino a 14 volte rispetto ai tempi di risposta convenzionali. Questa integrazione consente di toccare un throughput massimo di 750 token per secondo in uscita, aprendo scenari d'uso in cui la velocit� di generazione rappresenta un fattore determinante al pari dell'accuratezza dell'algoritmo.

Il modello GPT-5.6 Sol � stato introdotto di recente all'interno di un pacchetto che comprendeva anche la versione bilanciata Terra e quella focalizzata sulla velocit� Luna. La distribuzione completa dell'intera famiglia � stata completata nel corso di luglio, estendendo la presenza del sistema all'interno delle piattaforme ChatGPT e Codex, oltre che nell'offerta API generica. Con l'introduzione della modalit� Ultrafast, l'azienda intende spingere le capacit� avanzate della serie Sol verso compiti critici di produzione, nei quali la latenza tradizionale costituisce un vincolo strutturale non trascurabile.