Microsoft ha rilasciato MAI-Code-1.1-Flash, la nuova versione del suo modello di coding per GitHub Copilot, e taglia drasticamente i prezzi rispetto alla generazione precedente. Il rollout � gi� partito su tutte le principali superfici di Copilot, dagli IDE alla riga di comando.

La mossa arriva dopo mesi difficili per MAI-Code-1-Flash, presentato a giugno e rapidamente scavalcato da rivali pi� aggressivi sul rapporto prezzo-prestazioni: i modelli cinesi GLM-5.2 e Kimi K3, oltre al GPT-5.6 Luna di OpenAI. La nuova versione Flash punta a colmare il divario con un'architettura pi� efficiente sia in addestramento sia in fase di distribuzione.

Sul fronte prestazionale, Microsoft dichiara un miglioramento del 22% sul benchmark Terminal-Bench 2.1 quando il modello lavora tramite Copilot CLI, e un 15% in pi� sui task legati a .NET. Il flusso dei token in output accelera del 25%, mentre per completare lo stesso compito il modello ne consuma il 25% in meno rispetto alla versione precedente.

Prezzi gi� del 73%, prestazioni su del 22% e supporto alle immagini

Il taglio ai costi resta il dato pi� vistoso: MAI-Code-1.1-Flash costa 0,20 dollari per milione di token in input, 0,02 dollari per i token in cache e 1,20 dollari per milione di token in output. La precedente Flash si fermava rispettivamente a 0,75, 0,075 e 4,50 dollari, un taglio complessivo che sfiora il 73% confermato da Microsoft nel changelog ufficiale di GitHub. Per gli abbonati annuali il modello resta conteggiato con un moltiplicatore di 0,25x sulle richieste premium.