Il laboratorio di Hangzhou pubblica con licenza MIT un modello da 552 miliardi di parametri che ne attiva 8 in lettura e 16 in scrittura, dichiara 890 byte per token di cache e punteggi alla pari con Opus 5 sul codice

DeepSeek V4.1 Flash: The Native Multimodal Model That's Breaking Speed Records ...

V4.1-Flash arrives as Chinese developers increasingly compete on both frontier performance and cost efficiency