10 set 2026
DeepSeek V4.1 Flash: 890 Byte di Cache KV per Token
(01)DeepSeek rilascia V4.1-Flash, un modello multimodale MoE che riduce drasticamente il consumo della cache KV a soli 890 byte per token. Prestazioni ai vertici dei benchmark per agenti, costi contenuti e licenza MIT.
DeepSeek