LLMs
DeepSeek-V4-Flash sta in memoria grazie agli esperti a 4 bit
DeepSeek-V4-Flash attiva 13 Mld di parametri per token ma ne tiene 284 Mld residenti. Gli esperti sono in FP4: è questo a fissare quasi tutta la memoria.
22 giorni fa
Tutti gli articoli su Mixture Of Experts
DeepSeek-V4-Flash attiva 13 Mld di parametri per token ma ne tiene 284 Mld residenti. Gli esperti sono in FP4: è questo a fissare quasi tutta la memoria.
GLM-5 di Zhipu AI raggiunge 50 punti nell'Intelligence Index v4.0, diventando il primo modello open-weight a competere con GPT-5.2 e Claude Opus 4.5 nei benchmark agentici di programmazione.