LLMs
DeepSeek-V4-Flash sta in memoria grazie agli esperti a 4 bit
DeepSeek-V4-Flash attiva 13 Mld di parametri per token ma ne tiene 284 Mld residenti. Gli esperti sono in FP4: è questo a fissare quasi tutta la memoria.
19 giorni fa
Tutti gli articoli su Llm Ops
DeepSeek-V4-Flash attiva 13 Mld di parametri per token ma ne tiene 284 Mld residenti. Gli esperti sono in FP4: è questo a fissare quasi tutta la memoria.
Due impostazioni API hanno portato GPT-5.6 Sol dal 13,3 % al 38,3 % su ARC-AGI-3, senza toccare i pesi. Perché a decidere il punteggio è l'harness, non il modello.
GPT-5.6 Pro non è annunciato e ogni specifica è una fuga di notizie. Una lista per rendere ogni lancio di punta un non-evento: fissare gli identificatori, congelare le valutazioni, limitare i costi, designare un ripiego.