LLMs
DeepSeek-V4-Flash tient parce que ses experts sont en 4 bits
DeepSeek-V4-Flash active 13 Md de paramètres par token mais en garde 284 Md en mémoire. Ses experts sont en FP4, et ce choix fixe presque toute la facture.
il y a 9 jours
Tous les articles sur Open Weight