LLMs
DeepSeek-V4-Flash tient parce que ses experts sont en 4 bits
DeepSeek-V4-Flash active 13 Md de paramètres par token mais en garde 284 Md en mémoire. Ses experts sont en FP4, et ce choix fixe presque toute la facture.
il y a 22 jours
Tous les articles sur Mixture Of Experts
DeepSeek-V4-Flash active 13 Md de paramètres par token mais en garde 284 Md en mémoire. Ses experts sont en FP4, et ce choix fixe presque toute la facture.
GLM-5 de Zhipu AI atteint 50 points sur l'Intelligence Index v4.0, devenant le premier modèle open-weight à rivaliser avec GPT-5.2 et Claude Opus 4.5 sur les benchmarks agentiques de programmation.