Agents IA
DeepSeek V4.1 Flash : 890 octets de cache KV par token
Le modèle DeepSeek V4.1-Flash introduit des optimisations architecturales majeures qui réduisent le cache KV à seulement 890 octets par token. Avec des performances de pointe sur les benchmarks d'agents, ce modèle open-weights (MIT) redéfinit l'efficacité et les coûts de l'IA multimodale.
il y a 9 jours