---
type: "Comparison"
title: "Kimi K2.7 vs DeepSeek V4 (2026) : le coding open-weight après Kimi K3 et V4.1-Flash"
description: "Kimi K2.7 vs DeepSeek V4 en 2026 : tarifs OpenRouter à jour, scores Kimi K3 vérifiés par ARC et V4-Flash-0731 sous licence MIT."
resource: "https://www.contextstudios.ai/fr/comparaison/kimi-k2-7-vs-deepseek-v4"
language: "fr"
generated:
  by: "process:contextstudios-md/1"
  at: "2026-10-08T22:09:52.264Z"
status: "stable"
---

# Kimi K2.7 vs DeepSeek V4 (2026) : le coding open-weight après Kimi K3 et V4.1-Flash

Deux laboratoires chinois structurent la course au coding open-weight, et depuis la première version de cette comparaison, tous deux ont livré à nouveau. Moonshot AI a publié Kimi K2.7 Code le 12 juin 2026 — un modèle mixture-of-experts de 1 000 milliards de paramètres orienté usage agentique des outils et débit — puis a fait avancer la lignée vers Kimi K3, qu'ARC Prize a vérifié le 31 juillet 2026 comme nouveau meilleur score open-weight sur ARC-AGI-1 et ARC-AGI-2. DeepSeek a lancé V4 le 24 avril 2026 et l'a rafraîchi le 31 juillet 2026 avec DeepSeek-V4-Flash-0731 : 304 milliards de paramètres, 167 Go de poids, licence MIT simple. La vraie question de 2026 n'est donc plus seulement « K2.7 ou V4 », mais : sur quelle lignée vous standardisez-vous, et à quel niveau d'effort de raisonnement. Aux tarifs OpenRouter actuels, l'écart de coût atteint environ 19x en faveur de DeepSeek sur les tokens de sortie et 4x sur le contexte — mais l'effort de raisonnement fait varier la précision ARC-AGI-2 d'un facteur cinq à l'intérieur d'un même modèle, soit davantage que le choix entre ces deux familles.

## Comparaison Détaillée

| Facteur | Kimi K2.7 Code | DeepSeek V4 | Gagnant |
|--------|------|------|--------|
| Fraîcheur de sortie | Kimi K2.7 Code est sorti le 12 juin 2026, mais la lignée a avancé : la fiche du modèle Kimi K3 a été mise à jour le 27/07/2026. K2.7 ne représente donc plus les poids les plus récents de Moonshot. | DeepSeek V4 est arrivé le 24 avril 2026 et a été rafraîchi le 31 juillet 2026 avec V4-Flash-0731 (304B, 167 Go, fiche mise à jour le 01/08/2026) — les poids ouverts les plus récents des deux côtés de cette page. | DeepSeek V4 |
| Validation indépendante des benchmarks | Les gains de codage annoncés pour K2.7 restent auto-déclarés sur le Kimi Code Bench v2 de Moonshot. La lignée dispose désormais d'une validation tierce — ARC Prize a vérifié 94,5 % sur ARC-AGI-1 et 60,4 % sur ARC-AGI-2 — mais elle appartient à Kimi K3, pas à K2.7. | DeepSeek figure sur des classements indépendants, et Artificial Analysis place V4-Flash-0731 devant MiniMax M3 et ses 428B — une lecture indépendante du build actuel, et non d'un prédécesseur. | DeepSeek V4 |
| Coût d'API | OpenRouter affiche kimi-k2.7-code à 0,73 $/M en entrée et 3,50 $/M en sortie au 02/08/2026. Les 0,95 $/4,00 $ repris ici de LLM Stats sont obsolètes. | deepseek-v4-flash-0731 est affiché à 0,09 $/M en entrée et 0,18 $/M en sortie sur OpenRouter (0,14 $/0,27 $ chez l'éditeur), V4-Pro à 0,435 $/0,87 $ — les tokens de sortie coûtent environ 19 fois moins cher qu'avec K2.7 Code. | DeepSeek V4 |
| MCP et usage agentique des outils | Domine les benchmarks d'usage des outils au lancement : 76,0 MCP Atlas et 81,1 MCP Mark Verified | Solide en code agentique général, mais aucune avance publiée comparable sur l'usage des outils MCP | Kimi K2.7 Code |
| Vitesse d'inférence et débit | La variante HighSpeed atteint 180 tokens/s, jusqu'à 260 en contexte court | Latence solide, surtout V4-Flash, mais aucun avantage de débit publié à ce niveau | Kimi K2.7 Code |
| Fenêtre de contexte | kimi-k2.7-code expose une fenêtre de contexte de 262 144 tokens sur OpenRouter — vaste, mais pas d'un million. L'égalité indiquée auparavant sur cette page était tout simplement fausse. | deepseek-v4-flash-0731 et deepseek-v4-pro exposent tous deux 1 048 576 tokens sur la même couche de routage — une fenêtre 4 fois plus grande pour le travail sur un dépôt entier. | DeepSeek V4 |
| Éprouvé en production et disponibilité | Kimi K2.7-Code compte 665 880 téléchargements sur Hugging Face ; l'attention de la lignée s'est déplacée vers K3 (559 924 téléchargements, 9 502 likes) à peine six semaines après la sortie de K2.7. | DeepSeek-V4-Flash compte 2 814 414 téléchargements — plus de 4 fois K2.7-Code — chez plusieurs fournisseurs, et le build 0731 hérite de cette diffusion au lieu de repartir de zéro. | DeepSeek V4 |
| Efficacité des tokens de raisonnement | Réduit l'usage des tokens de raisonnement d'environ 30 % face à K2.6, abaissant le coût des longues boucles d'agents | Chaîne de raisonnement efficace, mais aucun chiffre de réduction publié comparable | Kimi K2.7 Code |
| Effort de raisonnement contre choix du modèle | Le run Kimi K3 vérifié par ARC Prize chute de 60,4 % à 12,4 % sur ARC-AGI-2 uniquement en abaissant l'effort de raisonnement de max à low — un effondrement de précision d'un facteur 5 à l'intérieur d'un seul modèle, et le coût suit (1,59 $ par tâche au niveau max). | Simon Willison a obtenu un résultat décevant de V4-Flash-0731 au niveau de raisonnement par défaut, puis bien meilleur après avoir réglé reasoning_effort sur high. Aucune des deux familles ne se juge sur son prix affiché : le niveau d'effort commande la qualité comme le coût réel. | Égalité |
| Clarté de la licence | La fiche Hugging Face de Kimi K3 indique license: other avec license_name: kimi-k3 — une licence Moonshot sur mesure, à faire relire par un juriste avant toute mise en production. | DeepSeek-V4-Flash et V4-Flash-0731 déclarent tous deux une licence MIT simple sur leur fiche. Pour qui héberge ou redistribue les poids, c'est la différence entre un cycle de revue juridique et aucun. | DeepSeek V4 |
| Snapshots de prix de septembre 2026 | kimi-k2.7-code à 0,71/3,50 $ (snapshot 10.09.2026) ; Kimi K3 à 3/15 $ offre les scores vérifiés en indépendant, mais ~16x le prix de sortie de V4-Flash. | V4-Flash-0731 divisé par deux à 0,065/0,18 $ le 10.09.2026 — la plus grande avance de coût de ce comparatif (~19x en sortie) et la route 1,3M de jetons la moins chère. | DeepSeek V4 |
| Ère V4.1-Flash (septembre 2026) | Kimi garde des identifiants stables sans redirection : k2.7-code (contexte 262K) et K3 (contexte 1M, 3/15 $) conservent leur comportement documenté durant la vague de septembre. | DeepSeek consolide : V4.1-Flash apporte le contexte natif 1M, la vision, 8B/16B paramètres actifs et un cache KV au quart, et absorbe le point d'accès v4-pro le 14/09 — une ligne rapide, mais deux changements de sémantique en une semaine. | DeepSeek V4 |

## Statistiques Clés

- **Live routing prices, 2026-08-25: kimi-k2.7-code $0.67/M input, $3.40/M output, 262,144-token context; deepseek-v4-flash-0731 $0.14/M input, $0.28/M output, 1,310,720-token context; deepseek-v4-pro-0813 $1.122/$3.366. Output tokens are ~12x cheaper on V4-Flash and the context window is 5x larger.** — [OpenRouter model API (live)](https://openrouter.ai/api/v1/models) (2026)
- **As of July 31, 2026 ARC Prize verified Kimi K3 as the new open-weight high score on both benchmarks: 94.5% on ARC-AGI-1 Semi-Private at $0.77 per task and 60.4% on ARC-AGI-2 Semi-Private at $1.59 per task at max reasoning effort. The same model scores 86.7%/55.0% at high effort and 65.7%/12.4% at low effort.** — [ARC Prize — Verified results, Kimi K3](https://arcprize.org/results/moonshot-kimi-k3) (2026)
- **DeepSeek-V4-Flash-0731 ships 304B parameters (167 GB of weights) under a plain MIT licence; the model card was last modified 2026-08-01. This is the newest open-weight release on either side of this comparison.** — [Hugging Face model API — deepseek-ai/DeepSeek-V4-Flash-0731](https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731) (2026)
- **Kimi K3's model card carries license: other with license_name: kimi-k3 — a custom Moonshot licence, not a standard OSI licence. Card last modified 2026-07-27.** — [Hugging Face model API — moonshotai/Kimi-K3](https://huggingface.co/moonshotai/Kimi-K3) (2026)
- **Willison rates V4-Flash-0731 at $0.14/M input and $0.27/M output as possibly the best value-per-intelligence model available, noting Artificial Analysis ranks the 304B model ahead of the 428B MiniMax M3 — and that the default reasoning level produced a disappointing result until he raised reasoning_effort to high.** — [Simon Willison — deepseek-ai/DeepSeek-V4-Flash-0731](https://simonwillison.net/2026/Jul/31/deepseek-v4-flash-0731/) (2026)
- **Adoption splits by type of user: DeepSeek-V4-Flash has 2,814,414 downloads against 1,947 likes, while Kimi-K2.7-Code has 665,880 downloads against 1,347 likes and Kimi K3 has 559,924 downloads against 9,502 likes — DeepSeek wins on deployment volume, Moonshot on community enthusiasm.** — [Hugging Face model API — adoption counters](https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash) (2026)
- **DeepSeek-V4-Flash-Vision-Exp: DeepSeek's experimental multimodal API model (text + image understanding) went live on the official DeepSeek API platform on 2026-08-21. It matches V4-Flash text capability and is offered on OpenRouter at $0.22/M input, $0.66/M output with a 1,048,576-token context — making V4 Flash the cheapest agentic multimodal option in this comparison.** — [DeepSeek API Docs — official release announcement (news260821)](https://api-docs.deepseek.com/news/news260821) (2026)
- **Snapshot OpenRouter du 10.09.2026 : deepseek-v4-flash-0731 passe à 0,065 $/M en entrée et 0,18 $/M en sortie (contexte de 1 310 720 jetons), soit environ la moitié du tarif de fin août (0,14/0,28 $). kimi-k2.7-code s'affiche à 0,71/3,50 $ (262 144 jetons) et kimi-k3 à 3/15 $ (1 048 576 jetons). L'écart de prix en sortie passe d'environ 12x à environ 19x.** — [OpenRouter model API (live)](https://openrouter.ai/api/v1/models) (2026)
- **DeepSeek-V4.1-Flash confirmé par la note de version officielle du 10/09/2026 : un MoE de 552 B sur une nouvelle architecture encodeur-décodeur causale, 8 B de paramètres actifs en entrée et 16 B en sortie, compréhension visuelle native, servi sous l'identifiant deepseek-flash ; V4-Flash et V4-Flash-Vision-Exp sont retirés.** — [DeepSeek API Docs — news260910](https://api-docs.deepseek.com/news/news260910) (2026)
- **Instantané OpenRouter du 11/09/2026 : deepseek/deepseek-v4.1-flash affiche 0,30 $/M en entrée et 1,20 $/M en sortie avec un contexte de 1 048 576 jetons. Selon la note, le cache KV n'exige que 1/4 de la HBM et 1/8 du stockage SSD de la génération précédente, et les tarifs hors pointe sont à 50 % — une remise directe sur la part cache-hit des coûts d'agent.** — [OpenRouter model API (live) + DeepSeek release note](https://openrouter.ai/api/v1/models) (2026)
- **Mécanique de redirection : à partir du 14/09/2026 à 04:00 UTC, toutes les requêtes deepseek-v4-pro sont routées vers V4.1-Flash aux tarifs Flash jusqu'au lancement de V4.1-Pro ; les identifiants v4-flash retirés basculent aussi à titre temporaire. Les identifiants épinglés restent valides mais changent de cible.** — [DeepSeek API Docs — news260910](https://api-docs.deepseek.com/news/news260910) (2026)
- **DeepSeek V4.1 compresse son cache KV à 890 octets par jeton ; le modèle demande encore environ 510 Go de fichiers pour un fonctionnement local — compression KV et tables de lookup n-grammes apprises sont les deux axes de la frontière d'efficacité, indépendamment du nombre brut de paramètres.** — [Cloud Codes — efficiency-frontier analysis (YouTube, 11.09.2026)](https://www.youtube.com/watch?v=Nm_zN6RQ_eE) (2026)
- **Redirection effective depuis le 14/09/2026 : à partir de 04:00 UTC, toutes les requêtes deepseek-v4-pro sont routées vers V4.1-Flash aux tarifs V4.1-Flash jusqu'au lancement de V4.1-Pro ; V4-Flash et V4-Flash-Vision-Exp sont retirés et routent temporairement vers le même modèle (deepseek-flash) — toute la ligne V4 converge vers un seul endpoint.** — [DeepSeek API Docs — news260910](https://api-docs.deepseek.com/news/news260910) (2026)
- **Instantané OpenRouter en direct du 14/09/2026 : deepseek-v4.1-flash à 0,30 $/M en entrée, 1,20 $/M en sortie, lectures de cache 0,006 $/M, créneaux hors pointe à 0,15 $/0,60 $ — la compression du KV cache (1/4 de la HBM, 1/8 du SSD par rapport à la génération précédente) se répercute directement sur les prix du cache, premier poste de coût des boucles d'agents.** — [OpenRouter model API (live) + note de release DeepSeek news260910](https://openrouter.ai/api/v1/models) (2026)

## Choisissez Kimi K2.7 Code quand...

- Votre charge est fortement orientée MCP et la justesse des appels d'outils est le vrai goulot d'étranglement
- Vous êtes déjà sur la lignée Kimi K2.x et voulez un chemin de mise à niveau qui aboutit au K3 vérifié par ARC
- Le débit compte plus que le prix du token, et les 180-260 tokens/s de la variante HighSpeed sont rentables
- Vous pouvez tourner à un effort de raisonnement élevé ou maximal et achetez de la capacité de pointe plutôt qu'un coût par tâche

## Choisissez DeepSeek V4 quand...

- Le coût par token est votre contrainte principale — les tokens de sortie coûtent environ 19 fois moins avec V4-Flash-0731
- Vous avez besoin d'une fenêtre de contexte d'un million de tokens ; K2.7 Code plafonne à 262 144
- Vous hébergez, affinez ou redistribuez les poids et voulez une licence MIT simple, sans revue juridique
- Vous voulez les poids les plus récents des deux côtés, rafraîchis le 31/07/2026, sur une base de fournisseurs déjà large
- Vous voulez une famille couvrant une strate Flash économique et une strate Pro de pointe pour le routage
- Vous visez la plus grande avance de prix documentée : V4-Flash-0731 est passé à 0,065/0,18 $ par million de jetons au snapshot du 10.09.2026
- Vous voulez la consolidation de septembre 2026 : une ligne Flash unique (contexte 1M, vision, 8B/16B actifs, cache KV au quart) qui absorbe aussi le point v4-pro le 14/09.

## Notre Recommandation

Il n'y a toujours pas de vainqueur unique, mais l'équilibre s'est déplacé depuis la première version de cette page — et il s'est déplacé des deux côtés en même temps. DeepSeek est désormais le meilleur choix par défaut pour presque toute décision de production sensible au coût. Aux tarifs OpenRouter actuels, deepseek-v4-flash-0731 coûte 0,14 $/M en entrée et 0,28 $/M en sortie contre 0,67 $/3,40 $ pour kimi-k2.7-code, soit environ 12 fois moins en sortie, et expose une fenêtre de 1 310 720 tokens contre 262 144 pour K2.7 — l'égalité que cette page enregistrait sur le contexte était tout simplement fausse. Le build 0731 constitue en outre les poids ouverts les plus récents de la comparaison (304B, 167 Go, fiche mise à jour le 01/08/2026) et paraît sous licence MIT simple, là où la fiche de Kimi K3 indique license: other avec license_name: kimi-k3. Si vous hébergez, affinez ou redistribuez, cette seule ligne de licence constitue une décision.

Ce qui a changé en faveur de Moonshot, c'est la validation — mais pas pour le modèle que cette page nomme. ARC Prize a vérifié Kimi K3 le 31 juillet 2026 à 94,5 % sur ARC-AGI-1 Semi-Private et 60,4 % sur ARC-AGI-2, les meilleurs scores open-weight jamais enregistrés chez eux. Les gains de codage de Kimi K2.7 Code restent, eux, auto-déclarés sur le Kimi Code Bench v2 de Moonshot. La lecture honnête est donc la suivante : la lignée Kimi a gagné une crédibilité indépendante, et on la récupère en passant à K3, pas en restant sur K2.7. K2.7 Code conserve une avance réelle exactement là où cette page l'a toujours située : usage MCP des outils (76,0 MCP Atlas, 81,1 MCP Mark Verified), débit (180-260 tokens/s sur la variante HighSpeed) et consommation de tokens de raisonnement inférieure d'environ 30 % à celle de K2.6.

Le constat le plus utile pour qui route réellement du trafic : le choix entre ces deux familles n'est pas le principal levier. Les chiffres d'ARC Prize montrent Kimi K3 passer de 60,4 % à 12,4 % sur ARC-AGI-2 uniquement parce que l'effort de raisonnement descend de max à low, et Simon Willison rapporte la même forme de l'autre côté : V4-Flash-0731 lui a donné un résultat décevant au niveau par défaut et bien meilleur avec reasoning_effort high. Un écart de précision d'un facteur cinq à l'intérieur d'un modèle dépasse l'écart entre les deux modèles. Évaluez un candidat au niveau d'effort que vous paierez vraiment, sinon le prix affiché est une fiction.

Le schéma retenu par Context Studios reste le même dans sa forme et gagne en précision : router par défaut le codage borné à fort volume vers DeepSeek V4-Flash-0731 pour le coût et le contexte, escalader les cas de raisonnement les plus durs vers V4-Pro, et diriger les boucles d'agents fortement orientées orchestration MCP vers la lignée Kimi — en budgétant toutefois Kimi K3 plutôt que K2.7, puisque K3 est l'aboutissement vérifié de ce chemin, et en figeant le niveau d'effort de raisonnement dans la même configuration que le modèle. En plus, le 21/08/2026 DeepSeek a publié DeepSeek-V4-Flash-Vision-Exp — un modèle API multimodal expérimental (texte + image) avec des performances de texte proches de V4 Flash, listé sur OpenRouter à 0,22 $/M en entrée et 0,66 $/M en sortie avec 1M de contexte. Cela étend les cas de production de V4 Flash au travail agentique visuel (captures d'écran, interfaces, schémas) pour une fraction du coût des modèles multimodaux de pointe. Depuis le snapshot du 10.09.2026, le côté DeepSeek a bougé : V4-Flash-0731 passe à 0,065/0,18 $ par million de jetons, l'écart de sortie avec kimi-k2.7-code (~0,71/3,50 $) monte à ~19x ; un build V4.1 Flash (multimodal natif, ~400 jetons/s, fin 10.09) est signalé mais pas encore sur OpenRouter. La formule de routage reste : V4-Flash pour le volume, V4-Pro pour le raisonnement difficile, la lignée Kimi pour les boucles MCP, K3 comme extrémité vérifiée. Depuis le 10/09/2026, l'aperçu V4.1-Flash est confirmé (MoE 552 B, 8B/16B actifs, contexte 1M, 0,30/1,20 $) — et avec la redirection du 14/09, DeepSeek réunit sa gamme en un seul Flash qui sert aussi l'ancien identifiant v4-pro, tandis que Kimi garde une sémantique d'identifiants plus stable. Sur l'axe efficacité, le cache KV de V4.1 est annoncé à 890 octets par jeton (environ 510 Go de fichiers pour des runs locaux) — compression et tables de lookup comptent désormais autant que le nombre brut de paramètres.

## Questions Fréquentes

**Q: Kimi K2.7 ou DeepSeek V4, lequel est meilleur pour coder ?**
A: Cela dépend de votre contrainte. DeepSeek V4 est le choix le plus sûr pour le travail à fort volume et sensible au coût : il est testé indépendamment (83,7 % rapportés sur SWE-bench Verified, 14e sur BenchLM), en production depuis avril 2026, et son palier V4-Flash compte parmi les API de code sérieuses les moins chères. Kimi K2.7 Code est plus fort pour les flux agentiques riches en MCP, dominant les benchmarks d'usage des outils (76,0 MCP Atlas, 81,1 MCP Mark Verified) avec un débit élevé — mais ses gains de code les plus remarqués restent largement auto-rapportés, validez donc d'abord sur vos propres tâches.

**Q: Lequel est le moins cher, Kimi K2.7 ou DeepSeek V4 ?**
A: DeepSeek V4 est le moins cher. V4-Flash affiche environ 0,28 $ par million de tokens en sortie et V4-Pro environ 0,87 $, parmi les plus bas pour des modèles de code sérieux. Kimi K2.7 Code est tarifé à 0,95 $ par million en entrée et 4,00 $ par million en sortie, avec des accès au cache descendant à 0,19 $ par million — compétitif, mais nettement au-dessus du palier Flash de DeepSeek sur le coût de sortie.

**Q: Les scores de benchmark de Kimi K2.7 sont-ils validés indépendamment ?**
A: Pas encore, pour l'essentiel. Au lancement, les gains de code les plus remarqués de Kimi (+21,8 % face à K2.6) viennent du Kimi Code Bench v2 maison de Moonshot, et les chiffres SWE-bench indépendants restent minces. DeepSeek V4, à l'inverse, figure déjà sur des classements indépendants comme Vals AI et BenchLM. Considérez les chiffres de lancement de Kimi comme prometteurs mais non confirmés jusqu'à la publication de benchmarks tiers.

**Q: Puis-je auto-héberger Kimi K2.7 et DeepSeek V4 ?**
A: Oui — les deux sont des modèles open-weight, vous pouvez donc les faire tourner sur votre propre infrastructure pour des raisons de résidence des données ou de conformité, en plus de leurs API hébergées. DeepSeek V4 est déjà disponible chez plusieurs fournisseurs (Fireworks, DeepInfra, Novita, SiliconFlow). Notez que les architectures MoE sont volumineuses : Kimi K2.7 totalise un billion de paramètres et DeepSeek V4-Pro 1,6 billion, auto-héberger les paliers supérieurs demande donc une bande passante mémoire importante.

**Q: Les scores de Kimi sont-ils désormais vérifiés indépendamment ?**
A: En partie — et pas sur le modèle que cette page nomme. ARC Prize a vérifié Kimi K3 le 31 juillet 2026 à 94,5 % sur ARC-AGI-1 Semi-Private (0,77 $ par tâche) et 60,4 % sur ARC-AGI-2 (1,59 $ par tâche), les meilleurs scores open-weight jamais enregistrés chez eux. Kimi K2.7 Code lui-même repose toujours sur le Kimi Code Bench v2 de Moonshot. Si vous attendez une validation indépendante, la réponse est de passer à K3, pas de faire confiance aux chiffres de lancement de K2.7.

**Q: Sur quelle licence pouvons-nous réellement livrer ?**
A: DeepSeek est la réponse la plus nette. DeepSeek-V4-Flash comme le plus récent V4-Flash-0731 déclarent une licence MIT simple sur leurs fiches Hugging Face. La fiche de Kimi K3 indique license: other avec license_name: kimi-k3 — une licence Moonshot sur mesure. MIT n'exige aucune revue juridique avant d'héberger, d'affiner ou de redistribuer ; une licence spécifique, si.

**Q: Qu'apporte la baisse de prix de septembre 2026 ?**
A: Au snapshot OpenRouter du 10.09.2026, deepseek-v4-flash-0731 est à 0,065 $/M en entrée et 0,18 $/M en sortie, contre 0,14/0,28 $ fin août. kimi-k2.7-code : 0,71/3,50 $ ; kimi-k3 : 3/15 $ (1M de jetons). L'écart en sortie monte à ~19x. Un build de test V4.1 Flash (multimodal natif, ~400 jetons/s, fin 10.09) est signalé mais absent d'OpenRouter. Vérifiez les prix au moment du routage.

**Q: Quest-ce que V4.1-Flash a changé le 10 septembre 2026 ?**
A: C'est le Flash confirmé au niveau flagship : MoE 552 B, 8 B de paramètres actifs en entrée et 16 B en sortie, contexte 1M, vision native, à 0,30/1,20 $ par million de jetons selon l'instantané OpenRouter du 11/09. V4-Flash et Vision-Exp sont retirés, et dès le 14/09 à 04:00 UTC l'identifiant deepseek-v4-pro route lui-même vers V4.1-Flash aux tarifs Flash — relancez vos évaluations après ce basculement.

