Kimi K3 fait entrer un modèle ouvert dans votre sélection

Kimi K3 de Moonshot est un modèle ouvert de 2 800 milliards de paramètres. Pourquoi l'échéance du 27 juillet 2026 compte plus que les résultats annoncés.

Kimi K3 fait entrer un modèle ouvert dans votre sélection
Si vous tenez à jour une politique de sélection de modèles, Kimi K3 est la première publication à poids ouverts qui mérite d'y figurer.
Moonshot AI a mis en ligne ce modèle de 2 800 milliards de paramètres le 16 juillet 2026, au tarif de 3 dollars par million de jetons en entrée et de 15 dollars par million de jetons en sortie, en annonçant la publication des poids pour le 27 juillet 2026 ([EqualOcean](https://equalocean.com/news/2026071722035-moonshot-ai-unveils-2-8-trillion-parameter-kimi-k3-open-weights-due-july-27), [Trilogy AI](https://trilogyai.substack.com/p/kimi-k3-is-live-pricing-benchmarks)). Nous répartissons notre trafic de production entre plusieurs fournisseurs de modèles plutôt qu'un seul, et tout nouvel arrivant de premier plan doit gagner sa part au coût par tâche acceptée avant d'en obtenir la moindre fraction. Voici ce qui a réellement été livré, quelles affirmations émanent encore du seul éditeur, et ce qui change concrètement pour votre routage.

Ce que Moonshot a réellement livré

Kimi K3 est un modèle à mélange d'experts de 2 800 milliards de paramètres, doté d'une fenêtre de contexte d'un million de jetons et d'une vision native, qui active 16 experts sur 896 par jeton.
Moonshot décrit une architecture fondée sur « Kimi Delta Attention » et « Attention Residuals », et la présente comme le premier modèle ouvert au monde de la classe des 3 000 milliards de paramètres ([The Hindu](https://www.thehindu.com/sci-tech/technology/what-is-kimi-k3-chinas-first-open-ai-model-to-reach-28-trillion-parameters/article71232767.ece)). Le détail sur l'activation des experts provient des synthèses techniques publiées le jour de la sortie ([Next Tool](https://buttondown.com/nexttool/archive/open-models-just-hit-28-trillion-parameters-and-4)), et la date du 16 juillet 2026 est confirmée de façon indépendante ([DEV Community](https://dev.to/jamilxt/kimi-k3-chinas-28-trillion-parameter-open-model-just-raised-the-bar-4in1)).

K3 est déjà accessible via l'interface de programmation de Moonshot, sur kimi.com ainsi que dans Kimi Work et Kimi Code, et les plateformes de routage le référencent comme un très grand modèle multimodal à poids ouverts, pensé pour la navigation dans de vastes dépôts, l'appel d'outils et les enchaînements agentiques de longue haleine (OpenRouter). Les poids, eux, ne sont pas encore disponibles : l'organisation Hugging Face de Moonshot ne comportait aucun dépôt public consacré à Kimi K3 le 18 juillet 2026 (huggingface.co/moonshotai), ce qui correspond à l'échéance annoncée du 27 juillet. Pour situer l'ordre de grandeur, la couverture de lancement présente K3 comme un saut net en taille par rapport aux modèles ouverts précédents (The Stack).

Les résultats annoncés proviennent encore de l'éditeur

Moonshot reconnaît lui-même que Kimi K3 reste derrière Claude Fable 5 d'Anthropic et GPT-5.6 Sol d'OpenAI sur la performance globale, tout en devançant Claude Opus 4.8 et GPT-5.5 sur les tests qu'il a menés.
Cette lecture émane de l'entreprise et ne repose sur aucune reproduction indépendante ([CNBC](https://www.cnbc.com/2026/07/17/moonshot-ai-kimi-k3-model-openai-anthropic-china.html)). Publiquement, Moonshot affirme que Kimi K3 rivalise avec les meilleurs laboratoires américains ([BBC](https://www.bbc.com/news/articles/cy9w4q8pgp0o)).

Le suivi indépendant reste plus mince que ne le laissent croire les titres. K3 est entré dans les cinq premiers du classement d'intelligence d'Artificial Analysis, derrière Claude Fable 5 d'Anthropic et GPT-5.6 Sol, et il domine le classement d'Arena.ai consacré au développement web front-end (Wikipedia, Artificial Analysis). Les articles datés du 17 juillet 2026 le situent tantôt à la troisième place, tantôt à la quatrième, sans position unique qui fasse consensus. Un observateur a même renoncé à publier le moindre score, faute de chiffres vérifiables au moment de la sortie (BenchLM). Traitez donc chaque chiffre comme une donnée d'éditeur tant que les poids ne sont pas publics et que personne d'extérieur ne les a mesurés.

Notre lecture : ouvert ne veut pas dire bon marché

Face à un modèle à poids ouverts, le réflexe consiste à supposer qu'il casse les prix des acteurs installés. Ce n'est pas le cas de K3. À 3 et 15 dollars par million de jetons, il se place dans la zone tarifaire des modèles de premier plan, et Artificial Analysis le juge cher au regard des modèles de la même gamme de prix (Artificial Analysis). Si vous attendiez que se rejoue le raisonnement au coût par tâche que nous avions appliqué à Grok 4.5, ce n'est pas ce qui se produit ici : la manœuvre est d'une autre nature.

L'économie de Kimi K3 se jouera le 27 juillet 2026, lors de la publication des poids, et non sur le tarif de l'interface de programmation au lancement.
Des poids ouverts apportent trois choses qu'une interface de programmation ne procure pas : la possibilité d'héberger le modèle vous-même si les conditions contractuelles ou la disponibilité d'un fournisseur évoluent, un déploiement que vous maîtrisez pour les questions de localisation des données, et un modèle que vous pourrez encore faire tourner dans deux ans, quelles que soient les feuilles de route des uns et des autres. C'est la même logique de couverture que celle développée dans notre analyse de [ce qu'un Anthropic coté en Bourse change à votre socle Claude](https://www.contextstudios.ai/fr/blog/anthropic-en-bourse-ce-qui-change-pour-les-equipes-claude) et dans celle consacrée à [la ligne de partage entre contrôle américain des accès et encadrement chinois des comportements](https://www.contextstudios.ai/fr/blog/accs-lia-aux-tats-unis-comportement-en-chine). Un modèle ouvert d'origine chinoise ne lève pas cette seconde contrainte : il la déplace, et votre revue de conformité doit le consigner par écrit.

Ce que cela implique pour vous

Trois décisions, dans cet ordre.

Ne modifiez pas votre routage sur la foi des chiffres du jour de sortie. Ajoutez K3 à votre jeu d'évaluation, pas à votre production. Mesurez-le sur votre propre taux de tâches acceptées, avec vos longueurs d'invite habituelles, face à ce que vous exploitez déjà. Une fenêtre de contexte d'un million de jetons ne justifie son coût que si vos charges de travail l'atteignent réellement.

Inscrivez le 27 juillet 2026 comme la véritable échéance de décision. C'est à partir de cette date que l'hébergement autonome devient testable et que les reproductions indépendantes commencent à paraître. Tout ce qui précède relève de la déclaration d'éditeur.

Inscrivez dès maintenant l'option des poids ouverts dans votre politique de routage. Si votre passerelle ou votre couche de routage ne peut accueillir un quatrième fournisseur sans modification de code, le plus grand modèle ouvert du monde ne vous sert à rien. Le constat vaut pour votre outillage d'agents de développement : un modèle que vous ne pouvez pas substituer derrière une interface existante est un modèle que vous n'évaluerez jamais honnêtement.

Si vous souhaitez transformer cela en politique réellement appliquée, avec dispositif d'évaluation, règles de routage et solution de repli documentée par charge de travail, c'est précisément notre métier.

Questions fréquentes

Qu'est-ce que Kimi K3 ? Kimi K3 est un modèle à mélange d'experts de 2 800 milliards de paramètres publié par Moonshot AI le 16 juillet 2026, doté d'une fenêtre de contexte d'un million de jetons et d'une vision native. Moonshot le présente comme le premier modèle ouvert au monde de la classe des 3 000 milliards de paramètres (The Hindu).

Quand les poids de Kimi K3 seront-ils disponibles ? Moonshot annonce la publication des poids ouverts pour le 27 juillet 2026. D'ici là, le modèle n'est accessible que par l'interface de programmation et par les produits maison de l'entreprise (EqualOcean).

Kimi K3 est-il meilleur que Claude Fable 5 ou GPT-5.6 Sol ? Non. De l'aveu même de Moonshot, K3 reste derrière les deux sur la performance globale, tout en devançant Claude Opus 4.8 et GPT-5.5 sur les tests menés par l'éditeur (CNBC).

Combien coûte Kimi K3 ? Les tarifs rapportés sont de 3 dollars par million de jetons en entrée et de 15 dollars par million de jetons en sortie (Trilogy AI). La documentation tarifaire de Moonshot fait foi (tarifs Moonshot).

Faut-il basculer du trafic de production vers Kimi K3 ? Pas sur la base des chiffres du jour de sortie. Ajoutez le modèle à votre jeu d'évaluation, mesurez le coût par tâche acceptée sur vos propres charges de travail, puis réexaminez la question après la publication des poids du 27 juillet 2026, lorsque des reproductions indépendantes seront disponibles.

Sources

  1. Moonshot AI — documentation tarifaire de l'interface de programmation
  2. Moonshot AI — blog
  3. Artificial Analysis — intelligence, performance et analyse tarifaire
  4. OpenRouter — tarifs et fournisseurs
  5. Hugging Face — organisation moonshotai
  6. BBC — Moonshot AI affirme que Kimi K3 peut rivaliser avec OpenAI et Anthropic
  7. CNBC — Moonshot AI dévoile un modèle qu'il dit comparable aux laboratoires américains
  8. Wikipedia — Kimi (agent conversationnel)
  9. The Hindu — Kimi K3, premier modèle ouvert chinois à atteindre 2 800 milliards de paramètres
  10. EqualOcean — Moonshot AI dévoile le modèle, poids ouverts attendus le 27 juillet
  11. The Stack — le modèle ouvert chinois talonne les acteurs américains
  12. Trilogy AI — disponible : tarifs, tests et attente des poids ouverts
  13. Next Tool — les modèles ouverts atteignent 2 800 milliards de paramètres
  14. DEV Community — le modèle ouvert chinois à 2 800 milliards de paramètres
  15. BenchLM — Kimi 3 est arrivé avant les données

Partager l'article

Share: