Comparaison Fournisseurs

Kimi K3 vs Claude Opus 5 (2026) : les poids sont publiés — reste la licence et la facture de VRAM

Kimi K3 a publié ses poids le 27 juillet 2026. Ce qui tranche désormais : seuils de licence, 1,5 To de VRAM, prix et reproductibilité.

3
Kimi K3
vs
2
Claude Opus 5
Verdict Rapide

La prémisse sur laquelle cette page reposait a disparu, et il vaut la peine de dire précisément pourquoi. Les poids de Kimi K3 étaient annoncés pour le 27 juillet 2026 et ont été livrés le 27 juillet 2026, à 16h29 UTC. Notre vérification a été lancée le même matin à 3h50 UTC et n'a rien trouvé : exact à cet instant, trompeur dès l'après-midi. Retenez-en la leçon : une affirmation sur l'existence ou non d'une chose a une demi-vie de quelques heures, et elle ne vieillit pas jusqu'à tomber dans un filtre d'obsolescence — elle devient simplement fausse, sans bruit. Cette correction faite, la comparaison est plus favorable à Kimi K3 qu'auparavant, mais sur un autre terrain. Les poids sont réels, largement adoptés et déjà requantifiés par Red Hat et Unsloth. L'avantage de prix tient : 3 / 15 USD contre 5 / 25 USD. La fenêtre de contexte est une véritable égalité, à environ un million de tokens de part et d'autre. Et K3 fait une chose qu'Opus ne fait pas : il publie ses résultats d'évaluation en YAML lisible par machine, à côté de poids téléchargeables, ce qui rend les annonces de l'éditeur réfutables. Personne n'a encore publié ce recalcul : nous notons donc une égalité, pas une victoire. Ce que les poids ouverts ne font pas, c'est rendre l'auto-hébergement banal. À 2 800 milliards de paramètres, K3 exige plus de 1,5 To de VRAM avant tout cache KV et ne tient pas sur un nœud de huit B200. La réponse pratique tient en huit cartes de 288 Go — et le chiffre le plus intéressant de ce travail est que la carte la moins chère l'emporte : 8 AMD MI355X délivrent 48 tokens par seconde et par dollar d'heure-GPU, contre 33 sur une B300 environ 2,4 fois plus coûteuse par GPU. Si vous chiffriez jusqu'ici l'auto-hébergement aux tarifs NVIDIA, votre modèle de coûts comporte une vraie lacune. En résumé : Kimi K3 si votre usage est interne, si le coût par token est contraignant et si du matériel de classe 288 Go est disponible ou louable. Claude Opus 5 s'il vous faut une gouvernance des données en Europe avec API de conformité, si vous préférez ne pas exploiter votre propre pile de service, ou si vous êtes un fournisseur de Model-as-a-Service approchant les 20 M USD de chiffre d'affaires — car à cette limite, la Kimi K3 Licence cesse d'être permissive et devient une négociation. Les poids ouverts ne clôturent pas la décision. Ils la déplacent de la disponibilité vers l'économie et le droit, là où elle aurait dû se situer dès le départ.

Comparaison Détaillée

Une analyse comparative des facteurs clés pour vous aider à faire le bon choix.

Facteur
Kimi K3Recommandé
Claude Opus 5Gagnant
Poids ouverts et auto-hébergement
Livré : moonshotai/Kimi-K3 publié le 27/07/2026 à 16h29 UTC — 96 fragments safetensors, 837 000 téléchargements et 9 600 mentions J'aime en six jours
Fermé et volontairement limité à l'API ; aucun poids proposé, à aucun niveau
Conditions de licence commerciale
Kimi K3 Licence, pas MIT : usage interne sans restriction, mais une activité de Model-as-a-Service dépassant 20 M USD de chiffre d'affaires sur douze mois doit conclure un accord distinct avec Moonshot
Conditions d'API commerciales usuelles : aucun seuil de chiffre d'affaires, aucune obligation de mention, aucun accord à négocier
Respect de la date de publication
Date tenue — les poids sont parus le 27 juillet 2026, le jour annoncé
Ne publie aucun poids par principe : il n'existe donc aucun engagement à tenir ou à manquer
Prix par million de tokens
3 USD en entrée / 15 USD en sortie (OpenRouter, 03/08/2026) — environ 40 % sous le palier Opus
5 USD en entrée / 25 USD en sortie (OpenRouter, 03/08/2026), inchangé depuis Opus 4.8
Coût réel de l'auto-hébergement
2 800 milliards de paramètres exigent plus de 1,5 To de VRAM avant tout cache KV — impossible à loger sur un nœud de 8 B200 ; il faut 8 MI355X ou B300 (288 Go chacune), ou 16 B200 sur deux nœuds
Aucune infrastructure : ni achat de GPU, ni pile de service, ni débogage de noyaux
Vérification indépendante des benchmarks
Livre ses résultats d'évaluation en YAML dans le dépôt (GPQA-Diamond 93,5, HLE 56, DeepSWE 67,5, APEX-Agents 41) — chiffres de l'éditeur, mais reproductibles grâce aux poids publics
Tableaux établis par l'éditeur, sans poids permettant de les recalculer
Gouvernance des données en Europe
API hébergée en Chine, ou auto-hébergement dans votre propre région si vous en financez le matériel
Régions européennes via Bedrock et Vertex, plus une API de conformité — le chemin le plus court vers un DPA signé
Fenêtre de contexte
1 048 576 tokens (OpenRouter, vérifié le 03/08/2026)
1 000 000 tokens (OpenRouter, vérifié le 03/08/2026)
Multimodalité native
Vision intégrée dès la conception, non rapportée — le dépôt fournit un processeur visuel et enregistre le modèle comme image-text-to-text
Les entrées multimodales sont prises en charge sur la plateforme Claude
Score Total3/ 92/ 94 égalités
Poids ouverts et auto-hébergement
Kimi K3
Livré : moonshotai/Kimi-K3 publié le 27/07/2026 à 16h29 UTC — 96 fragments safetensors, 837 000 téléchargements et 9 600 mentions J'aime en six jours
Claude Opus 5
Fermé et volontairement limité à l'API ; aucun poids proposé, à aucun niveau
Conditions de licence commerciale
Kimi K3
Kimi K3 Licence, pas MIT : usage interne sans restriction, mais une activité de Model-as-a-Service dépassant 20 M USD de chiffre d'affaires sur douze mois doit conclure un accord distinct avec Moonshot
Claude Opus 5
Conditions d'API commerciales usuelles : aucun seuil de chiffre d'affaires, aucune obligation de mention, aucun accord à négocier
Respect de la date de publication
Kimi K3
Date tenue — les poids sont parus le 27 juillet 2026, le jour annoncé
Claude Opus 5
Ne publie aucun poids par principe : il n'existe donc aucun engagement à tenir ou à manquer
Prix par million de tokens
Kimi K3
3 USD en entrée / 15 USD en sortie (OpenRouter, 03/08/2026) — environ 40 % sous le palier Opus
Claude Opus 5
5 USD en entrée / 25 USD en sortie (OpenRouter, 03/08/2026), inchangé depuis Opus 4.8
Coût réel de l'auto-hébergement
Kimi K3
2 800 milliards de paramètres exigent plus de 1,5 To de VRAM avant tout cache KV — impossible à loger sur un nœud de 8 B200 ; il faut 8 MI355X ou B300 (288 Go chacune), ou 16 B200 sur deux nœuds
Claude Opus 5
Aucune infrastructure : ni achat de GPU, ni pile de service, ni débogage de noyaux
Vérification indépendante des benchmarks
Kimi K3
Livre ses résultats d'évaluation en YAML dans le dépôt (GPQA-Diamond 93,5, HLE 56, DeepSWE 67,5, APEX-Agents 41) — chiffres de l'éditeur, mais reproductibles grâce aux poids publics
Claude Opus 5
Tableaux établis par l'éditeur, sans poids permettant de les recalculer
Gouvernance des données en Europe
Kimi K3
API hébergée en Chine, ou auto-hébergement dans votre propre région si vous en financez le matériel
Claude Opus 5
Régions européennes via Bedrock et Vertex, plus une API de conformité — le chemin le plus court vers un DPA signé
Fenêtre de contexte
Kimi K3
1 048 576 tokens (OpenRouter, vérifié le 03/08/2026)
Claude Opus 5
1 000 000 tokens (OpenRouter, vérifié le 03/08/2026)
Multimodalité native
Kimi K3
Vision intégrée dès la conception, non rapportée — le dépôt fournit un processeur visuel et enregistre le modèle comme image-text-to-text
Claude Opus 5
Les entrées multimodales sont prises en charge sur la plateforme Claude

Statistiques Clés

Données réelles provenant de sources vérifiées du secteur pour appuyer votre décision.

Les poids de Kimi K3 ont été publiés sur Hugging Face le 27 juillet 2026 à 16h29 UTC — 96 fragments safetensors répartis sur 118 fichiers, totalisant 837 202 téléchargements et 9 666 mentions J'aime en six jours

API Hugging Face (revérifiée le 3 août 2026)

La Kimi K3 Licence n'est pas une licence MIT : une activité de Model-as-a-Service dont le chiffre d'affaires cumulé dépasse 20 M USD sur douze mois consécutifs doit signer un accord distinct avec Moonshot avant tout usage commercial, et tout produit dépassant 100 millions d'utilisateurs actifs mensuels ou 20 M USD de revenu mensuel doit afficher "Kimi K3" de manière visible dans son interface. L'usage strictement interne est exempté des deux.

Kimi K3 Licence (source primaire, dans le dépôt)

Moonshot publie les résultats d'évaluation de K3 en YAML lisible par machine dans le dépôt du modèle : GPQA-Diamond 93,5, Humanity's Last Exam 56, DeepSWE 67,5 et APEX-Agents 41 — des chiffres de l'éditeur, mais adossés à des poids téléchargeables

Fiche de modèle Kimi K3 et .eval_results du dépôt

Kimi K3 est facturé 3 USD par million de tokens en entrée et 15 USD en sortie, avec 1 048 576 tokens de contexte, contre 5 / 25 USD et 1 000 000 tokens pour Claude Opus 5

API OpenRouter models (vérifiée le 3 août 2026)

Les 2 800 milliards de paramètres de K3 réclament plus de 1,5 To de VRAM avant même d'allouer un cache KV : le modèle ne tient donc pas sur un nœud de huit B200. Sur 8 AMD MI355X, il atteint 952 tokens/seconde par nœud et 48 tokens/seconde par dollar d'heure-GPU, contre 33 sur une B300 environ 2,4 fois plus chère par GPU

Wafer, Ian Ye (31 juillet 2026)

K3 active 16 experts sur 896 par token à travers 2 800 milliards de paramètres, grâce à Kimi Delta Attention et Attention Residuals ; Moonshot y voit une efficacité de mise à l'échelle environ 2,5 fois supérieure à celle de K2. Le modèle est présenté comme le premier modèle ouvert de la classe des 3 000 milliards et intègre la vision nativement

Fiche de modèle Kimi K3

Toutes les statistiques proviennent de sources tierces vérifiées. La source, l'année et le lien direct sont affichés pour chaque chiffre.

Quand Choisir Chaque Option

Un guide clair basé sur votre situation spécifique et vos besoins.

Choisissez Kimi K3 quand...

  • Vous voulez des poids que vous pouvez réellement télécharger, inspecter et figer — ils existent, et plus de 800 000 téléchargements attestent d'une chaîne d'approvisionnement réelle
  • Votre usage est interne, ce qui vous place hors des deux seuils de licence
  • Le coût d'API est la contrainte déterminante et 40 % d'écart par token suffisent à trancher
  • Vous exploitez déjà des accélérateurs de la classe 288 Go, ou votre hébergeur le fait : un déploiement de 1,5 To devient une question d'approvisionnement, pas un fantasme

Choisissez Claude Opus 5 quand...

  • Vous voulez que le modèle fonctionne sans posséder, louer ni déboguer une pile de service
  • Vous relevez de règles européennes ou de groupe en matière de données et préférez des régions UE avec API de conformité à un point d'accès hébergé en Chine
  • Vous êtes un fournisseur de Model-as-a-Service proche de la barre des 20 M USD et ne voulez pas d'une négociation de licence sur le chemin critique
  • Vous voulez des annonces de benchmarks émanant d'un éditeur avec support contractuel, et vous n'êtes pas en mesure de relancer les évaluations vous-même

Notre Recommandation

La prémisse sur laquelle cette page reposait a disparu, et il vaut la peine de dire précisément pourquoi. Les poids de Kimi K3 étaient annoncés pour le 27 juillet 2026 et ont été livrés le 27 juillet 2026, à 16h29 UTC. Notre vérification a été lancée le même matin à 3h50 UTC et n'a rien trouvé : exact à cet instant, trompeur dès l'après-midi. Retenez-en la leçon : une affirmation sur l'existence ou non d'une chose a une demi-vie de quelques heures, et elle ne vieillit pas jusqu'à tomber dans un filtre d'obsolescence — elle devient simplement fausse, sans bruit. Cette correction faite, la comparaison est plus favorable à Kimi K3 qu'auparavant, mais sur un autre terrain. Les poids sont réels, largement adoptés et déjà requantifiés par Red Hat et Unsloth. L'avantage de prix tient : 3 / 15 USD contre 5 / 25 USD. La fenêtre de contexte est une véritable égalité, à environ un million de tokens de part et d'autre. Et K3 fait une chose qu'Opus ne fait pas : il publie ses résultats d'évaluation en YAML lisible par machine, à côté de poids téléchargeables, ce qui rend les annonces de l'éditeur réfutables. Personne n'a encore publié ce recalcul : nous notons donc une égalité, pas une victoire. Ce que les poids ouverts ne font pas, c'est rendre l'auto-hébergement banal. À 2 800 milliards de paramètres, K3 exige plus de 1,5 To de VRAM avant tout cache KV et ne tient pas sur un nœud de huit B200. La réponse pratique tient en huit cartes de 288 Go — et le chiffre le plus intéressant de ce travail est que la carte la moins chère l'emporte : 8 AMD MI355X délivrent 48 tokens par seconde et par dollar d'heure-GPU, contre 33 sur une B300 environ 2,4 fois plus coûteuse par GPU. Si vous chiffriez jusqu'ici l'auto-hébergement aux tarifs NVIDIA, votre modèle de coûts comporte une vraie lacune. En résumé : Kimi K3 si votre usage est interne, si le coût par token est contraignant et si du matériel de classe 288 Go est disponible ou louable. Claude Opus 5 s'il vous faut une gouvernance des données en Europe avec API de conformité, si vous préférez ne pas exploiter votre propre pile de service, ou si vous êtes un fournisseur de Model-as-a-Service approchant les 20 M USD de chiffre d'affaires — car à cette limite, la Kimi K3 Licence cesse d'être permissive et devient une négociation. Les poids ouverts ne clôturent pas la décision. Ils la déplacent de la disponibilité vers l'économie et le droit, là où elle aurait dû se situer dès le départ.

Questions Fréquentes

Réponses aux questions courantes sur cette comparaison.

Oui. moonshotai/Kimi-K3 est en ligne sur Hugging Face depuis le 27 juillet 2026 à 16h29 UTC, à la date annoncée par Moonshot. Cette page indiquait auparavant que l'échéance était passée sans publication : ce constat provenait d'une vérification automatisée lancée le même matin à 3h50 UTC, soit environ treize heures avant la mise en ligne. Il était exact au moment de la mesure et faux dès l'après-midi. Les poids ont depuis dépassé les 800 000 téléchargements, et Red Hat, Unsloth et d'autres ont publié des versions quantifiées.
Seulement avec du matériel de tout premier plan. À 2 800 milliards de paramètres, les poids seuls dépassent 1,5 To de VRAM avant même d'allouer un cache KV pour un million de tokens de contexte : le modèle ne tient donc pas sur un nœud standard de huit B200. Les configurations praticables sont huit cartes de 288 Go — AMD MI355X ou NVIDIA B300 — ou seize B200 réparties sur deux nœuds, avec la pénalité d'all-reduce inter-nœuds que cela implique. Si cette phrase ne décrit pas du matériel dont vous disposez déjà, les poids ouverts sont un argument de négociation face à un hébergeur, pas un plan d'exploitation.
Pour un usage interne, oui, sans condition. Au-delà, deux seuils comptent. Si vous exploitez une activité de Model-as-a-Service — c'est-à-dire si vous donnez à des tiers un contrôle significatif sur les entrées, les paramètres ou les données d'entraînement — et que votre chiffre d'affaires cumulé franchit 20 M USD sur douze mois consécutifs, vous devez signer un accord distinct avec Moonshot avant tout usage commercial. Indépendamment, tout produit dépassant 100 millions d'utilisateurs actifs mensuels ou 20 M USD de revenu mensuel doit afficher "Kimi K3" de façon visible dans son interface. Notez qu'il s'agit de deux déclencheurs distincts, et non d'un seul : le seuil de revenus régit l'accord, le seuil d'utilisateurs régit la mention.
Sur le tarif public, environ 40 % : 3 / 15 USD par million de tokens contre 5 / 25 USD, les deux vérifiés sur OpenRouter le 3 août 2026. Cet écart est réel pour un usage par API. Ce n'est pas le bon chiffre pour arbitrer un auto-hébergement, où la comparaison porte sur un déploiement GPU à six chiffres et sur le temps d'ingénierie nécessaire pour le maintenir en service.
Pas à notre connaissance. Les chiffres GPQA, HLE, DeepSWE et APEX-Agents proviennent de Moonshot et sont publiés en YAML dans le dépôt. Ce qui change, c'est qu'ils sont désormais réfutables : avec des poids publics, un tiers peut les recalculer. C'est nettement plus solide qu'un tableau d'éditeur invérifiable, mais ce n'est pas un résultat indépendant, et nous ne considérerons ces chiffres comme confirmés que lorsque quelqu'un en publiera un.

Besoin d'aide pour décider ?

Réservez une consultation gratuite de 30 minutes et nous vous aiderons à déterminer la meilleure approche pour votre projet spécifique.

Consultation gratuite
Sans engagement
Réponse sous 24h