Comparaison Fournisseurs

Qwen3.8-Max vs Kimi K3 (2026) : 2,78 billions livrés contre 2,4 billions annoncés

Qwen3.8-Max vs Kimi K3 (2026) : Qwen est en disponibilité générale et moins cher, mais seul K3 peut être téléchargé et hébergé par vos soins.

2
Qwen3.8-Max
vs
6
Kimi K3
Verdict Rapide

Qwen3.8-Max est désormais le modèle le moins cher et Kimi K3 reste le seul déployable ; lequel des deux compte le plus dépend entièrement de votre intention de l'héberger un jour vous-même. L'argument tarifaire en faveur de Qwen est réel et n'a plus rien de spéculatif. Depuis sa disponibilité générale le 3 août 2026, il s'échange sur le marché ouvert à 2,00 dollars par million de tokens en entrée et 6,00 dollars par million en sortie, contre 3,00 et 15,00 dollars pour Kimi K3 — soit 33 pour cent de moins en entrée et 60 pour cent en sortie, avec l'entrée mise en cache à 0,25 dollar par million. Il accepte en outre la vidéo en entrée, ce que K3 ne fait pas, et offre une fenêtre de contexte d'un million de tokens. Si vous achetez de l'inférence via une API sans intention d'en sortir, Qwen3.8-Max est aujourd'hui la meilleure affaire commerciale. L'argument de déploiement en faveur de Kimi K3 s'est durci sans que personne y prête attention. Les poids de Moonshot sont en ligne depuis le 27 juillet 2026 à 16h29 UTC et ont depuis été téléchargés plus de 960 000 fois ; le dépôt indique 2 779 931 837 184 paramètres, non pas un chiffre marketing arrondi mais une somme de tenseurs que chacun peut recalculer. Dix fournisseurs indépendants le servent — Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes, Morph, Wafer et Moonshot lui-même — et c'est précisément pour cela que son prix est contestable. Qwen3.8-Max n'est servi que par une seule entreprise : Alibaba. Un modèle à fournisseur unique a un prix catalogue, pas un prix de marché. La réserve honnête, des deux côtés : les chiffres phares d'Alibaba — 2,4 billions au total, 95 milliards actifs, cinquième en Text Arena — proviennent du constructeur et ont été annoncés en même temps qu'une publication de poids qui n'a pas eu lieu. Au 4 août 2026, il n'existe aucun dépôt Qwen3.8-Max sur Hugging Face ni sur ModelScope, la plateforme d'Alibaba. La licence de Kimi K3 n'est pas davantage une licence OSI ; Hugging Face l'enregistre comme « other ». Aucun des deux modèles n'est ouvert au sens où l'entend une équipe conformité. Notre recommandation : si la charge de travail vit derrière une API et que le coût par token est la contrainte, prenez Qwen3.8-Max. Si vous devez héberger vous-même, négocier avec plus d'un fournisseur ou défendre un chiffre devant quelqu'un qui le vérifiera, prenez Kimi K3 — et revérifiez l'affirmation sur les poids de Qwen avant de vous engager, car ce type d'affirmation s'inverse sans prévenir.

Comparaison Détaillée

Une analyse comparative des facteurs clés pour vous aider à faire le bon choix.

Facteur
Qwen3.8-MaxRecommandé
Kimi K3Gagnant
Des poids réellement téléchargeables
Aucun au 4 août 2026 — pas de dépôt Hugging Face ni d'entrée sur ModelScope, la plateforme d'Alibaba ; publication annoncée pour « la semaine prochaine »
En ligne depuis le 27 juillet 2026 à 16h29 UTC sur Hugging Face ; plus de 960 000 téléchargements et 9 800 mentions J'aime la première semaine
Vérifiabilité du nombre de paramètres
2,4 billions au total / 95 milliards actifs — chiffre constructeur issu de l'annonce, non recalculable de façon indépendante
2 779 931 837 184 paramètres, sommés depuis l'index de tenseurs publié — recalculable par quiconque dispose du dépôt
Prix de marché par million de tokens
2,00 dollars en entrée / 6,00 dollars en sortie, entrée en cache 0,25 dollar — moins cher sur les deux axes
3,00 dollars en entrée / 15,00 dollars en sortie, entrée en cache 0,30 dollar
Nombre de fournisseurs auprès desquels acheter
Un seul — Alibaba. Un modèle à fournisseur unique a un prix catalogue, pas un prix de marché
Dix fournisseurs indépendants, dont Together, Fireworks, BaseTen, Modal, DigitalOcean et Wafer, ce qui rend le prix contestable
Modalités d'entrée
Texte, images et vidéo dans un seul modèle — l'entrée vidéo est la capacité la plus nette qui manque à Kimi K3
Texte et images ; solide en code et en travail agentique de longue haleine, sans entrée vidéo
Fenêtre de contexte et plafond de sortie
1 000 000 tokens de contexte, plafonné à 131 072 tokens de complétion par requête
1 048 576 tokens de contexte, sans plafond de complétion publié par requête
Licence qui vous engagerait réellement
Non publiée — sans publication des poids, il n'y a aucune licence à lire
Publiée mais non approuvée par l'OSI ; Hugging Face enregistre la licence comme « other », avec des seuils commerciaux dans le texte
Vitesse de péremption des affirmations clés
De forme annonce : une publication de poids non livrée et des classements d'arène constructeur, tous deux modifiables en quelques jours
De forme artefact : un dépôt daté, un compteur de téléchargements et un index de tenseurs qui ne bougent pas rétroactivement
Score Total2/ 86/ 80 égalités
Des poids réellement téléchargeables
Qwen3.8-Max
Aucun au 4 août 2026 — pas de dépôt Hugging Face ni d'entrée sur ModelScope, la plateforme d'Alibaba ; publication annoncée pour « la semaine prochaine »
Kimi K3
En ligne depuis le 27 juillet 2026 à 16h29 UTC sur Hugging Face ; plus de 960 000 téléchargements et 9 800 mentions J'aime la première semaine
Vérifiabilité du nombre de paramètres
Qwen3.8-Max
2,4 billions au total / 95 milliards actifs — chiffre constructeur issu de l'annonce, non recalculable de façon indépendante
Kimi K3
2 779 931 837 184 paramètres, sommés depuis l'index de tenseurs publié — recalculable par quiconque dispose du dépôt
Prix de marché par million de tokens
Qwen3.8-Max
2,00 dollars en entrée / 6,00 dollars en sortie, entrée en cache 0,25 dollar — moins cher sur les deux axes
Kimi K3
3,00 dollars en entrée / 15,00 dollars en sortie, entrée en cache 0,30 dollar
Nombre de fournisseurs auprès desquels acheter
Qwen3.8-Max
Un seul — Alibaba. Un modèle à fournisseur unique a un prix catalogue, pas un prix de marché
Kimi K3
Dix fournisseurs indépendants, dont Together, Fireworks, BaseTen, Modal, DigitalOcean et Wafer, ce qui rend le prix contestable
Modalités d'entrée
Qwen3.8-Max
Texte, images et vidéo dans un seul modèle — l'entrée vidéo est la capacité la plus nette qui manque à Kimi K3
Kimi K3
Texte et images ; solide en code et en travail agentique de longue haleine, sans entrée vidéo
Fenêtre de contexte et plafond de sortie
Qwen3.8-Max
1 000 000 tokens de contexte, plafonné à 131 072 tokens de complétion par requête
Kimi K3
1 048 576 tokens de contexte, sans plafond de complétion publié par requête
Licence qui vous engagerait réellement
Qwen3.8-Max
Non publiée — sans publication des poids, il n'y a aucune licence à lire
Kimi K3
Publiée mais non approuvée par l'OSI ; Hugging Face enregistre la licence comme « other », avec des seuils commerciaux dans le texte
Vitesse de péremption des affirmations clés
Qwen3.8-Max
De forme annonce : une publication de poids non livrée et des classements d'arène constructeur, tous deux modifiables en quelques jours
Kimi K3
De forme artefact : un dépôt daté, un compteur de téléchargements et un index de tenseurs qui ne bougent pas rétroactivement

Statistiques Clés

Données réelles provenant de sources vérifiées du secteur pour appuyer votre décision.

Les poids de Kimi K3 ont été publiés sur Hugging Face le 27 juillet 2026 à 16h29 UTC et dépassaient 967 000 téléchargements et 9 800 mentions J'aime au 4 août 2026.

Hugging Face Model API — moonshotai/Kimi-K3

Le dépôt Kimi K3 indique 2 779 931 837 184 paramètres dans son index safetensors — une somme de tenseurs, non un chiffre constructeur arrondi.

Hugging Face Model API — moonshotai/Kimi-K3

Qwen3.8-Max est passé en disponibilité générale le 3 août 2026 à 2,00 dollars par million de tokens en entrée et 6,00 dollars par million en sortie, contre 3,00 et 15,00 dollars pour Kimi K3 — 33 pour cent moins cher en entrée et 60 pour cent en sortie.

OpenRouter Models API

Kimi K3 est servi sur le marché ouvert par dix fournisseurs indépendants — dont Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes et Wafer — tandis que Qwen3.8-Max n'est servi que par un seul : Alibaba.

OpenRouter Endpoints API

Au 4 août 2026, il n'existe aucun dépôt de poids Qwen3.8-Max sur Hugging Face, et ModelScope, la plateforme d'Alibaba, renvoie « record not found » pour ce modèle.

ModelScope Model API (HTTP 404) et recherche de modèles Hugging Face

Alibaba a annoncé Qwen3.8-Max le 3 août 2026 avec 2,4 billions de paramètres au total, 95 milliards actifs, une fenêtre de contexte d'un million de tokens et la cinquième place en Text Arena — autant de chiffres constructeur, accompagnés d'une publication de poids non livrée le lendemain.

Alibaba Cloud Press Room

Toutes les statistiques proviennent de sources tierces vérifiées. La source, l'année et le lien direct sont affichés pour chaque chiffre.

Quand Choisir Chaque Option

Un guide clair basé sur votre situation spécifique et vos besoins.

Choisissez Qwen3.8-Max quand...

  • Votre charge de travail reste derrière une API dans un avenir prévisible et le coût par token est la contrainte déterminante — Qwen est 33 pour cent moins cher en entrée et 60 pour cent en sortie.
  • Vous avez besoin de la vidéo comme modalité d'entrée, que Kimi K3 n'accepte pas du tout.
  • Vous développez pour le marché chinois ou travaillez déjà dans Alibaba Cloud, Qoder ou QoderWork.
  • Vous menez un travail exploratoire où les classements annoncés par le constructeur suffisent et où personne en aval ne vous demandera de les sourcer.

Choisissez Kimi K3 quand...

  • Vous comptez héberger vous-même : les poids de K3 sont les seuls des deux à exister aujourd'hui comme artefact téléchargeable.
  • Vous voulez plus d'un fournisseur pour négocier — dix servent K3, un seul sert Qwen3.8-Max.
  • Vous devez défendre chaque chiffre devant les achats ou la conformité et avez besoin d'un nombre de paramètres recalculable plutôt que cité.
  • Votre horizon d'évaluation dépasse un cycle d'actualité et vous préférez bâtir sur un artefact daté que sur une date de publication annoncée.

Notre Recommandation

Qwen3.8-Max est désormais le modèle le moins cher et Kimi K3 reste le seul déployable ; lequel des deux compte le plus dépend entièrement de votre intention de l'héberger un jour vous-même. L'argument tarifaire en faveur de Qwen est réel et n'a plus rien de spéculatif. Depuis sa disponibilité générale le 3 août 2026, il s'échange sur le marché ouvert à 2,00 dollars par million de tokens en entrée et 6,00 dollars par million en sortie, contre 3,00 et 15,00 dollars pour Kimi K3 — soit 33 pour cent de moins en entrée et 60 pour cent en sortie, avec l'entrée mise en cache à 0,25 dollar par million. Il accepte en outre la vidéo en entrée, ce que K3 ne fait pas, et offre une fenêtre de contexte d'un million de tokens. Si vous achetez de l'inférence via une API sans intention d'en sortir, Qwen3.8-Max est aujourd'hui la meilleure affaire commerciale. L'argument de déploiement en faveur de Kimi K3 s'est durci sans que personne y prête attention. Les poids de Moonshot sont en ligne depuis le 27 juillet 2026 à 16h29 UTC et ont depuis été téléchargés plus de 960 000 fois ; le dépôt indique 2 779 931 837 184 paramètres, non pas un chiffre marketing arrondi mais une somme de tenseurs que chacun peut recalculer. Dix fournisseurs indépendants le servent — Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes, Morph, Wafer et Moonshot lui-même — et c'est précisément pour cela que son prix est contestable. Qwen3.8-Max n'est servi que par une seule entreprise : Alibaba. Un modèle à fournisseur unique a un prix catalogue, pas un prix de marché. La réserve honnête, des deux côtés : les chiffres phares d'Alibaba — 2,4 billions au total, 95 milliards actifs, cinquième en Text Arena — proviennent du constructeur et ont été annoncés en même temps qu'une publication de poids qui n'a pas eu lieu. Au 4 août 2026, il n'existe aucun dépôt Qwen3.8-Max sur Hugging Face ni sur ModelScope, la plateforme d'Alibaba. La licence de Kimi K3 n'est pas davantage une licence OSI ; Hugging Face l'enregistre comme « other ». Aucun des deux modèles n'est ouvert au sens où l'entend une équipe conformité. Notre recommandation : si la charge de travail vit derrière une API et que le coût par token est la contrainte, prenez Qwen3.8-Max. Si vous devez héberger vous-même, négocier avec plus d'un fournisseur ou défendre un chiffre devant quelqu'un qui le vérifiera, prenez Kimi K3 — et revérifiez l'affirmation sur les poids de Qwen avant de vous engager, car ce type d'affirmation s'inverse sans prévenir.

Questions Fréquentes

Réponses aux questions courantes sur cette comparaison.

Qwen3.8-Max, nettement. Depuis sa disponibilité générale le 3 août 2026, il s'échange à 2,00 dollars par million de tokens en entrée et 6,00 dollars par million en sortie, contre 3,00 et 15,00 dollars pour Kimi K3. L'entrée mise en cache est à 0,25 dollar par million contre 0,30. Si votre charge de travail reste derrière l'API d'un tiers, cela représente 33 pour cent d'économie en entrée et 60 pour cent en sortie.
Uniquement Kimi K3. Ses poids sont en ligne sur Hugging Face depuis le 27 juillet 2026 et ont été téléchargés plus de 960 000 fois. Les poids de Qwen3.8-Max ont été annoncés, mais au 4 août 2026 il n'existe aucun dépôt sur Hugging Face ni sur ModelScope — la plateforme de modèles d'Alibaba renvoie « record not found ». Traitez les poids de Qwen comme un événement planifié, non comme un actif disponible, et revérifiez avant de bâtir dessus.
Ces classements proviennent de l'annonce d'Alibaba. Ils sont peut-être exacts, mais ils sont arrivés dans la même annonce qu'une publication de poids non livrée le lendemain : traitez-les donc comme des chiffres constructeur tant que vous ne pouvez pas pointer une entrée de classement indépendante. La nuance compte dès que vous devez défendre le chiffre dans un document d'achat.
Oui, et c'est la ligne la plus sous-estimée de cette comparaison. Kimi K3 est vendu par dix fournisseurs indépendants : son prix résulte de leur concurrence et vous pouvez déplacer la charge si l'un augmente ses tarifs ou dégrade son service. Qwen3.8-Max n'est vendu que par Alibaba. Aujourd'hui ce prix unique est le plus bas des deux — mais c'est un prix catalogue, et aucun second fournisseur ne le maintient à ce niveau.

Besoin d'aide pour décider ?

Réservez une consultation gratuite de 30 minutes et nous vous aiderons à déterminer la meilleure approche pour votre projet spécifique.

Consultation gratuite
Sans engagement
Réponse sous 24h