Qwen3.8-Max vs Kimi K3 (2026) : 2,78 billions livrés contre 2,4 billions annoncés
Qwen3.8-Max vs Kimi K3 (2026) : Qwen est en disponibilité générale et moins cher, mais seul K3 peut être téléchargé et hébergé par vos soins.
Qwen3.8-Max est désormais le modèle le moins cher et Kimi K3 reste le seul déployable ; lequel des deux compte le plus dépend entièrement de votre intention de l'héberger un jour vous-même. L'argument tarifaire en faveur de Qwen est réel et n'a plus rien de spéculatif. Depuis sa disponibilité générale le 3 août 2026, il s'échange sur le marché ouvert à 2,00 dollars par million de tokens en entrée et 6,00 dollars par million en sortie, contre 3,00 et 15,00 dollars pour Kimi K3 — soit 33 pour cent de moins en entrée et 60 pour cent en sortie, avec l'entrée mise en cache à 0,25 dollar par million. Il accepte en outre la vidéo en entrée, ce que K3 ne fait pas, et offre une fenêtre de contexte d'un million de tokens. Si vous achetez de l'inférence via une API sans intention d'en sortir, Qwen3.8-Max est aujourd'hui la meilleure affaire commerciale. L'argument de déploiement en faveur de Kimi K3 s'est durci sans que personne y prête attention. Les poids de Moonshot sont en ligne depuis le 27 juillet 2026 à 16h29 UTC et ont depuis été téléchargés plus de 960 000 fois ; le dépôt indique 2 779 931 837 184 paramètres, non pas un chiffre marketing arrondi mais une somme de tenseurs que chacun peut recalculer. Dix fournisseurs indépendants le servent — Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes, Morph, Wafer et Moonshot lui-même — et c'est précisément pour cela que son prix est contestable. Qwen3.8-Max n'est servi que par une seule entreprise : Alibaba. Un modèle à fournisseur unique a un prix catalogue, pas un prix de marché. La réserve honnête, des deux côtés : les chiffres phares d'Alibaba — 2,4 billions au total, 95 milliards actifs, cinquième en Text Arena — proviennent du constructeur et ont été annoncés en même temps qu'une publication de poids qui n'a pas eu lieu. Au 4 août 2026, il n'existe aucun dépôt Qwen3.8-Max sur Hugging Face ni sur ModelScope, la plateforme d'Alibaba. La licence de Kimi K3 n'est pas davantage une licence OSI ; Hugging Face l'enregistre comme « other ». Aucun des deux modèles n'est ouvert au sens où l'entend une équipe conformité. Notre recommandation : si la charge de travail vit derrière une API et que le coût par token est la contrainte, prenez Qwen3.8-Max. Si vous devez héberger vous-même, négocier avec plus d'un fournisseur ou défendre un chiffre devant quelqu'un qui le vérifiera, prenez Kimi K3 — et revérifiez l'affirmation sur les poids de Qwen avant de vous engager, car ce type d'affirmation s'inverse sans prévenir.
Comparaison Détaillée
Une analyse comparative des facteurs clés pour vous aider à faire le bon choix.
| Facteur | Qwen3.8-MaxRecommandé | Kimi K3 | Gagnant |
|---|---|---|---|
| Des poids réellement téléchargeables | Aucun au 4 août 2026 — pas de dépôt Hugging Face ni d'entrée sur ModelScope, la plateforme d'Alibaba ; publication annoncée pour « la semaine prochaine » | En ligne depuis le 27 juillet 2026 à 16h29 UTC sur Hugging Face ; plus de 960 000 téléchargements et 9 800 mentions J'aime la première semaine | |
| Vérifiabilité du nombre de paramètres | 2,4 billions au total / 95 milliards actifs — chiffre constructeur issu de l'annonce, non recalculable de façon indépendante | 2 779 931 837 184 paramètres, sommés depuis l'index de tenseurs publié — recalculable par quiconque dispose du dépôt | |
| Prix de marché par million de tokens | 2,00 dollars en entrée / 6,00 dollars en sortie, entrée en cache 0,25 dollar — moins cher sur les deux axes | 3,00 dollars en entrée / 15,00 dollars en sortie, entrée en cache 0,30 dollar | |
| Nombre de fournisseurs auprès desquels acheter | Un seul — Alibaba. Un modèle à fournisseur unique a un prix catalogue, pas un prix de marché | Dix fournisseurs indépendants, dont Together, Fireworks, BaseTen, Modal, DigitalOcean et Wafer, ce qui rend le prix contestable | |
| Modalités d'entrée | Texte, images et vidéo dans un seul modèle — l'entrée vidéo est la capacité la plus nette qui manque à Kimi K3 | Texte et images ; solide en code et en travail agentique de longue haleine, sans entrée vidéo | |
| Fenêtre de contexte et plafond de sortie | 1 000 000 tokens de contexte, plafonné à 131 072 tokens de complétion par requête | 1 048 576 tokens de contexte, sans plafond de complétion publié par requête | |
| Licence qui vous engagerait réellement | Non publiée — sans publication des poids, il n'y a aucune licence à lire | Publiée mais non approuvée par l'OSI ; Hugging Face enregistre la licence comme « other », avec des seuils commerciaux dans le texte | |
| Vitesse de péremption des affirmations clés | De forme annonce : une publication de poids non livrée et des classements d'arène constructeur, tous deux modifiables en quelques jours | De forme artefact : un dépôt daté, un compteur de téléchargements et un index de tenseurs qui ne bougent pas rétroactivement | |
| Score Total | 2/ 8 | 6/ 8 | 0 égalités |
Statistiques Clés
Données réelles provenant de sources vérifiées du secteur pour appuyer votre décision.
Hugging Face Model API — moonshotai/Kimi-K3
Hugging Face Model API — moonshotai/Kimi-K3
OpenRouter Models API
OpenRouter Endpoints API
ModelScope Model API (HTTP 404) et recherche de modèles Hugging Face
Alibaba Cloud Press Room
Toutes les statistiques proviennent de sources tierces vérifiées. La source, l'année et le lien direct sont affichés pour chaque chiffre.
Quand Choisir Chaque Option
Un guide clair basé sur votre situation spécifique et vos besoins.
Choisissez Qwen3.8-Max quand...
- Votre charge de travail reste derrière une API dans un avenir prévisible et le coût par token est la contrainte déterminante — Qwen est 33 pour cent moins cher en entrée et 60 pour cent en sortie.
- Vous avez besoin de la vidéo comme modalité d'entrée, que Kimi K3 n'accepte pas du tout.
- Vous développez pour le marché chinois ou travaillez déjà dans Alibaba Cloud, Qoder ou QoderWork.
- Vous menez un travail exploratoire où les classements annoncés par le constructeur suffisent et où personne en aval ne vous demandera de les sourcer.
Choisissez Kimi K3 quand...
- Vous comptez héberger vous-même : les poids de K3 sont les seuls des deux à exister aujourd'hui comme artefact téléchargeable.
- Vous voulez plus d'un fournisseur pour négocier — dix servent K3, un seul sert Qwen3.8-Max.
- Vous devez défendre chaque chiffre devant les achats ou la conformité et avez besoin d'un nombre de paramètres recalculable plutôt que cité.
- Votre horizon d'évaluation dépasse un cycle d'actualité et vous préférez bâtir sur un artefact daté que sur une date de publication annoncée.
Notre Recommandation
Qwen3.8-Max est désormais le modèle le moins cher et Kimi K3 reste le seul déployable ; lequel des deux compte le plus dépend entièrement de votre intention de l'héberger un jour vous-même. L'argument tarifaire en faveur de Qwen est réel et n'a plus rien de spéculatif. Depuis sa disponibilité générale le 3 août 2026, il s'échange sur le marché ouvert à 2,00 dollars par million de tokens en entrée et 6,00 dollars par million en sortie, contre 3,00 et 15,00 dollars pour Kimi K3 — soit 33 pour cent de moins en entrée et 60 pour cent en sortie, avec l'entrée mise en cache à 0,25 dollar par million. Il accepte en outre la vidéo en entrée, ce que K3 ne fait pas, et offre une fenêtre de contexte d'un million de tokens. Si vous achetez de l'inférence via une API sans intention d'en sortir, Qwen3.8-Max est aujourd'hui la meilleure affaire commerciale. L'argument de déploiement en faveur de Kimi K3 s'est durci sans que personne y prête attention. Les poids de Moonshot sont en ligne depuis le 27 juillet 2026 à 16h29 UTC et ont depuis été téléchargés plus de 960 000 fois ; le dépôt indique 2 779 931 837 184 paramètres, non pas un chiffre marketing arrondi mais une somme de tenseurs que chacun peut recalculer. Dix fournisseurs indépendants le servent — Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes, Morph, Wafer et Moonshot lui-même — et c'est précisément pour cela que son prix est contestable. Qwen3.8-Max n'est servi que par une seule entreprise : Alibaba. Un modèle à fournisseur unique a un prix catalogue, pas un prix de marché. La réserve honnête, des deux côtés : les chiffres phares d'Alibaba — 2,4 billions au total, 95 milliards actifs, cinquième en Text Arena — proviennent du constructeur et ont été annoncés en même temps qu'une publication de poids qui n'a pas eu lieu. Au 4 août 2026, il n'existe aucun dépôt Qwen3.8-Max sur Hugging Face ni sur ModelScope, la plateforme d'Alibaba. La licence de Kimi K3 n'est pas davantage une licence OSI ; Hugging Face l'enregistre comme « other ». Aucun des deux modèles n'est ouvert au sens où l'entend une équipe conformité. Notre recommandation : si la charge de travail vit derrière une API et que le coût par token est la contrainte, prenez Qwen3.8-Max. Si vous devez héberger vous-même, négocier avec plus d'un fournisseur ou défendre un chiffre devant quelqu'un qui le vérifiera, prenez Kimi K3 — et revérifiez l'affirmation sur les poids de Qwen avant de vous engager, car ce type d'affirmation s'inverse sans prévenir.
Questions Fréquentes
Réponses aux questions courantes sur cette comparaison.
Besoin d'aide pour décider ?
Réservez une consultation gratuite de 30 minutes et nous vous aiderons à déterminer la meilleure approche pour votre projet spécifique.