Anbietervergleich

Qwen3.8-Max vs. Kimi K3 (2026): Ausgelieferte 2,78 Billionen gegen angekündigte 2,4 Billionen

Qwen3.8-Max vs Kimi K3 (2026): Qwen ist allgemein verfügbar und günstiger — aber nur K3 können Sie heute herunterladen und selbst betreiben.

2
Qwen3.8-Max
vs
6
Kimi K3
Schnellurteil

Qwen3.8-Max ist jetzt das günstigere Modell, Kimi K3 weiterhin das einzige betreibbare — und was davon schwerer wiegt, hängt allein davon ab, ob Sie das Modell jemals selbst betreiben wollen. Das Preisargument für Qwen ist real und nicht mehr spekulativ. Seit der allgemeinen Verfügbarkeit am 3. August 2026 wird es am offenen Markt zu 2,00 US-Dollar je Million Eingabe-Tokens und 6,00 US-Dollar je Million Ausgabe-Tokens gehandelt, gegenüber 3,00 und 15,00 US-Dollar bei Kimi K3 — 33 Prozent günstiger bei der Eingabe, 60 Prozent bei der Ausgabe, zwischengespeicherte Eingaben zu 0,25 US-Dollar je Million. Zudem verarbeitet es Video als Eingabe, was K3 nicht kann, und bietet ein Kontextfenster von einer Million Tokens. Wenn Sie Inferenz über eine API einkaufen und dabei bleiben wollen, ist Qwen3.8-Max heute das bessere kommerzielle Angebot. Das Betriebsargument für Kimi K3 hat sich unbemerkt verhärtet. Moonshots Gewichte gingen am 27. Juli 2026 um 16:29 UTC live und wurden seither über 960.000 Mal heruntergeladen; das Repository weist 2.779.931.837.184 Parameter aus — keine gerundete Marketingzahl, sondern eine summierte Tensoranzahl, die jeder nachrechnen kann. Zehn unabhängige Anbieter liefern es aus: Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes, Morph, Wafer und Moonshot selbst. Genau deshalb ist der Preis überhaupt verhandelbar. Qwen3.8-Max liefert exakt ein Unternehmen aus: Alibaba. Ein Modell mit einem einzigen Anbieter hat einen Listenpreis, keinen Marktpreis. Der ehrliche Vorbehalt für beide Seiten: Alibabas Eckdaten — 2,4 Billionen gesamt, 95 Milliarden aktiv, Platz fünf in der Text Arena — stammen vom Hersteller und wurden zusammen mit einer Gewichte-Veröffentlichung angekündigt, die nicht stattgefunden hat. Am 4. August 2026 existiert weder auf Hugging Face noch auf ModelScope, Alibabas eigenem Hub, ein Qwen3.8-Max-Repository. Auch die Lizenz von Kimi K3 ist keine OSI-Lizenz; Hugging Face führt sie als „other". Keines der beiden Modelle ist offen in dem Sinne, den eine Compliance-Abteilung meint. Unsere Empfehlung: Lebt die Arbeitslast hinter einer API und sind die Kosten je Token die Randbedingung, nehmen Sie Qwen3.8-Max. Müssen Sie selbst hosten, gegen mehr als einen Lieferanten verhandeln oder eine Zahl gegenüber jemandem vertreten, der sie nachprüft, nehmen Sie Kimi K3 — und prüfen Sie die Qwen-Gewichte-Aussage erneut, bevor Sie sich festlegen. Solche Aussagen kehren sich ohne Vorwarnung um.

Detaillierter Vergleich

Eine Gegenüberstellung der wichtigsten Faktoren für Ihre Entscheidung.

Faktor
Qwen3.8-MaxEmpfohlen
Kimi K3Gewinner
Gewichte, die Sie tatsächlich herunterladen können
Keine, Stand 4. August 2026 — kein Hugging-Face-Repository und kein Eintrag auf Alibabas eigenem ModelScope; Veröffentlichung für „nächste Woche" angekündigt
Live seit 27. Juli 2026, 16:29 UTC auf Hugging Face; über 960.000 Downloads und mehr als 9.800 Likes in der ersten Woche
Wie die Parameterzahl überprüfbar ist
2,4 Billionen gesamt / 95 Milliarden aktiv — Herstellerangabe aus der Ankündigung, nicht unabhängig nachrechenbar
2.779.931.837.184 Parameter, summiert aus dem veröffentlichten Tensor-Index — mit dem Repository nachrechenbar
Marktpreis je Million Tokens
2,00 US-Dollar Eingabe / 6,00 US-Dollar Ausgabe, zwischengespeichert 0,25 US-Dollar — auf beiden Achsen günstiger
3,00 US-Dollar Eingabe / 15,00 US-Dollar Ausgabe, zwischengespeichert 0,30 US-Dollar
Anzahl der Lieferanten, bei denen Sie kaufen können
Einer — Alibaba. Ein Modell mit einem einzigen Anbieter hat einen Listenpreis, keinen Marktpreis
Zehn unabhängige Anbieter, darunter Together, Fireworks, BaseTen, Modal, DigitalOcean und Wafer — der Preis bleibt dadurch verhandelbar
Eingabemodalitäten
Text, Bilder und Video in einem Modell — Video-Eingabe ist die deutlichste Fähigkeit, die Kimi K3 fehlt
Text und Bilder; stark bei Code und langlaufenden agentischen Aufgaben, keine Video-Eingabe
Kontextfenster und Ausgabegrenze
1.000.000 Tokens Kontext, begrenzt auf 131.072 Tokens Ausgabe je Anfrage
1.048.576 Tokens Kontext, ohne veröffentlichte Ausgabegrenze je Anfrage
Lizenz, an die Sie tatsächlich gebunden wären
Nicht veröffentlicht — ohne Gewichte-Release gibt es keine Lizenz zum Nachlesen
Veröffentlicht, aber nicht OSI-konform; Hugging Face führt die Lizenz als „other", mit kommerziellen Schwellenwerten im Text
Wie schnell die Kernaussagen verfallen
Ankündigungsförmig: ein nicht ausgeliefertes Gewichte-Release und Hersteller-Arena-Platzierungen, beides binnen Tagen veränderlich
Artefaktförmig: ein datiertes Repository, ein Download-Zähler und ein Tensor-Index, die sich nicht rückwirkend ändern
Gesamtpunktzahl2/ 86/ 80 unentschieden
Gewichte, die Sie tatsächlich herunterladen können
Qwen3.8-Max
Keine, Stand 4. August 2026 — kein Hugging-Face-Repository und kein Eintrag auf Alibabas eigenem ModelScope; Veröffentlichung für „nächste Woche" angekündigt
Kimi K3
Live seit 27. Juli 2026, 16:29 UTC auf Hugging Face; über 960.000 Downloads und mehr als 9.800 Likes in der ersten Woche
Wie die Parameterzahl überprüfbar ist
Qwen3.8-Max
2,4 Billionen gesamt / 95 Milliarden aktiv — Herstellerangabe aus der Ankündigung, nicht unabhängig nachrechenbar
Kimi K3
2.779.931.837.184 Parameter, summiert aus dem veröffentlichten Tensor-Index — mit dem Repository nachrechenbar
Marktpreis je Million Tokens
Qwen3.8-Max
2,00 US-Dollar Eingabe / 6,00 US-Dollar Ausgabe, zwischengespeichert 0,25 US-Dollar — auf beiden Achsen günstiger
Kimi K3
3,00 US-Dollar Eingabe / 15,00 US-Dollar Ausgabe, zwischengespeichert 0,30 US-Dollar
Anzahl der Lieferanten, bei denen Sie kaufen können
Qwen3.8-Max
Einer — Alibaba. Ein Modell mit einem einzigen Anbieter hat einen Listenpreis, keinen Marktpreis
Kimi K3
Zehn unabhängige Anbieter, darunter Together, Fireworks, BaseTen, Modal, DigitalOcean und Wafer — der Preis bleibt dadurch verhandelbar
Eingabemodalitäten
Qwen3.8-Max
Text, Bilder und Video in einem Modell — Video-Eingabe ist die deutlichste Fähigkeit, die Kimi K3 fehlt
Kimi K3
Text und Bilder; stark bei Code und langlaufenden agentischen Aufgaben, keine Video-Eingabe
Kontextfenster und Ausgabegrenze
Qwen3.8-Max
1.000.000 Tokens Kontext, begrenzt auf 131.072 Tokens Ausgabe je Anfrage
Kimi K3
1.048.576 Tokens Kontext, ohne veröffentlichte Ausgabegrenze je Anfrage
Lizenz, an die Sie tatsächlich gebunden wären
Qwen3.8-Max
Nicht veröffentlicht — ohne Gewichte-Release gibt es keine Lizenz zum Nachlesen
Kimi K3
Veröffentlicht, aber nicht OSI-konform; Hugging Face führt die Lizenz als „other", mit kommerziellen Schwellenwerten im Text
Wie schnell die Kernaussagen verfallen
Qwen3.8-Max
Ankündigungsförmig: ein nicht ausgeliefertes Gewichte-Release und Hersteller-Arena-Platzierungen, beides binnen Tagen veränderlich
Kimi K3
Artefaktförmig: ein datiertes Repository, ein Download-Zähler und ein Tensor-Index, die sich nicht rückwirkend ändern

Wichtige Statistiken

Echte Daten aus verifizierten Branchenquellen zur Unterstützung Ihrer Entscheidung.

Die Gewichte von Kimi K3 wurden am 27. Juli 2026 um 16:29 UTC auf Hugging Face veröffentlicht und überschritten bis zum 4. August 2026 967.000 Downloads und 9.800 Likes.

Hugging Face Model API — moonshotai/Kimi-K3

Das Kimi-K3-Repository weist im safetensors-Index 2.779.931.837.184 Parameter aus — eine summierte Tensoranzahl, keine gerundete Herstellerangabe.

Hugging Face Model API — moonshotai/Kimi-K3

Qwen3.8-Max erreichte am 3. August 2026 die allgemeine Verfügbarkeit zu 2,00 US-Dollar je Million Eingabe-Tokens und 6,00 US-Dollar je Million Ausgabe-Tokens, gegenüber 3,00 und 15,00 US-Dollar bei Kimi K3 — 33 Prozent günstiger bei der Eingabe, 60 Prozent bei der Ausgabe.

OpenRouter Models API

Kimi K3 wird am offenen Markt von zehn unabhängigen Anbietern ausgeliefert — darunter Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes und Wafer — Qwen3.8-Max von genau einem: Alibaba.

OpenRouter Endpoints API

Stand 4. August 2026 existiert kein Qwen3.8-Max-Gewichte-Repository auf Hugging Face, und Alibabas eigener ModelScope-Hub meldet für das Modell „record not found".

ModelScope Model API (HTTP 404) und Hugging-Face-Modellsuche

Alibaba kündigte Qwen3.8-Max am 3. August 2026 mit 2,4 Billionen Gesamtparametern, 95 Milliarden aktiven Parametern, einem Kontextfenster von einer Million Tokens und Platz fünf in der Text Arena an — alles Herstellerangaben, begleitet von einem Gewichte-Release, das einen Tag später noch nicht ausgeliefert war.

Alibaba Cloud Press Room

Alle Statistiken stammen aus verifizierten Drittquellen. Quelle, Jahr und Original-Link werden direkt bei jeder Kennzahl angezeigt.

Wann Sie welche Option wählen sollten

Klare Orientierung basierend auf Ihrer spezifischen Situation und Ihren Bedürfnissen.

Wählen Sie Qwen3.8-Max, wenn...

  • Ihre Arbeitslast bleibt auf absehbare Zeit hinter einer API und die Kosten je Token sind die bindende Randbedingung — Qwen ist 33 Prozent günstiger bei der Eingabe und 60 Prozent bei der Ausgabe.
  • Sie brauchen Video als Eingabemodalität, die Kimi K3 überhaupt nicht annimmt.
  • Sie entwickeln für den chinesischen Markt oder arbeiten bereits in Alibaba Cloud, Qoder oder QoderWork.
  • Sie forschen explorativ, Herstellerangaben zu Benchmarks genügen, und niemand wird Sie später nach der Quelle fragen.

Wählen Sie Kimi K3, wenn...

  • Sie wollen selbst hosten: Nur die Gewichte von K3 existieren heute als herunterladbares Artefakt.
  • Sie wollen mehr als einen Lieferanten, gegen den Sie verhandeln können — zehn Anbieter liefern K3 aus, einer Qwen3.8-Max.
  • Sie müssen jede Zahl gegenüber Beschaffung oder Compliance vertreten und brauchen eine Parameterzahl, die sich nachrechnen und nicht nur zitieren lässt.
  • Ihr Bewertungshorizont ist länger als ein Nachrichtenzyklus, und Sie bauen lieber auf ein datiertes Artefakt als auf einen angekündigten Veröffentlichungstermin.

Unsere Empfehlung

Qwen3.8-Max ist jetzt das günstigere Modell, Kimi K3 weiterhin das einzige betreibbare — und was davon schwerer wiegt, hängt allein davon ab, ob Sie das Modell jemals selbst betreiben wollen. Das Preisargument für Qwen ist real und nicht mehr spekulativ. Seit der allgemeinen Verfügbarkeit am 3. August 2026 wird es am offenen Markt zu 2,00 US-Dollar je Million Eingabe-Tokens und 6,00 US-Dollar je Million Ausgabe-Tokens gehandelt, gegenüber 3,00 und 15,00 US-Dollar bei Kimi K3 — 33 Prozent günstiger bei der Eingabe, 60 Prozent bei der Ausgabe, zwischengespeicherte Eingaben zu 0,25 US-Dollar je Million. Zudem verarbeitet es Video als Eingabe, was K3 nicht kann, und bietet ein Kontextfenster von einer Million Tokens. Wenn Sie Inferenz über eine API einkaufen und dabei bleiben wollen, ist Qwen3.8-Max heute das bessere kommerzielle Angebot. Das Betriebsargument für Kimi K3 hat sich unbemerkt verhärtet. Moonshots Gewichte gingen am 27. Juli 2026 um 16:29 UTC live und wurden seither über 960.000 Mal heruntergeladen; das Repository weist 2.779.931.837.184 Parameter aus — keine gerundete Marketingzahl, sondern eine summierte Tensoranzahl, die jeder nachrechnen kann. Zehn unabhängige Anbieter liefern es aus: Together, Fireworks, BaseTen, Modal, DigitalOcean, Chutes, Morph, Wafer und Moonshot selbst. Genau deshalb ist der Preis überhaupt verhandelbar. Qwen3.8-Max liefert exakt ein Unternehmen aus: Alibaba. Ein Modell mit einem einzigen Anbieter hat einen Listenpreis, keinen Marktpreis. Der ehrliche Vorbehalt für beide Seiten: Alibabas Eckdaten — 2,4 Billionen gesamt, 95 Milliarden aktiv, Platz fünf in der Text Arena — stammen vom Hersteller und wurden zusammen mit einer Gewichte-Veröffentlichung angekündigt, die nicht stattgefunden hat. Am 4. August 2026 existiert weder auf Hugging Face noch auf ModelScope, Alibabas eigenem Hub, ein Qwen3.8-Max-Repository. Auch die Lizenz von Kimi K3 ist keine OSI-Lizenz; Hugging Face führt sie als „other". Keines der beiden Modelle ist offen in dem Sinne, den eine Compliance-Abteilung meint. Unsere Empfehlung: Lebt die Arbeitslast hinter einer API und sind die Kosten je Token die Randbedingung, nehmen Sie Qwen3.8-Max. Müssen Sie selbst hosten, gegen mehr als einen Lieferanten verhandeln oder eine Zahl gegenüber jemandem vertreten, der sie nachprüft, nehmen Sie Kimi K3 — und prüfen Sie die Qwen-Gewichte-Aussage erneut, bevor Sie sich festlegen. Solche Aussagen kehren sich ohne Vorwarnung um.

Häufig gestellte Fragen

Häufige Fragen zu diesem Vergleich beantwortet.

Eindeutig Qwen3.8-Max. Seit der allgemeinen Verfügbarkeit am 3. August 2026 kostet es 2,00 US-Dollar je Million Eingabe-Tokens und 6,00 US-Dollar je Million Ausgabe-Tokens, gegenüber 3,00 und 15,00 US-Dollar bei Kimi K3. Zwischengespeicherte Eingaben liegen bei 0,25 statt 0,30 US-Dollar. Bleibt Ihre Arbeitslast hinter einer fremden API, sind das 33 Prozent Ersparnis bei der Eingabe und 60 Prozent bei der Ausgabe.
Nur Kimi K3. Dessen Gewichte gingen am 27. Juli 2026 auf Hugging Face live und wurden seither über 960.000 Mal heruntergeladen. Die Gewichte von Qwen3.8-Max wurden angekündigt, doch Stand 4. August 2026 existiert weder ein Repository auf Hugging Face noch eines auf ModelScope — Alibabas eigener Modell-Hub meldet „record not found". Behandeln Sie die Qwen-Gewichte als terminierten Vorgang, nicht als verfügbares Gut, und prüfen Sie erneut, bevor Sie darauf planen.
Diese Platzierungen stammen aus Alibabas Ankündigung. Sie mögen zutreffen, kamen aber in derselben Mitteilung wie ein Gewichte-Release, das einen Tag später nicht ausgeliefert war. Behandeln Sie sie daher als Herstellerangabe, bis Sie auf einen unabhängigen Leaderboard-Eintrag zeigen können. Der Unterschied zählt, sobald Sie die Zahl in einem Beschaffungsdokument vertreten müssen.
Ja, und das ist die am meisten unterschätzte Zeile in diesem Vergleich. Kimi K3 wird von zehn unabhängigen Anbietern verkauft; der Preis entsteht im Wettbewerb zwischen ihnen, und Sie können Last verschieben, wenn einer die Preise anhebt oder die Qualität nachlässt. Qwen3.8-Max verkauft allein Alibaba. Heute ist dieser eine Preis der niedrigere von beiden — aber es ist ein Listenpreis, und es gibt keinen zweiten Lieferanten, der ihn dort hält.

Brauchen Sie Hilfe bei der Entscheidung?

Buchen Sie ein kostenloses 30-minütiges Beratungsgespräch und wir helfen Ihnen, den besten Ansatz für Ihr Projekt zu bestimmen.

Kostenlose Beratung
Unverbindlich
Antwort innerhalb von 24h