Kimi K3 rückt ein offenes Spitzenmodell in die engere Wahl

Kimi K3 von Moonshot ist ein offenes Modell mit 2,8 Billionen Parametern. Warum der Termin am 27. Juli 2026 wichtiger ist als die Benchmark-Angaben zum Start.

Kimi K3 rückt ein offenes Spitzenmodell in die engere Wahl
Wer eine Richtlinie zur Modellauswahl pflegt, kommt an Kimi K3 nicht vorbei: Es ist das erste Modell mit offenen Gewichten, das dort hineingehört.
Moonshot AI hat das Modell mit 2,8 Billionen Parametern am 16. Juli 2026 veröffentlicht, ruft dafür 3 US-Dollar je Million Eingabe-Token und 15 US-Dollar je Million Ausgabe-Token auf und nennt den 27. Juli 2026 als Termin für die Freigabe der Gewichte ([EqualOcean](https://equalocean.com/news/2026071722035-moonshot-ai-unveils-2-8-trillion-parameter-kimi-k3-open-weights-due-july-27), [Trilogy AI](https://trilogyai.substack.com/p/kimi-k3-is-live-pricing-benchmarks)). Wir verteilen unseren Produktivverkehr bewusst auf mehrere Modellanbieter statt auf einen einzigen, und jeder neue Anbieter der Spitzenklasse muss sich seinen Anteil erst über die Kosten je akzeptierter Aufgabe verdienen. Im Folgenden steht, was tatsächlich ausgeliefert wurde, welche Angaben bislang nur vom Hersteller stammen und was sich für Ihr Routing wirklich ändert.

Was Moonshot tatsächlich ausgeliefert hat

Kimi K3 ist ein Mixture-of-Experts-Modell mit 2,8 Billionen Parametern, einem Kontextfenster von einer Million Token und nativer Bildverarbeitung, wobei pro Token 16 von 896 Experten aktiv sind.
Moonshot beschreibt die Architektur als Aufbau auf „Kimi Delta Attention" und „Attention Residuals" und bezeichnet sie als weltweit erstes offenes Modell der 3-Billionen-Klasse ([The Hindu](https://www.thehindu.com/sci-tech/technology/what-is-kimi-k3-chinas-first-open-ai-model-to-reach-28-trillion-parameters/article71232767.ece)). Die Angabe zur Expertenaktivierung stammt aus den technischen Zusammenfassungen vom Erscheinungstag ([Next Tool](https://buttondown.com/nexttool/archive/open-models-just-hit-28-trillion-parameters-and-4)), das Datum 16. Juli 2026 wird unabhängig bestätigt ([DEV Community](https://dev.to/jamilxt/kimi-k3-chinas-28-trillion-parameter-open-model-just-raised-the-bar-4in1)).

Erreichbar ist K3 bereits über die Moonshot-Programmierschnittstelle, über kimi.com sowie über Kimi Work und Kimi Code; Routing-Plattformen führen es als sehr großes, offenes multimodales Modell für die Arbeit in umfangreichen Repositories, für Werkzeugaufrufe und für langlaufende agentische Abläufe (OpenRouter). Die Gewichte selbst liegen dagegen noch nicht vor. In der Hugging Face-Organisation von Moonshot fand sich am 18. Juli 2026 kein öffentliches Repository zu Kimi K3 (huggingface.co/moonshotai), was zum genannten Termin am 27. Juli passt. Zur Einordnung: Die Berichterstattung zum Start wertet K3 als deutlichen Sprung in der Größenordnung gegenüber bisherigen offenen Modellen (The Stack).

Die Benchmark-Angaben stammen bislang nur vom Hersteller

Moonshot räumt selbst ein, dass Kimi K3 in der Gesamtleistung hinter Claude Fable 5 von Anthropic und GPT-5.6 Sol von OpenAI zurückbleibt, in den eigenen Tests aber Claude Opus 4.8 und GPT-5.5 schlägt.
Diese Einordnung kommt vom Unternehmen selbst und beruht nicht auf einer unabhängigen Wiederholung der Messungen ([CNBC](https://www.cnbc.com/2026/07/17/moonshot-ai-kimi-k3-model-openai-anthropic-china.html)). Öffentlich tritt Moonshot mit dem Anspruch an, dass Kimi K3 mit den führenden amerikanischen Laboren mithalten kann ([BBC](https://www.bbc.com/news/articles/cy9w4q8pgp0o)).

Die unabhängige Datenlage ist dünner, als es die Schlagzeilen vermuten lassen. K3 stieg in der Intelligenzwertung von Artificial Analysis unter den ersten fünf ein, hinter Claude Fable 5 von Anthropic und GPT-5.6 Sol, und führte die Wertung von Arena.ai für Frontend-Webentwicklung an (Wikipedia, Artificial Analysis). Beiträge vom 17. Juli 2026 nennen dabei mal Platz drei, mal Platz vier, sodass es keine einheitliche Angabe gibt. Ein Beobachter verzichtete sogar ganz darauf, Werte zu veröffentlichen, weil die zugrunde liegenden Zahlen zum Erscheinen nicht überprüfbar waren (BenchLM). Behandeln Sie jede Zahl als Herstellerangabe, solange die Gewichte nicht öffentlich sind und niemand außerhalb des Unternehmens nachgemessen hat.

Unsere Einschätzung: offen bedeutet hier nicht günstig

Bei einem Modell mit offenen Gewichten wird reflexhaft angenommen, dass es die etablierten Anbieter im Preis unterbietet. Auf K3 trifft das nicht zu. Mit 3 beziehungsweise 15 US-Dollar je Million Token bewegt es sich im Bereich der Spitzenmodelle, und Artificial Analysis stuft es im Vergleich zu Modellen derselben Preisklasse als teuer ein (Artificial Analysis). Wer erwartet hat, dass sich unsere Kostenrechnung je Aufgabe zu Grok 4.5 hier wiederholt, wird enttäuscht. Es handelt sich um einen anderen Zug.

Die Wirtschaftlichkeit von Kimi K3 entscheidet sich am 27. Juli 2026, wenn die Gewichte erscheinen, und nicht am Preis der Programmierschnittstelle zum Start.
Offene Gewichte bringen drei Dinge, die eine Programmierschnittstelle nicht bietet: die Möglichkeit zum Eigenbetrieb, falls sich Vertragsbedingungen oder Verfügbarkeit eines Anbieters ändern, eine Installation unter eigener Kontrolle für Fragen des Datenstandorts sowie ein Modell, das Sie auch in zwei Jahren noch betreiben können, unabhängig von fremden Produktplänen. Dahinter steht dieselbe Absicherungslogik wie in unserer Einschätzung dazu, [was ein börsennotiertes Anthropic für Ihren Claude-Aufbau bedeutet](https://www.contextstudios.ai/de/blog/anthropic-boersengang-was-sich-fuer-claude-teams-aendert), und in unserer Analyse zur [Trennung zwischen amerikanischer Zugangskontrolle und chinesischer Verhaltensregulierung](https://www.contextstudios.ai/de/blog/usa-regeln-ki-zugang-china-regelt-ki-verhalten). Ein offenes Modell chinesischer Herkunft räumt die zweite Einschränkung nicht aus. Es verlagert sie lediglich, und Ihre Compliance-Prüfung muss das schriftlich festhalten.

Was das für Sie bedeutet

Drei Schritte, in dieser Reihenfolge.

Ändern Sie Ihr Routing nicht wegen der Zahlen vom Erscheinungstag. Nehmen Sie K3 in Ihre Bewertungsreihe auf, nicht in den Produktivbetrieb. Messen Sie es an Ihrer eigenen Quote akzeptierter Aufgaben, bei Ihren eigenen Promptlängen, gegen das, was bei Ihnen produktiv läuft. Ein Kontextfenster von einer Million Token lohnt den Aufpreis nur, wenn Ihre Arbeitslasten es tatsächlich ausschöpfen.

Notieren Sie den 27. Juli 2026 als den eigentlichen Entscheidungstermin. Erst dann lässt sich der Eigenbetrieb testen, und erst dann erscheinen unabhängige Wiederholungen der Messungen. Alles davor ist Herstellerangabe.

Verankern Sie die Option offener Gewichte schon jetzt in Ihren Richtlinien für das Routing. Wenn Ihre Gateway- oder Routing-Ebene einen vierten Anbieter nicht ohne Codeänderung aufnehmen kann, nützt Ihnen auch das größte offene Modell der Welt nichts. Dasselbe gilt für Ihre Auswahl an Coding-Agenten: Ein Modell, das sich nicht hinter einer bestehenden Schnittstelle austauschen lässt, werden Sie nie ernsthaft bewerten.

Wenn daraus eine belastbare Richtlinie werden soll, mit Bewertungsaufbau, Routing-Regeln und dokumentiertem Rückfallweg je Arbeitslast, dann ist genau das unsere Arbeit.

Häufig gestellte Fragen

Was ist Kimi K3? Kimi K3 ist ein Mixture-of-Experts-Modell mit 2,8 Billionen Parametern, das Moonshot AI am 16. Juli 2026 veröffentlicht hat, mit einem Kontextfenster von einer Million Token und nativer Bildverarbeitung. Moonshot bezeichnet es als weltweit erstes offenes Modell der 3-Billionen-Klasse (The Hindu).

Wann werden die Gewichte von Kimi K3 verfügbar? Moonshot nennt den 27. Juli 2026 als Termin für die offenen Gewichte. Bis dahin ist das Modell ausschließlich über die Programmierschnittstelle und über die eigenen Produkte des Unternehmens erreichbar (EqualOcean).

Ist Kimi K3 besser als Claude Fable 5 oder GPT-5.6 Sol? Nein. Nach Angaben von Moonshot selbst bleibt K3 in der Gesamtleistung hinter beiden zurück, schlägt in den getesteten Benchmarks aber Claude Opus 4.8 und GPT-5.5 (CNBC).

Was kostet Kimi K3? Berichtet werden 3 US-Dollar je Million Eingabe-Token und 15 US-Dollar je Million Ausgabe-Token (Trilogy AI). Maßgeblich ist die Preisdokumentation von Moonshot selbst (Preise bei Moonshot).

Sollten wir Produktivverkehr auf Kimi K3 umstellen? Nicht auf Grundlage der Zahlen vom Erscheinungstag. Nehmen Sie das Modell in Ihre Bewertungsreihe auf, messen Sie die Kosten je akzeptierter Aufgabe an Ihren eigenen Arbeitslasten und entscheiden Sie neu, sobald nach der Freigabe der Gewichte am 27. Juli 2026 unabhängige Wiederholungen vorliegen.

Quellen

  1. Moonshot AI — Preisdokumentation der Programmierschnittstelle
  2. Moonshot AI — Blog
  3. Artificial Analysis — Intelligenz, Leistung und Preisanalyse
  4. OpenRouter — Preise und Anbieter der Programmierschnittstelle
  5. Hugging Face — Organisation moonshotai
  6. BBC — Moonshot AI aus China erklärt, Kimi K3 könne mit OpenAI und Anthropic mithalten
  7. CNBC — Moonshot AI sieht das neue Modell auf Augenhöhe mit US-Laboren
  8. Wikipedia — Kimi (Chatbot)
  9. The Hindu — Was Kimi K3 ist, Chinas erstes offenes Modell mit 2,8 Billionen Parametern
  10. EqualOcean — Moonshot AI stellt das Modell vor, offene Gewichte bis zum 27. Juli
  11. The Stack — Chinas offenes Modell rückt den US-Anbietern auf die Pelle
  12. Trilogy AI — verfügbar: Preise, Benchmarks und das Warten auf die offenen Gewichte
  13. Next Tool — Offene Modelle erreichen 2,8 Billionen Parameter
  14. DEV Community — Chinas offenes Modell mit 2,8 Billionen Parametern
  15. BenchLM — Kimi 3 erschien vor den Daten

Artikel teilen

Share: