Technologie

Kimi K2.7 vs. DeepSeek V4 (2026): Open-Weight-Coding nach Kimi K3 und V4.1-Flash

Kimi K2.7 vs. DeepSeek V4 2026: aktuelle OpenRouter-Preise, ARC-verifizierte Kimi-K3-Werte und MIT-lizenziertes V4-Flash-0731.

Geprüft von Michael Kerkhoff, Stand

Definition
Zwei chinesische Labore bestimmen das Open-Weight-Coding-Rennen, und seit der ersten Fassung dieses Vergleichs haben beide erneut geliefert. Moonshot AI veröffentlichte Kimi K2.7 Code am 12. Juni 2026 — ein Mixture-of-Experts-Modell mit 1 Billion Parametern, ausgelegt auf agentische Tool-Nutzung und Durchsatz — und hat die Reihe inzwischen auf Kimi K3 weitergeführt, das ARC Prize am 31. Juli 2026 als neuen Open-Weight-Bestwert auf ARC-AGI-1 und ARC-AGI-2 verifiziert hat. DeepSeek startete V4 am 24. April 2026 und frischte es am 31. Juli 2026 mit DeepSeek-V4-Flash-0731 auf: 304 Milliarden Parameter, 167 GB Gewichte, schlichte MIT-Lizenz. Die ehrliche Frage 2026 lautet damit nicht mehr nur "K2.7 oder V4", sondern: auf welche Reihe standardisieren Sie sich — und bei welchem Reasoning-Aufwand. Nach aktuellen OpenRouter-Preisen liegt der Kostenunterschied bei den Output-Tokens rund 19-fach zugunsten von DeepSeek, der Kontextunterschied 4-fach. Doch der Reasoning-Aufwand verschiebt die ARC-AGI-2-Genauigkeit innerhalb eines einzigen Modells um den Faktor fünf — mehr, als die Wahl zwischen diesen beiden Familien ausmacht.
Kategorie
Technologie
Optionen
Kimi K2.7 CodeDeepSeek V4

Detaillierter Vergleich

Eine Gegenüberstellung der wichtigsten Faktoren für Ihre Entscheidung.

Kimi K2.7 Code vs DeepSeek V4
FaktorKimi K2.7 CodeDeepSeek V4
Aktualität der VeröffentlichungKimi K2.7 Code erschien am 12. Juni 2026, doch die Reihe ist weitergezogen: Die Modellkarte von Kimi K3 wurde zuletzt am 27.07.2026 aktualisiert. K2.7 sind damit nicht mehr Moonshots neueste Gewichte.DeepSeek V4 startete am 24. April 2026 und wurde am 31. Juli 2026 mit V4-Flash-0731 aufgefrischt (304B, 167 GB, Karte aktualisiert am 01.08.2026) — die neuesten offenen Gewichte auf beiden Seiten dieser Seite. Gewinner
Unabhängige Benchmark-ValidierungDie Coding-Kennzahlen von K2.7 stammen weiterhin aus Moonshots eigenem Kimi Code Bench v2. Die Reihe besitzt inzwischen eine Fremdvalidierung — ARC Prize verifizierte 94,5 % auf ARC-AGI-1 und 60,4 % auf ARC-AGI-2 —, doch die gehört Kimi K3, nicht K2.7.DeepSeek erscheint auf unabhängigen Leaderboards, und Artificial Analysis platziert V4-Flash-0731 vor dem 428B großen MiniMax M3 — eine unabhängige Einordnung des aktuellen Builds, nicht eines Vorgängers. Gewinner
API-KostenOpenRouter listet kimi-k2.7-code am 02.08.2026 mit 0,73 $/M Input und 3,50 $/M Output. Die hier zuvor von LLM Stats übernommenen 0,95 $/4,00 $ sind veraltet.deepseek-v4-flash-0731 steht bei OpenRouter mit 0,09 $/M Input und 0,18 $/M Output (erstanbieterseitig 0,14 $/0,27 $), V4-Pro bei 0,435 $/0,87 $ — Output-Tokens sind rund 19-mal günstiger als bei K2.7 Code. Gewinner
MCP & agentische Tool-NutzungFührt zum Start bei Tool-Nutzungs-Benchmarks: 76,0 MCP Atlas und 81,1 MCP Mark Verified GewinnerStarkes allgemeines agentisches Coding, aber keine vergleichbare veröffentlichte Spitzenposition bei der MCP-Tool-Nutzung
Inferenzgeschwindigkeit & DurchsatzDie HighSpeed-Variante schafft 180 Token/Sek., bis zu 260 bei kurzem Kontext GewinnerSolide Latenz, besonders V4-Flash, aber kein veröffentlichter Durchsatz-Vorsprung auf diesem Niveau
Kontextfensterkimi-k2.7-code stellt bei OpenRouter ein Kontextfenster von 262.144 Tokens bereit — groß, aber nicht im Millionenbereich. Das zuvor auf dieser Seite vermerkte Unentschieden war schlicht falsch.deepseek-v4-flash-0731 und deepseek-v4-pro stellen auf derselben Routing-Ebene je 1.048.576 Tokens bereit — ein 4-mal größeres Fenster für Arbeit am gesamten Repository. Gewinner
Praxisbewährung & VerfügbarkeitKimi K2.7-Code zählt 665.880 Downloads auf Hugging Face; die Aufmerksamkeit der Reihe ist schon nach gut sechs Wochen auf K3 übergegangen (559.924 Downloads, 9.502 Likes).DeepSeek-V4-Flash zählt 2.814.414 Downloads — über das Vierfache von K2.7-Code — über mehrere Anbieter hinweg, und der 0731-Build erbt diese Verbreitung, statt bei null zu beginnen. Gewinner
Effizienz bei Reasoning-TokenSenkt den Reasoning-Token-Verbrauch um rund 30 % gegenüber K2.6 und drückt so die Kosten bei langen Agentenschleifen GewinnerEffiziente Gedankenketten, aber keine vergleichbare veröffentlichte Reduktionszahl
Reasoning-Aufwand gegenüber ModellwahlDer von ARC Prize verifizierte Kimi-K3-Lauf fällt auf ARC-AGI-2 von 60,4 % auf 12,4 %, nur weil der Reasoning-Aufwand von max auf low gesenkt wird — ein 5-facher Genauigkeitseinbruch innerhalb eines Modells, und die Kosten wandern mit (1,59 $ pro Aufgabe bei max).Simon Willison erhielt von V4-Flash-0731 beim Standard-Reasoning ein enttäuschendes Ergebnis und ein deutlich besseres, nachdem er reasoning_effort auf high gesetzt hatte. Keine der beiden Familien lässt sich am Schlagzeilenpreis beurteilen: Die Aufwandsstufe bestimmt Qualität und tatsächliche Kosten.
LizenzklarheitDie Hugging-Face-Karte von Kimi K3 nennt license: other mit license_name: kimi-k3 — eine eigene Moonshot-Lizenz, die vor dem produktiven Einsatz juristisch geprüft werden muss.DeepSeek-V4-Flash und V4-Flash-0731 nennen beide eine schlichte MIT-Lizenz auf ihrer Modellkarte. Wer Gewichte selbst hostet oder weitergibt, entscheidet damit zwischen einer Prüfschleife und gar keiner. Gewinner
Preis-Snapshot September 2026kimi-k2.7-code jetzt bei 0,71/3,50 $ (Snapshot 10.09.2026); Kimi K3 mit 3/15 $ liefert die unabhängig verifizierten Scores, aber zum ~16-fachen Ausgabe-Preis von V4-Flash.V4-Flash-0731 am 10.09.2026 halbiert auf 0,065 $/M Eingabe und 0,18 $/M Ausgabe — die größte Kostenlead dieses Vergleichs (~19x bei Ausgabe) und die günstigste 1,3M-Token-Route. Gewinner
V4.1-Flash-Ära (September 2026)Kimi hält stabile IDs ohne Redirects: k2.7-code (262K Kontext) und K3 (1M Kontext, 3/15 $) behalten ihr dokumentiertes Verhalten durch die September-Welle.DeepSeek konsolidiert: V4.1-Flash bringt 1M nativen Kontext, Vision, 8B/16B aktive Parameter und 1/4 KV-Cache-Speicher und übernimmt am 14.09. den v4-pro-Endpunkt — eine schnelle Linie, aber zwei ID-Änderungen in einer Woche. Gewinner
Gesamtpunktzahl · 1 unentschieden3 / 128 / 12

Wichtige Statistiken

Echte Daten aus verifizierten Branchenquellen zur Unterstützung Ihrer Entscheidung.

  • Live routing prices, 2026-08-25: kimi-k2.7-code $0.67/M input, $3.40/M output, 262,144-token context; deepseek-v4-flash-0731 $0.14/M input, $0.28/M output, 1,310,720-token context; deepseek-v4-pro-0813 $1.122/$3.366. Output tokens are ~12x cheaper on V4-Flash and the context window is 5x larger. — OpenRouter model API (live) (2026)
  • As of July 31, 2026 ARC Prize verified Kimi K3 as the new open-weight high score on both benchmarks: 94.5% on ARC-AGI-1 Semi-Private at $0.77 per task and 60.4% on ARC-AGI-2 Semi-Private at $1.59 per task at max reasoning effort. The same model scores 86.7%/55.0% at high effort and 65.7%/12.4% at low effort. — ARC Prize — Verified results, Kimi K3 (2026)
  • DeepSeek-V4-Flash-0731 ships 304B parameters (167 GB of weights) under a plain MIT licence; the model card was last modified 2026-08-01. This is the newest open-weight release on either side of this comparison. — Hugging Face model API — deepseek-ai/DeepSeek-V4-Flash-0731 (2026)
  • Kimi K3's model card carries license: other with license_name: kimi-k3 — a custom Moonshot licence, not a standard OSI licence. Card last modified 2026-07-27. — Hugging Face model API — moonshotai/Kimi-K3 (2026)
  • Willison rates V4-Flash-0731 at $0.14/M input and $0.27/M output as possibly the best value-per-intelligence model available, noting Artificial Analysis ranks the 304B model ahead of the 428B MiniMax M3 — and that the default reasoning level produced a disappointing result until he raised reasoning_effort to high. — Simon Willison — deepseek-ai/DeepSeek-V4-Flash-0731 (2026)
  • Adoption splits by type of user: DeepSeek-V4-Flash has 2,814,414 downloads against 1,947 likes, while Kimi-K2.7-Code has 665,880 downloads against 1,347 likes and Kimi K3 has 559,924 downloads against 9,502 likes — DeepSeek wins on deployment volume, Moonshot on community enthusiasm. — Hugging Face model API — adoption counters (2026)
  • DeepSeek-V4-Flash-Vision-Exp: DeepSeek's experimental multimodal API model (text + image understanding) went live on the official DeepSeek API platform on 2026-08-21. It matches V4-Flash text capability and is offered on OpenRouter at $0.22/M input, $0.66/M output with a 1,048,576-token context — making V4 Flash the cheapest agentic multimodal option in this comparison. — DeepSeek API Docs — official release announcement (news260821) (2026)
  • OpenRouter-Live-Snapshot 10.09.2026: deepseek-v4-flash-0731 listet jetzt 0,065 $/M Eingabe und 0,18 $/M Ausgabe bei 1.310.720 Token Kontext — etwa die Hälfte des Standes von Ende August (0,14/0,28 $). kimi-k2.7-code listet 0,71/3,50 $ (262.144 Token), kimi-k3 3/15 $ (1.048.576 Token). Der Ausgabe-Preisabstand zu K2.7 wächst von ~12x auf ~19x. — OpenRouter model API (live) (2026)
  • DeepSeek-V4.1-Flash durch das offizielle Release-Note vom 10.09.2026 bestätigt: 552B-MoE auf neuer Kausal-Encoder-Decoder-Architektur mit 8B aktiven Parametern im Input und 16B im Output, native Visuellen Verständnis, ausgeliefert unter der Modell-ID deepseek-flash; V4-Flash und V4-Flash-Vision-Exp sind eingestellt. — DeepSeek API Docs — news260910 (2026)
  • OpenRouter-Live-Snapshot 11.09.2026: deepseek/deepseek-v4.1-flash listet 0,30 $/M Input und 1,20 $/M Output bei 1.048.576-Token-Kontext. Laut Release-Note braucht der KV-Cache nur 1/4 des HBM und 1/8 des SSD-Speichers der Vorgängergeneration; Off-Peak-Tarife liegen bei 50 % der Peak-Tarife — ein direkter Rabatt auf den Cache-Hit-Anteil der Agentenkosten. — OpenRouter model API (live) + DeepSeek release note (2026)
  • Redirect-Mechanik: ab 14.09.2026, 04:00 UTC, routen alle deepseek-v4-pro-Anfragen auf V4.1-Flash zu Flash-Preisen, bis V4.1-Pro startet; auch die eingestellten v4-flash-IDs routen übergangsweise. Gepinnte Modell-IDs bleiben gültig, ändern aber ihr Ziel. — DeepSeek API Docs — news260910 (2026)
  • DeepSeek V4.1 komprimiert den KV-Cache auf 890 Bytes pro Token; für den lokalen Lauf bleiben ca. 510 GB Modelldateien — KV-Kompression und gelernte N-gram-Lookup-Tabellen sind die zwei Achsen der Effizienz-Frontier, unabhängig von der reinen Parameterzahl. — Cloud Codes — efficiency-frontier analysis (YouTube, 11.09.2026) (2026)
  • Redirect aktiv seit 14.09.2026: Seit 04:00 UTC laufen alle deepseek-v4-pro-Anfragen auf V4.1-Flash zu V4.1-Flash-Preisen, bis V4.1-Pro startet; V4-Flash und V4-Flash-Vision-Exp sind eingestellt und routen vorübergehend auf dasselbe Modell (deepseek-flash) — die gesamte V4-Linie konvergiert auf einen Endpoint. — DeepSeek API Docs — news260910 (2026)
  • OpenRouter-Live-Snapshot 14.09.2026: deepseek-v4.1-flash $0,30/M Input, $1,20/M Output, Cache-Hits $0,006/M, in Off-Peak-Fenstern $0,15/$0,60 — die KV-Kompression (1/4 HBM, 1/8 SSD gegenüber der Vorgängergeneration) schlägt direkt in den Cache-Preisen durch, dem Kostentreiber Nr. 1 in Agent-Loops. — OpenRouter model API (live) + DeepSeek-Release-Note news260910 (2026)

Alle Statistiken stammen aus verifizierten Drittquellen. Quelle, Jahr und Original-Link werden direkt bei jeder Kennzahl angezeigt.

Wann Sie welche Option wählen sollten

Klare Orientierung basierend auf Ihrer spezifischen Situation und Ihren Bedürfnissen.

Unsere Empfehlung

Es gibt weiterhin keinen Einzelsieger, doch das Gleichgewicht hat sich seit der ersten Fassung dieser Seite verschoben — und zwar auf beiden Seiten gleichzeitig. DeepSeek ist inzwischen der stärkere Standard für nahezu jede kostensensible Produktionsentscheidung. Nach aktuellen OpenRouter-Preisen kostet deepseek-v4-flash-0731 0,14 $/M Input und 0,28 $/M Output gegenüber 0,67 $/3,40 $ für kimi-k2.7-code, also rund 12-mal weniger beim Output, und stellt ein Kontextfenster von 1.310.720 Tokens bereit gegenüber 262.144 bei K2.7 — das zuvor hier vermerkte Unentschieden beim Kontext war schlicht falsch. Der 0731-Build ist zudem das neueste offene Gewicht im Vergleich (304B, 167 GB, Karte aktualisiert am 01.08.2026) und erscheint unter schlichter MIT-Lizenz, während die Karte von Kimi K3 license: other mit license_name: kimi-k3 nennt. Wer selbst hostet, feintunt oder weitergibt, trifft allein an dieser Lizenzzeile eine Entscheidung. Zugunsten von Moonshot hat sich die Validierungslage verändert — allerdings nicht für das Modell, das diese Seite benennt. ARC Prize verifizierte Kimi K3 am 31. Juli 2026 mit 94,5 % auf ARC-AGI-1 Semi-Private und 60,4 % auf ARC-AGI-2 — die höchsten je dort erfassten Open-Weight-Werte. Die Coding-Kennzahlen von Kimi K2.7 Code stammen dagegen weiterhin aus Moonshots eigenem Kimi Code Bench v2. Die ehrliche Lesart lautet also: Die Kimi-Reihe hat sich unabhängige Glaubwürdigkeit erarbeitet, und man holt sie ab, indem man auf K3 wechselt, nicht indem man auf K2.7 bleibt. K2.7 Code hält weiterhin genau dort einen echten Vorsprung, wo diese Seite es immer gesagt hat: bei der MCP-Tool-Nutzung (76,0 MCP Atlas, 81,1 MCP Mark Verified), beim Durchsatz (180-260 Tokens/Sek. in der HighSpeed-Variante) und bei rund 30 % geringerem Reasoning-Token-Verbrauch gegenüber K2.6. Die nützlichste Erkenntnis für alle, die tatsächlich Traffic routen: Die Wahl zwischen diesen beiden Familien ist nicht der größte Hebel. Die Zahlen von ARC Prize zeigen Kimi K3 auf ARC-AGI-2 von 60,4 % auf 12,4 % fallen, nur weil der Reasoning-Aufwand von max auf low sinkt, und Simon Willison berichtet auf der Gegenseite dasselbe Muster: V4-Flash-0731 lieferte beim Standard-Reasoning ein enttäuschendes und bei reasoning_effort high ein deutlich besseres Ergebnis. Ein fünffacher Genauigkeitsunterschied innerhalb eines Modells ist größer als der Abstand zwischen den beiden Modellen. Testen Sie einen Kandidaten auf der Aufwandsstufe, die Sie später auch bezahlen — sonst ist der Schlagzeilenpreis Fiktion. Das Muster von Context Studios bleibt in der Form gleich und wird im Detail schärfer: Hochvolumige, klar begrenzte Coding-Last standardmäßig auf DeepSeek V4-Flash-0731 für Kosten und Kontext, die härtesten Reasoning-Fälle auf V4-Pro eskalieren und MCP-orchestrierungslastige Agent-Schleifen auf die Kimi-Reihe routen — dabei jedoch mit Kimi K3 statt K2.7 kalkulieren, da K3 das verifizierte Ende dieses Pfades ist, und die Reasoning-Aufwandsstufe in derselben Konfiguration festschreiben wie das Modell. Zusätzlich hat DeepSeek am 21.08.2026 DeepSeek-V4-Flash-Vision-Exp veröffentlicht — ein experimentelles multimodales API-Modell (Text + Bild) mit V4-Flash-naher Textleistung, auf OpenRouter für 0,22 $/M Input und 0,66 $/M Output mit 1-M-Kontext gelistet. Damit erweitert V4 Flash seine Produktions-Fälle um visuelle Agenten-Aufgaben (Screenshots, UIs, Diagramme) zu einem Bruchteil der Kosten von Frontier-Multimodal-Modellen. Seit dem Snapshot vom 10.09.2026 hat die DeepSeek-Seite erneut bewegt: V4-Flash-0731 halbiert auf 0,065/0,18 $ pro Million Tokens, die Ausgabe-Lücke zu kimi-k2.7-code (~0,71/3,50 $) wächst auf ~19x; ein V4.1-Flash-Test-Build (natives Multimodal, ~400 tok/s, Cut-off 10.09.) ist gemeldet, aber noch nicht bei OpenRouter. Die Routing-Formel bleibt: V4-Flash für die Masse, V4-Pro für das härteste Reasoning, die Kimi-Linie für MCP-lastige Schleifen — mit K3 als verifiziertem Ende. Seit dem 10.09.2026 ist der V4.1-Flash-Preview bestätigt (552B-MoE, 8B/16B aktiv, 1M Kontext, 0,30/1,20 $) — und mit dem 14.09.-Redirect bündelt DeepSeek seine Linie in einem Flash-Rückgrat, das auch die alte v4-pro-ID bedient, während Kimi die stabilere ID-Semantik hält. Auf der Effizienz-Achse wird V4.1s KV-Cache mit 890 Bytes pro Token angegeben (ca. 510 GB Dateien für lokale Läufe) — Kompression und Lookup-Tabellen zählen inzwischen so viel wie die reine Parameterzahl.

Wählen Sie Kimi K2.7 Code, wenn...
  • Ihre Last ist MCP-lastig und die Treffsicherheit der Tool-Aufrufe ist der eigentliche Engpass
  • Sie sind bereits auf der Kimi-K2.x-Reihe und wollen einen Upgrade-Pfad, der beim ARC-verifizierten K3 endet
  • Durchsatz zählt für Sie mehr als Tokenpreis, und die 180-260 Tokens/Sek. der HighSpeed-Variante rechnen sich
  • Sie können mit hohem oder maximalem Reasoning-Aufwand fahren und kaufen Spitzenleistung statt Kosten pro Aufgabe
Wählen Sie DeepSeek V4, wenn...
  • Kosten pro Token sind Ihre Hauptrestriktion — Output-Tokens sind bei V4-Flash-0731 rund 19-mal günstiger
  • Sie brauchen ein Kontextfenster im Millionenbereich; K2.7 Code endet bei 262.144 Tokens
  • Sie hosten, feintunen oder verteilen Gewichte selbst und wollen eine schlichte MIT-Lizenz ohne Rechtsprüfung
  • Sie wollen die neuesten Gewichte auf beiden Seiten, aufgefrischt am 31.07.2026, auf bereits breiter Anbieterbasis
  • Sie wollen eine Familie mit günstiger Flash-Stufe und Frontier-Pro-Stufe für das Routing
  • Sie die dokumentiert größte Preislead wollen: V4-Flash-0731 halbierte im Snapshot vom 10.09.2026 auf 0,065/0,18 $ pro Million Tokens
  • Sie wollen die Konsolidierung vom September 2026: eine 1M-Kontext-, vision-fähige Flash-Linie (8B/16B aktiv, 1/4 KV-Cache), die am 14.09. auch den v4-pro-Endpunkt aufnimmt.

Häufige Fragen zu diesem Vergleich beantwortet.

Häufig gestellte Fragen

(01)Ist Kimi K2.7 oder DeepSeek V4 besser zum Programmieren?
Das hängt von Ihrer Einschränkung ab. DeepSeek V4 ist die sicherere Wahl für kostensensible Arbeit mit hohem Volumen: Es ist unabhängig getestet (berichtete 83,7 % bei SWE-bench Verified, Platz 14 bei BenchLM), seit April 2026 in Produktion, und seine V4-Flash-Stufe gehört zu den günstigsten ernstzunehmenden Coding-APIs. Kimi K2.7 Code ist stärker bei MCP-lastigen agentischen Abläufen und führt Tool-Nutzungs-Benchmarks (76,0 MCP Atlas, 81,1 MCP Mark Verified) bei hohem Durchsatz an — doch seine vielbeachteten Coding-Gewinne sind noch weitgehend selbst berichtet, validieren Sie also zuerst an Ihren eigenen Aufgaben.
(02)Was ist günstiger, Kimi K2.7 oder DeepSeek V4?
DeepSeek V4 ist günstiger. V4-Flash liegt bei rund 0,28 $ pro Million Ausgabe-Token und V4-Pro bei rund 0,87 $, mit zu den niedrigsten Werten für ernstzunehmende Coding-Modelle. Kimi K2.7 Code kostet 0,95 $ pro Million Eingabe- und 4,00 $ pro Million Ausgabe-Token, mit Cache-Treffern für nur 0,19 $ pro Million — wettbewerbsfähig, aber bei den Ausgabekosten deutlich über DeepSeeks Flash-Stufe.
(03)Sind die Benchmark-Werte von Kimi K2.7 unabhängig bestätigt?
Bislang überwiegend nicht. Zum Start stammen Kimis vielbeachtete Coding-Gewinne (+21,8 % gegenüber K2.6) aus Moonshots eigenem Kimi Code Bench v2, und unabhängige SWE-bench-Zahlen sind noch dünn. DeepSeek V4 hingegen taucht bereits auf unabhängigen Bestenlisten wie Vals AI und BenchLM auf. Behandeln Sie Kimis Startwerte als vielversprechend, aber unbestätigt, bis Benchmarks von Dritten vorliegen.
(04)Kann ich Kimi K2.7 und DeepSeek V4 selbst hosten?
Ja — beide sind Open-Weight-Modelle, sodass Sie sie aus Gründen der Datenhoheit oder Compliance auf eigener Infrastruktur betreiben können, zusätzlich zu ihren gehosteten APIs. DeepSeek V4 ist bereits bei mehreren Anbietern verfügbar (Fireworks, DeepInfra, Novita, SiliconFlow). Beachten Sie, dass die MoE-Architekturen groß sind: Kimi K2.7 hat eine Billion Parameter insgesamt und DeepSeek V4-Pro 1,6 Billionen, das Selbst-Hosting der obersten Stufen erfordert also erhebliche Speicherbandbreite.
(05)Sind Kimis Benchmark-Werte inzwischen unabhängig verifiziert?
Teilweise — und nicht für das Modell, das diese Seite benennt. ARC Prize verifizierte Kimi K3 am 31. Juli 2026 mit 94,5 % auf ARC-AGI-1 Semi-Private (0,77 $ pro Aufgabe) und 60,4 % auf ARC-AGI-2 (1,59 $ pro Aufgabe) — die höchsten Open-Weight-Werte, die dort je erfasst wurden. Kimi K2.7 Code selbst stützt sich weiterhin auf Moonshots eigenen Kimi Code Bench v2. Wenn Sie auf unabhängige Validierung warten, lautet die Antwort: auf K3 wechseln, nicht den Startwerten von K2.7 vertrauen.
(06)Mit welcher Lizenz können wir tatsächlich produktiv gehen?
DeepSeek ist hier die klarere Antwort. Sowohl DeepSeek-V4-Flash als auch das neuere V4-Flash-0731 nennen auf ihren Hugging-Face-Karten eine schlichte MIT-Lizenz. Die Karte von Kimi K3 nennt license: other mit license_name: kimi-k3 — eine eigene Moonshot-Lizenz. MIT erfordert vor Self-Hosting, Fine-Tuning oder Weitergabe keine juristische Prüfung, eine Speziallizenz schon.
(07)Was änderte sich beim Preis-Schnitt im September 2026?
Im OpenRouter-Snapshot vom 10.09.2026 listet deepseek-v4-flash-0731 0,065 $/M Eingabe und 0,18 $/M Ausgabe, nach 0,14/0,28 $ Ende August — etwa eine Halbierung. kimi-k2.7-code liegt bei 0,71/3,50 $, kimi-k3 bei 3/15 $ (1M-Token-Fenster), die Lücke wächst auf ~19x. Gemeldet wurde zudem ein V4.1-Flash-Test-Build (natives Multimodal, ~400 tok/s, Cut-off 10.09.), noch ohne OpenRouter-Eintrag. Preise beim Routing gegenprüfen.
(08)Was hat V4.1-Flash am 10. September 2026 geändert?
Es ist der bestätigte Flagship-tier-Flash: 552B-MoE, 8B aktive Parameter im Input und 16B im Output, 1M-Token-Kontext, native Vision, laut OpenRouter-Snapshot vom 11.09. bei 0,30/1,20 $ pro Mio. Tokens. V4-Flash und Vision-Exp sind eingestellt, und ab 14.09., 04:00 UTC, routet die ID deepseek-v4-pro selbst auf V4.1-Flash zu Flash-Preisen — nach dem Schalter die Evals neu laufen lassen.

Brauchen Sie Hilfe bei der Entscheidung?

Buchen Sie ein kostenloses 30-minütiges Beratungsgespräch und wir helfen Ihnen, den besten Ansatz für Ihr Projekt zu bestimmen.

Kostenlose Beratung · Unverbindlich · Persönliche Antwort