Lokale KI · Rezept · 3× DGX Spark

Kimi-K3 UD-IQ1_S mit SparkInfer auf 3× DGX Spark

von vcruz305

6,59tok/sAlltag

1 Anfrage, Prosa-Prompt, ohne Spekulation

Quelle: github.com
Intelligenz (Originalmodell) · Artificial Analysis44mit DenkenWert des Originalmodells. Stark komprimiert (~0,95 Bit), Intelligenz dürfte deutlich niedriger liegen.

≤ 3 bit: Quantisierung kann Qualität kosten

Engine

Engine
SparkInfer sparkinfer-k3 + Patches 0001–0026
Quantisierung
GGUF UD-IQ1_S (330 GB)
Modellfamilie
Kimi-K3
Kontext
—
Parameter
2.78T (HF-Card vcruz305/Kimi-K3-GGUF; HF-API moonshotai/Kimi-K3 safetensors total 2 779 931 837 184)
Kreator
vcruz305
GitHub-Sterne
9
Repo-Stand
13. Sept. 2026

Messwerte

Alle belegten Werte dieses Rezepts, je mit Bedingung und Quelle. Balken im Verhältnis zum größten Wert der Gruppe.

Für dieses Rezept sind keine Messwerte mit Quelle belegt.

Was brauche ich

Hardware
3 × NVIDIA DGX Spark (GB10)
Gewichte
Engine
SparkInfer sparkinfer-k3 + Patches 0001–0026

Hinweise

Was vor dem Nachbauen wichtig ist.

  • ≤ 3 bit: Quantisierung kann Qualität kostenBei 3 bit und weniger kann das Modell spürbar schlechter antworten als das Original. Die Intelligenz-Zahl gilt für das Original.
  • Experimentell
  • Sehr starke Quantisierung
  • Mehrere Knoten
  • Lizenz ungeklärt

Quellen

Verwandte Rezepte

← Zur Übersicht

Lokale KI im eigenen Unternehmen?

Im Workshop klären wir, welche Modelle und welche Hardware zu Ihren Aufgaben passen, und bauen den ersten Agenten auf Ihrer Infrastruktur.