Lokale KI · Rezept · 1× DGX Spark

Qwen3.8-27B NVFP4 mit Atlas auf 1× DGX Spark

Qwen3.8-27B NVFP4 mit Atlas auf 1× DGX Spark: 19 tok/s laut github.com (Datensatz-Stand: 29. Sept. 2026).

von Weschera

19tok/sAlltag

1 Anfrage, Prosa-Prompt, mit MTP (laut Rezept)

Quelle: github.com
Intelligenz (Originalmodell) · Artificial Analysiskein unabhängiger Wert

Engine

Engine
Atlas
Quantisierung
NVFP4 (unsloth); MTP-Head bf16 (--mtp-quantization bf16); fp8 KV (Engine-Default)
Modellfamilie
Qwen3.8-27B
Kontext
32.768
Parameter
27B (dicht)
Kreator
Weschera
GitHub-Sterne
0
Repo-Stand
15. Aug. 2026

Messwerte

Alle belegten Werte dieses Rezepts, je mit Bedingung und Quelle. Balken im Verhältnis zum größten Wert der Gruppe.

Decode · 1 Anfrage

  • Alltag (Decode)19 tok/sProse temp 0.6 ('~19') → approx Quelle 
  • Spitze (Decode)31,6 tok/sMaintainer-Fingerprint-Protokoll: Atlas-README gibt Bereich '30-32'; 31.6 wörtlich im Quant-Ladder-README (gleiche Messkampagne, inkl. deterministic-twin 964-token run); eigener Lab 32.0/29.8/30.5 → approx Quelle 

Was brauche ich

Hardware
1 × NVIDIA DGX Spark (GB10)
Gewichte
Engine
Atlas
Kontext
32.768 Token

Verwandte Rezepte

← Zur Übersicht

Lokale KI im eigenen Unternehmen?

Im Workshop klären wir, welche Modelle und welche Hardware zu Ihren Aufgaben passen, und bauen den ersten Agenten auf Ihrer Infrastruktur.