kein belegter Tempowert
Lokale KI · Rezept · 1× DGX Spark
Qwen3.6-35B NVFP4 mit SGLang auf 1× DGX Spark
Qwen3.6-35B NVFP4 mit SGLang auf 1× DGX Spark: 92,2 tok/s laut github.com (Datensatz-Stand: 29. Sept. 2026).
von Weschera
Engine
- Engine
- SGLang
- Quantisierung
- NVFP4 (qwen36-35b-nvfp4 Checkpoint)
- Modellfamilie
- Qwen3.6-35B
- Kontext
- 262.144
- Kreator
- Weschera
- GitHub-Sterne
- 1
- Repo-Stand
- 12. Juli 2026
Messwerte
Alle belegten Werte dieses Rezepts, je mit Bedingung und Quelle. Balken im Verhältnis zum größten Wert der Gruppe.
Decode · 1 Anfrage
Was brauche ich
- Hardware
- 1 × NVIDIA DGX Spark (GB10)
- Gewichte
- HauptgewichtRedHatAI/Qwen3.6-35B-A3B-NVFP4 Apache-2.0
- Engine
- SGLang
- Kontext
- 262.144 Token
Verwandte Rezepte
1 Anfrage, Prosa-Prompt, mit MTP (laut Rezept) Quelle
- Eigener Kernel nötig
- Lizenz ungeklärt
1 Anfrage, Prosa-Prompt, mit MTP (laut Rezept) Quelle
- Zugang auf Anfrage
- Lizenz ungeklärt
1 Anfrage, Prosa-Prompt, mit MTP Quelle
1 Anfrage, Prosa-Prompt, Prompt 50 Token, mit DSpark (laut Rezept) Quelle
- Lizenz ungeklärt
1 Anfrage, Prosa-Prompt, mit Drafting aus dem Prompt (Edit-Setup, lt. README 'drafts its guesses from your prompt') (laut Rezept) Quelle
- Lizenz ungeklärt
Lokale KI im eigenen Unternehmen?
Im Workshop klären wir, welche Modelle und welche Hardware zu Ihren Aufgaben passen, und bauen den ersten Agenten auf Ihrer Infrastruktur.