1 Anfrage, Prosa-Prompt, mit MTP Quelle
Lokale KI · Rezept · 1× Mac
Qwen3.8-27B mit MLX auf 1× Mac
Qwen3.8-27B mit MLX auf 1× Mac: 53,3 tok/s laut github.com (Datensatz-Stand: 29. Sept. 2026).
von Weschera
Engine
- Engine
- oMLX 0.6.3rc2
- Quantisierung
- oQ4e (4-bit affine g64, 166 sens. Tensoren 5-bit; Stock-Qwen3.8-27B-Konversion)
- Modellfamilie
- Qwen3.8-27B
- Kontext
- 262.144
- Parameter
- 27B (dicht, lt. Modellname)
- Kreator
- Weschera
- GitHub-Sterne
- 64
- Repo-Stand
- 21. Aug. 2026
Messwerte
Alle belegten Werte dieses Rezepts, je mit Bedingung und Quelle. Balken im Verhältnis zum größten Wert der Gruppe.
Decode · 1 Anfrage
Prefill je Kontext
Was brauche ich
- Hardware
- 1 × Mac / Apple Silicon
- Gewichte
- HauptgewichtJundot/Qwen3.8-27B-oQ4e-mtp Lizenz ungeklärt
- Engine
- oMLX 0.6.3rc2
- Kontext
- 262.144 Token
Verwandte Rezepte
1 Anfrage, realistischer Prompt, mit Qwen MTP3 probabilistic mit standard rejection (laut Rezept) Quelle
- Eigener Kernel nötig
1 Anfrage, Prosa-Prompt, mit MTP (laut Rezept) Quelle
- Experimentell
- Eigener Kernel nötig
1 Anfrage, gemischtes Prompt-Set, Kontext 150000, mit DFlash2 (laut Rezept) Quelle
- Eigener Kernel nötig
1 Anfrage, gemischtes Prompt-Set, mit MTP Quelle
- Lizenz ungeklärt
1 Anfrage, gemischtes Prompt-Set, mit DFlash2 (laut Rezept) Quelle
- Eigener Kernel nötig
Lokale KI im eigenen Unternehmen?
Im Workshop klären wir, welche Modelle und welche Hardware zu Ihren Aufgaben passen, und bauen den ersten Agenten auf Ihrer Infrastruktur.