1 Anfrage, Prosa-Prompt, mit DFlash2 (laut Rezept) Quelle
- Eigener Kernel nötig
- Nicht kommerziell
Ihr Ziel
Sichtbar werden, wo KI antwortet
Prozesse automatisieren
Ein Produkt bauen
KI-Agenten einsetzen
Systeme verbinden und modernisieren
Wissen, wo wir stehen
Use Cases
CRMKundenbeziehungen stärkenBeliebtE-CommerceOnline-Umsatz steigernBuchungssystem24/7 Termine annehmenProjektmanagementTeams koordinierenRechnungswesenSchneller bezahlt werdenAnalyticsDatenbasiert entscheidenLokale KI · Rezept · 2× DGX Spark
GLM-5.3-Flash EXL3 mit TensorFold auf 2× DGX Spark (1M Kontext, 4 Streams): 97,6 tok/s laut github.com (Datensatz-Stand: 29. Sept. 2026).
von MiaAI-Lab
≤ 3 bit: Quantisierung kann Qualität kosten
Alle belegten Werte dieses Rezepts, je mit Bedingung und Quelle. Balken im Verhältnis zum größten Wert der Gruppe.
Summe über alle Streams ist markiert; pro Anfrage ist es entsprechend weniger.
Kürzer ist besser.
Was vor dem Nachbauen wichtig ist.
1 Anfrage, Prosa-Prompt, mit DFlash2 (laut Rezept) Quelle
1 Anfrage, Prosa-Prompt, mit DFlash2 (laut Rezept) Quelle
1 Anfrage, Prosa-Prompt, mit DFlash2 (laut Rezept) Quelle
1 Anfrage, Prosa-Prompt, mit DFlash2 (laut Rezept) Quelle
1 Anfrage, Prosa-Prompt, mit MTP4 Quelle
1 Anfrage, Prosa-Prompt, mit DFlash2 (laut Rezept) Quelle
Im Workshop klären wir, welche Modelle und welche Hardware zu Ihren Aufgaben passen, und bauen den ersten Agenten auf Ihrer Infrastruktur.