29. Sept. 2026
Gebrauchte RTX 3090 für lokale LLMs: tok/s und Kosten gegen DGX Spark gerechnet
(01)Eine gebrauchte RTX 3090 decodiert Qwen-27B in Q4 mit 30–35 tok/s — und unser Cluster-Betrieb senkte die API-Kosten von 127,56 $/Tag auf 0 $/Tag. Alle Zahlen gegen den DGX Spark.
Lokale KI