Wann Sie welche Option wählen sollten
Klare Orientierung basierend auf Ihrer spezifischen Situation und Ihren Bedürfnissen.
Unsere Empfehlung
Einen universellen Sieger gibt es hier nicht, und die ehrliche Achse ist nicht "kostenlos gegen kostenpflichtig" - sondern was Sie überprüfen und was Sie überstehen können. Beim Preis gewinnen offene Gewichte klar, und deutlicher als viele Teams annehmen. Die Preisseite von DeepSeek-V4-Pro nennt 0,435 US-Dollar je Million Eingabe-Token und 0,87 US-Dollar je Million Ausgabe-Token; Anthropics Preisseite führt Claude Opus 5 mit 5 beziehungsweise 25 US-Dollar. Das ist rund das Elffache bei der Eingabe und das 29-Fache bei der Ausgabe - für ein gehostetes Open-Weight-Modell, noch vor dem Eigenbetrieb. Die Verbreitung ist real: GLM-5.2 von Z.ai und dessen FP8-Variante kommen in den 25 Tagen seit Veröffentlichung zusammen auf knapp vier Millionen Hugging-Face-Downloads, und ein chinesisches Open-Weight-Modell erledigte im Juli 2026 die Portierung der Vercel-CLI von TypeScript nach nativ. Eingetauscht werden Lieferzuverlässigkeit und Nachprüfbarkeit. Die 2,8 Billionen Parameter schweren Gewichte von Kimi K3 waren auf den 27. Juli 2026 datiert; eine direkte Abfrage der Hugging-Face-API zeigt an jenem Morgen kein offizielles Repository, nur Ableitungen Dritter - während mehrere Medien die Veröffentlichung als vollzogen meldeten. Zudem verbirgt "kostenlos" eine Hardware-Hürde: Ein Open-Weight-Modell der Spitzenklasse benötigt einen Mehr-GPU-Knoten, bevor es überhaupt lädt, und dieser Knoten kostet monatlich dasselbe, ob Sie eine Anfrage senden oder eine Million. Bei unabhängig reproduzierten Coding-Benchmarks führen weiterhin die geschlossenen Flaggschiffe. Neu ist 2026 die politische Dimension. Im Juli wuchs der Brief "Open Weights and American AI Leadership" binnen eines Tages von 25 auf 50 Unterzeichner - Nvidia, Microsoft, Meta, IBM, Hugging Face, Mozilla, die Linux Foundation, Mistral, mit OpenAI und Google als Nachzüglern und ohne Anthropic und Amazon. Lesen Sie das als Lieferketten-Information, nicht als Moralstück: Ein Anbieter, dessen Position lautet, bestimmte Gewichte sollten nicht veröffentlicht werden dürfen, ist ein Anbieter, dessen Fahrplan von Ihrer Ausstiegsfähigkeit abweichen kann. Offene Gewichte sind der Ausstieg. Die praktische Antwort lautet für die meisten Teams: beides. Ein proprietäres Flaggschiff für Spitzenaufgaben, bei denen geprüfte Benchmarks und Unternehmens-Governance gefordert sind, und ein einsatzbereites Open-Weight-Modell für sensible, sehr große oder kostengetriebene Lasten - damit eine Lizenz-, Preis- oder Politikänderung eine Unannehmlichkeit bleibt und keine Migration wird.
- Wählen Sie Open-Source-LLMs, wenn...
- Ihre Datenklasse verbietet es grundsätzlich, Prompts an eine fremde API zu senden
- Das Volumen ist hoch und gleichmäßig genug, um einen dedizierten GPU-Knoten zu amortisieren
- Sie müssen das Modell feinabstimmen, quantisieren oder inspizieren, statt es nur aufzurufen
- Sie wollen einen Migrationspfad, der Preis- oder Kurswechsel eines Anbieters übersteht
- Wählen Sie Proprietäre LLMs, wenn...
- Sie brauchen die Spitze bei Benchmarks, die ein Dritter reproduziert hat
- Ihr Volumen schwankt stark oder ist gering, sodass ein fester GPU-Knoten ungenutzt bliebe
- Sie benötigen heute Unternehmens-Governance: regionales Hosting, AV-Verträge, Compliance-Werkzeuge, Support
- Sie haben kein Plattformteam, das Inferenz-Infrastruktur samt Fehlerbildern betreuen kann