Quand Choisir Chaque Option
Un guide clair basé sur votre situation spécifique et vos besoins.
Notre Recommandation
Il n'y a pas de vainqueur universel ici, et l'axe honnête n'est pas « gratuit contre payant » : c'est ce que vous pouvez vérifier et ce à quoi vous pouvez survivre. Sur le coût, les poids ouverts l'emportent nettement, et davantage que ne le supposent la plupart des équipes. La page tarifaire de DeepSeek-V4-Pro affiche 0,435 dollar par million de tokens en entrée et 0,87 en sortie ; celle d'Anthropic affiche Claude Opus 5 à 5 et 25 dollars. Soit environ 11 fois plus en entrée et 29 fois plus en sortie - pour un modèle à poids ouverts hébergé, avant même d'envisager l'auto-hébergement. L'adoption est réelle : GLM-5.2 de Z.ai et sa variante FP8 totalisent près de quatre millions de téléchargements Hugging Face en vingt-cinq jours, et un modèle chinois à poids ouverts a réalisé en juillet 2026 le portage du CLI Vercel de TypeScript vers du natif. Ce que vous cédez, c'est la fiabilité de livraison et la vérifiabilité. Les poids de Kimi K3, 2 800 milliards de paramètres, étaient datés du 27 juillet 2026 ; une vérification directe de l'API Hugging Face ce matin-là ne montre aucun dépôt officiel, seulement des dérivés tiers - alors que plusieurs médias annonçaient la sortie comme faite. L'auto-hébergement cache aussi un seuil matériel : un modèle de pointe à poids ouverts exige un nœud multi-GPU avant même de se charger, et ce nœud coûte le même montant mensuel que vous lui envoyiez une requête ou un million. Sur les benchmarks de code reproduits indépendamment, les modèles fermés gardent l'avantage. La nouveauté de 2026, c'est le volet politique. En juillet, la lettre « Open Weights and American AI Leadership » est passée de 25 à 50 signataires en une journée - Nvidia, Microsoft, Meta, IBM, Hugging Face, Mozilla, la Linux Foundation, Mistral, OpenAI et Google ayant signé tardivement, Anthropic et Amazon restant absents. Voyez-y une donnée de chaîne d'approvisionnement plutôt qu'une querelle morale : un fournisseur qui défend l'idée que certains poids ne devraient pas être publiables est un fournisseur dont la trajectoire peut diverger de votre capacité de sortie. Les poids ouverts sont cette sortie. Pour la plupart des équipes, la réponse pratique est : les deux. Un modèle phare propriétaire pour les travaux de pointe où benchmarks vérifiés et gouvernance d'entreprise sont exigés, et un modèle à poids ouverts tenu prêt pour les charges sensibles, à très fort volume ou dominées par le coût - afin qu'un changement de licence, de tarif ou de politique reste un désagrément et non une migration.
- Choisissez LLM open source quand...
- Votre classe de données interdit purement et simplement d'envoyer des prompts à une API tierce
- Le volume est suffisamment élevé et régulier pour amortir un nœud GPU dédié
- Vous devez affiner, quantiser ou inspecter le modèle plutôt que simplement l'appeler
- Vous voulez un chemin de migration qui résiste à un changement de tarif ou de politique du fournisseur
- Choisissez LLM propriétaires quand...
- Vous visez le sommet sur des benchmarks reproduits par un tiers
- Votre volume est irrégulier ou faible : un nœud GPU fixe resterait inutilisé
- Vous exigez dès aujourd'hui une gouvernance d'entreprise : hébergement régional, DPA, outils de conformité, support
- Vous n'avez pas d'équipe plateforme pour exploiter l'infrastructure d'inférence et ses modes de défaillance