Kimi K3 vs Claude Opus 5 (2026): i pesi sono usciti — ora contano licenza e conto della VRAM
Kimi K3 ha pubblicato i pesi il 27 luglio 2026. Ora decidono le soglie di licenza, 1,5 TB di VRAM, il prezzo e la riproducibilità.
La premessa su cui questa pagina era costruita è venuta meno, e vale la pena dire con precisione perché. I pesi di Kimi K3 erano annunciati per il 27 luglio 2026 e sono stati consegnati il 27 luglio 2026, alle 16:29 UTC. Il nostro controllo è partito la stessa mattina alle 03:50 UTC e non ha trovato nulla: esatto in quell'istante, fuorviante già nel pomeriggio. Ne tragga la lezione che contiene: un'affermazione sul fatto che qualcosa esista già ha un'emivita di poche ore e non invecchia fino a cadere in un filtro di obsolescenza — diventa semplicemente falsa, in silenzio. Fatta questa correzione, il confronto premia Kimi K3 più di prima, ma su un terreno diverso. I pesi sono reali, ampiamente adottati e già riquantizzati da Red Hat e Unsloth. Il vantaggio di prezzo regge: 3 / 15 USD contro 5 / 25 USD. Sulla finestra di contesto c'è una vera parità, circa un milione di token per parte. E K3 fa una cosa che Opus non fa: pubblica i risultati delle valutazioni come YAML leggibile dalle macchine accanto a pesi scaricabili, rendendo falsificabili le dichiarazioni del produttore. Nessuno ha ancora pubblicato quel ricalcolo, perciò lo valutiamo come parità e non come vittoria. Ciò che i pesi aperti non fanno è rendere il self-hosting una decisione ordinaria. Con 2.800 miliardi di parametri, K3 richiede oltre 1,5 TB di VRAM prima di qualsiasi cache KV e non entra in un nodo da otto B200. La risposta pratica sono otto schede da 288 GB — e il numero più interessante emerso è che vince la scheda più economica: 8 AMD MI355X hanno reso 48 token al secondo per dollaro di ora-GPU contro i 33 di una B300 che costa circa 2,4 volte di più per GPU. Se finora ha calcolato il self-hosting a prezzi NVIDIA, il Suo modello di costo ha una lacuna concreta. In sintesi: Kimi K3 se l'uso è interno, se il costo per token è vincolante e se hardware della classe 288 GB è disponibile o affittabile. Claude Opus 5 se Le serve governance dei dati nell'UE con API di conformità, se preferisce non gestire uno stack di serving proprio, oppure se è un fornitore di Model-as-a-Service in avvicinamento ai 20 milioni di USD di ricavi — perché a quella soglia la Kimi K3 Licence smette di essere permissiva e diventa una trattativa. I pesi aperti non chiudono la decisione. La spostano dalla disponibilità all'economia e ai termini legali, dove sarebbe dovuta stare fin dall'inizio.
Confronto Dettagliato
Un'analisi comparativa dei fattori chiave per aiutarti a fare la scelta giusta.
| Fattore | Kimi K3Consigliato | Claude Opus 5 | Vincitore |
|---|---|---|---|
| Pesi aperti e self-hosting | Rilasciato: moonshotai/Kimi-K3 pubblicato il 27/07/2026 alle 16:29 UTC — 96 frammenti safetensors, 837.000 download e 9.600 like in sei giorni | Chiuso e per scelta accessibile solo via API; nessun peso disponibile a nessun livello | |
| Condizioni di licenza commerciale | Kimi K3 Licence, non MIT: uso interno senza limiti, ma un'attività di Model-as-a-Service che superi i 20 milioni di USD di ricavi in dodici mesi deve stipulare un accordo separato con Moonshot | Consuete condizioni commerciali per API: nessuna soglia di ricavi, nessun obbligo di menzione, nessun accordo da negoziare | |
| Rispetto della data di rilascio | Data rispettata — i pesi sono usciti il 27 luglio 2026, il giorno annunciato | Per scelta non pubblica alcun peso: non esiste quindi un impegno da rispettare o mancare | |
| Prezzo per milione di token | 3 USD in ingresso / 15 USD in uscita (OpenRouter, 03/08/2026) — circa il 40% sotto la fascia Opus | 5 USD in ingresso / 25 USD in uscita (OpenRouter, 03/08/2026), invariato rispetto a Opus 4.8 | |
| Costo reale del self-hosting | 2.800 miliardi di parametri richiedono oltre 1,5 TB di VRAM prima di qualsiasi cache KV — non entrano in un nodo da 8 B200; servono 8 MI355X o B300 (288 GB ciascuna) oppure 16 B200 su due nodi | Nessuna infrastruttura: nessun acquisto di GPU, nessuno stack di serving, nessun debug dei kernel | |
| Verifica indipendente dei benchmark | Pubblica i risultati delle valutazioni in YAML dentro il repository (GPQA-Diamond 93,5, HLE 56, DeepSWE 67,5, APEX-Agents 41) — sempre dati del produttore, ma riproducibili grazie ai pesi pubblici | Tabelle compilate dal produttore, senza pesi con cui ricalcolarle | |
| Governance dei dati nell'UE | API ospitata in Cina, oppure self-hosting nella Sua regione se ne finanzia l'hardware | Regioni UE tramite Bedrock e Vertex più un'API di conformità — la via più breve a un DPA firmato | |
| Finestra di contesto | 1.048.576 token (OpenRouter, verificato il 03/08/2026) | 1.000.000 token (OpenRouter, verificato il 03/08/2026) | |
| Multimodalità nativa | Visione integrata fin dalla progettazione, non aggiunta a posteriori — il repository fornisce un processore visivo e registra il modello come image-text-to-text | Gli input multimodali sono supportati sulla piattaforma Claude | |
| Punteggio Totale | 3/ 9 | 2/ 9 | 4 pareggi |
Statistiche Chiave
Dati reali da fonti verificate del settore per supportare la tua decisione.
API Hugging Face (riverificata il 3 agosto 2026)
Kimi K3 Licence (fonte primaria, nel repository)
Model card di Kimi K3 e .eval_results nel repository
API OpenRouter models (verificata il 3 agosto 2026)
Wafer, Ian Ye (31 luglio 2026)
Model card di Kimi K3
Tutte le statistiche provengono da fonti terze verificate. Fonte, anno e link diretto sono mostrati su ogni metrica.
Quando Scegliere Ogni Opzione
Una guida chiara basata sulla tua situazione specifica ed esigenze.
Scegli Kimi K3 quando...
- Vuole pesi che può davvero scaricare, ispezionare e bloccare a una versione — esistono, e oltre 800.000 download attestano una filiera reale
- Il Suo utilizzo è interno, il che La colloca al di fuori di entrambe le soglie di licenza
- Il costo delle API è il vincolo determinante e circa il 40% per token basta a decidere
- Dispone già di acceleratori della classe 288 GB, o ne dispone il Suo fornitore: un'installazione da 1,5 TB diventa una questione di approvvigionamento, non un'illusione
Scegli Claude Opus 5 quando...
- Vuole che il modello funzioni senza possedere, affittare o sottoporre a debug uno stack di serving
- È soggetto a regole UE o aziendali sui dati e preferisce regioni europee con API di conformità a un endpoint ospitato in Cina
- È un fornitore di Model-as-a-Service vicino alla soglia dei 20 milioni di USD e non vuole una trattativa di licenza sul percorso critico
- Vuole dichiarazioni di benchmark da un fornitore con supporto contrattuale e non è in condizione di rieseguire le valutazioni in proprio
La Nostra Raccomandazione
La premessa su cui questa pagina era costruita è venuta meno, e vale la pena dire con precisione perché. I pesi di Kimi K3 erano annunciati per il 27 luglio 2026 e sono stati consegnati il 27 luglio 2026, alle 16:29 UTC. Il nostro controllo è partito la stessa mattina alle 03:50 UTC e non ha trovato nulla: esatto in quell'istante, fuorviante già nel pomeriggio. Ne tragga la lezione che contiene: un'affermazione sul fatto che qualcosa esista già ha un'emivita di poche ore e non invecchia fino a cadere in un filtro di obsolescenza — diventa semplicemente falsa, in silenzio. Fatta questa correzione, il confronto premia Kimi K3 più di prima, ma su un terreno diverso. I pesi sono reali, ampiamente adottati e già riquantizzati da Red Hat e Unsloth. Il vantaggio di prezzo regge: 3 / 15 USD contro 5 / 25 USD. Sulla finestra di contesto c'è una vera parità, circa un milione di token per parte. E K3 fa una cosa che Opus non fa: pubblica i risultati delle valutazioni come YAML leggibile dalle macchine accanto a pesi scaricabili, rendendo falsificabili le dichiarazioni del produttore. Nessuno ha ancora pubblicato quel ricalcolo, perciò lo valutiamo come parità e non come vittoria. Ciò che i pesi aperti non fanno è rendere il self-hosting una decisione ordinaria. Con 2.800 miliardi di parametri, K3 richiede oltre 1,5 TB di VRAM prima di qualsiasi cache KV e non entra in un nodo da otto B200. La risposta pratica sono otto schede da 288 GB — e il numero più interessante emerso è che vince la scheda più economica: 8 AMD MI355X hanno reso 48 token al secondo per dollaro di ora-GPU contro i 33 di una B300 che costa circa 2,4 volte di più per GPU. Se finora ha calcolato il self-hosting a prezzi NVIDIA, il Suo modello di costo ha una lacuna concreta. In sintesi: Kimi K3 se l'uso è interno, se il costo per token è vincolante e se hardware della classe 288 GB è disponibile o affittabile. Claude Opus 5 se Le serve governance dei dati nell'UE con API di conformità, se preferisce non gestire uno stack di serving proprio, oppure se è un fornitore di Model-as-a-Service in avvicinamento ai 20 milioni di USD di ricavi — perché a quella soglia la Kimi K3 Licence smette di essere permissiva e diventa una trattativa. I pesi aperti non chiudono la decisione. La spostano dalla disponibilità all'economia e ai termini legali, dove sarebbe dovuta stare fin dall'inizio.
Domande Frequenti
Risposte alle domande comuni su questo confronto.
Hai bisogno di aiuto per decidere?
Prenota una consulenza gratuita di 30 minuti e ti aiuteremo a determinare l'approccio migliore per il tuo progetto specifico.