L'opzione da 512 GB che in una notte ha perso 17.000 $ — e cosa ti insegna per il tuo prossimo Mac
Il 25 agosto 2026, Apple ha presentato l'M5 Ultra. La configurazione da 512 GB? Arriva solo a fine ottobre. Quattro giorni dopo, il prezzo dell'usato di una macchina considerata un pezzo da collezione inaccessibile è crollato da 20.000 $ a 3.000 $. Non perché l'hardware fosse peggiorato, ma perché la scarsità che ne sosteneva il prezzo era svanita.
Questa storia non è un aneddoto sul calo dei prezzi. È la dimostrazione più chiara di una regola che nel 2026 dovrebbe guidare ogni decisione di acquisto hardware: Non compri potenza di calcolo. Compri un'opzione sulla scarsità — e una sola capacità decide se vale la pena: tenere il modello che vuoi davvero far girare.
Il trucco del moltiplicatore 4× studiato per ingannarti
Apple pubblicizza l'M5 Ultra con prestazioni IA «fino a 4,3× più veloci». Non è una bugia — ma è un numero che misura il momento sbagliato. Il team ML di Apple lo ha misurato in «Exploring LLMs with MLX and the Neural Accelerators in the M5 GPU»:
| Operazione | Accelerazione | Scala con |
|---|---|---|
| Elaborazione del prompt (prefill) | fino a 4,06× (3,33–4,06×) | Potenza di calcolo |
| Generazione (decode) | solo 1,19–1,27× (+19–27%) | Larghezza di banda di memoria |
La cifra 4× descrive il momento prima del primo token. Non dice nulla su quanto velocemente il modello scriva in seguito — ed è esattamente ciò che avverti nell'uso quotidiano.
L'elaborazione del prompt scala con il calcolo. La generazione scala con la banda.
Per questo la domanda vera non è «quanti TFLOPS?» ma: «Qual è il mio collo di bottiglia — e quale modello voglio tenere?»
L'unico numero che conta davvero: la banda
La banda determina tutto ciò che senti durante la generazione. Ed è qui che la generazione M5 cambia davvero qualcosa:
| Chip | Banda | Classe |
|---|---|---|
| Mac mini M6 | 170 GB/s | Entry level |
| M5 Pro | 307 GB/s | Solido 27B/32B |
| M5 Max | 614 GB/s | Vicino alla frontiera |
| M5 Ultra | 1.200 GB/s | L'unico salto di classe |
Da M4 Max (546 GB/s) a M5 Max (614 GB/s) si parla di +12% — stessa lega, nuovo involucro. Da M5 Max a M5 Ultra si parla di +95% — un vero salto di classe. Se stai scegliendo tra M5 Pro e M5 Max, stai comprando due volte la stessa lega. Passa all'M5 Ultra e cambi lega.
La memoria unificata è al contempo una funzionalità e una tassa. macOS riserva 8–12 GB prima ancora che il modello si carichi. Ogni scheda del browser, ogni strumento dello spazio utente attinge dallo stesso pool. Quando leggi «64 GB», dovresti leggere «~54 GB per il modello».
La crisi della DRAM come macchina dei prezzi
Perché i prezzi esplodono? Perché nel 2026 la memoria è la risorsa più scarsa dell'industria tech. Tim Cook l'ha definita una crisi da «alluvione centenaria». I numeri:
- Modulo di memoria di iPhone 17 Pro: da ~25–29 $ a ~70 $ (+230%)
- Previsione Gartner 2026: DRAM +125%, NAND +234% nell'arco dell'anno
- Micron: HBM esaurita per il 2026, copre solo il 50–66% della domanda
- Dimensione del mercato: da ~220 mld $ (2025) a ~890 mld $ (fine 2026) — l'inferenza IA si sta mangiando la differenza
Non è un problema di capacità, ma un problema di allocazione: i fab stanno migrando verso i chip HBM a margini più alti. Esattamente la stessa forza che sta facendo salire i prezzi dei box GB10 ha colpito l'opzione da 512 GB.
La collisione da 50 dollari
E poi c'è il calcolo che nessuno ha sul radar: un M5 Ultra con 256 GB/1 TB costa 9.499 $. Due bundle DGX Spark insieme costano 9.449 $ — una differenza di 50 dollari.
Ma 2×128 GB non è 1×256 GB. Due nodi Spark suddividono il lavoro: un token 70B richiede 269 ms attraverso il ponte di rete, o 133 ms con due nodi — in cambio di due sistemi operativi, due interfacce di rete e la latenza dell'interconnessione. Un Mac da 256 GB tiene il modello in un unico pool di memoria.
2×128 ≠ 1×256.
La lezione
Se un anno fa hai pagato 20.000 $ per una macchina da 512 GB, non stavi comprando potenza. Stavi comprando un'opzione sulla scarsità. Apple ha chiuso quell'opzione a marzo, l'ha riaperta ad agosto — e il valore della vecchia opzione è evaporato. L'hardware è rimasto esattamente identico. È il premio a essere morto.
Prima di comprare ora, rispondi a tre domande:
- Quale modello voglio davvero tenere? — la scala delle capacità, non i sogni a occhi aperti.
- Leggo di più o scrivo di più? — il prefill è dominato dal calcolo, il decode dalla banda.
- Posso suddividere il mio carico di lavoro? — se sì, 2× Spark può essere il calcolo più furbo; se no, vince il pool di memoria.
Compra per il tuo collo di bottiglia, non per il numero di marketing. Non è il nome del chip a decidere — ma l'unica capacità che conta: tenere il modello che vuoi far girare.
FAQ
Perché il numero 4× di Apple è fuorviante anche se è corretto? Quel numero misura l'elaborazione del prompt (tempo al primo token), che scala con la potenza di calcolo. La generazione — ciò che senti davvero mentre scrivi — scala con la banda di memoria e migliora solo del 19–27%. Apple non mente; il numero misura solo il momento prima del primo token, non l'esperienza di scrittura successiva. Se ti basi sul 4×, stai misurando il collo di bottiglia sbagliato.
Perché 512 GB di memoria unificata è così speciale? Perché è l'unico modo per tenere un modello di classe 700B su una singola macchina. 256 GB coprono la classe 300B, ma Kimi K3 (2.800 miliardi di parametri) non ci sta nemmeno in 512 GB — il tetto è reale. La memoria è quindi il collo di bottiglia decisivo, non il calcolo. È esattamente per questo che la dimensione della RAM determina quale classe di modello puoi realisticamente far girare.
L'M5 Ultra vale il sovrapprezzo rispetto all'M5 Max? Solo se vuoi davvero spingere la classe 700B o contesti molto lunghi. Il salto di banda da 614 a 1.200 GB/s (+95%) è l'unico vero salto di classe di questa generazione — tutto ciò che sta sotto è la stessa lega. Per un carico di puro decode su modelli 70B, l'M5 Max 128 GB è la scelta più sensata. Il sovrapprezzo si giustifica solo se ti servono davvero la capacità o la banda.
Quando ha senso 2× DGX Spark invece di 1× M5 Ultra? Quando il tuo carico di lavoro è naturalmente suddivisibile: cluster CUDA, più lavori paralleli dove la latenza di interconnessione è sopportabile. Con 50 dollari di differenza, è una questione di architettura, non di budget. Un singolo token 70B costa 269 ms attraverso il ponte di rete — o 133 ms con la suddivisione, ma con due sistemi operativi. Se invece vuoi tenere un unico grande modello in un pool di memoria, vince l'M5 Ultra.
Cosa c'entra la crisi della DRAM con il mio acquisto? È la macchina dei prezzi dietro tutto questo. Con la DRAM a +125% e la NAND a +234% nell'anno, il costo di ogni bit di memoria sale — e la scarsità è una questione di allocazione, non di capacità. I fab stanno migrando verso i chip HBM a margini più alti, quindi la DRAM di fascia bassa resta tesa. Se compri ora, tratta la memoria come la parte più costosa e più scarsa della macchina e dai priorità alla dimensione della RAM.
Devo comprare ora o aspettare la versione da 512 GB? Dipende dal tuo collo di bottiglia: se punti alla classe 700B, vale la pena aspettare la configurazione da 512 GB (fine ottobre). Per la maggior parte dei casi d'uso (fino alla classe 300B), la versione da 256 GB è la scelta giusta. Se hai carichi suddivisibili, puoi partire già oggi con 2× Spark. La crisi della DRAM rende la memoria costosa — ma la rende anche esattamente ciò che conta davvero.
Fonti
- Apple ML Research: «Exploring LLMs with MLX and the Neural Accelerators in the M5 GPU» (machinelearning.apple.com)
- Apple Newsroom, 25.08.2026: annuncio M5 Max/M5 Ultra, «up to 4.3x faster AI performance»
- Specifiche prodotto Apple: bande, configurazioni di memoria unificata
- Previsione Gartner DRAM/NAND 2026 · esaurimento HBM di Micron · dichiarazioni di Tim Cook sulla memoria (luglio 2026)
- Ars Technica / Tom's Hardware (marzo 2026: opzione da 512 GB rimossa)
- wccftech / OnMSFT / Macfax / MacRumors (mercato dell'usato M3 Ultra 512 GB)
- ComputerBase (misurazioni indipendenti DGX Spark) · forum NVIDIA / heise / overclock3d (andamento prezzi GB10)
- Yume_X (29.08.2026, osservazione prezzi) · verifica propria 31.08.2026