NVIDIA ha annunciato che la piattaforma Vera Rubin sta entrando in una fase di deployment su scala enorme, con l’obiettivo di arrivare a installazioni da trilioni di parametri e con sistemi già operativi presso diversi provider cloud di primo piano.
Il dato più interessante riguarda l’inferenza AI: nei test basati sul modello DeepSeek R1, la configurazione Vera Rubin NVL72 ha mostrato una throughput di token per megawatt fino a 10 volte superiore rispetto a Blackwell NVL72 a parità di obiettivo di interattività.

Vera Rubin NVL72 entra nella fase di deployment su larga scala
NVIDIA sta accelerando la produzione di Vera Rubin NVL72 e ha già portato la piattaforma all’interno delle infrastrutture di CoreWeave, Google Cloud, Microsoft Azure e Oracle Cloud Infrastructure. Il messaggio è chiaro: non si tratta più di un progetto solo da laboratorio, ma di una piattaforma che si avvicina alla distribuzione concreta nei datacenter.
L’azienda indica anche una base industriale molto ampia, con oltre 350 fabbriche in 30 Paesi, costruita per sostenere una supply chain a livello rack tra le più estese mai messe in campo. Per chi segue il settore AI, questo è un segnale pratico di maturità produttiva oltre che di ambizione tecnologica.
- Produzione di Vera Rubin NVL72 in accelerazione.
- Sistemi già in esecuzione presso CoreWeave, Google Cloud, Microsoft Azure e Oracle Cloud Infrastructure.
- Supply chain rack-scale distribuita su 30 Paesi con oltre 350 fabbriche.
- Focus esplicito su deployment AI di scala molto elevata.
Nei test con DeepSeek R1 l’efficienza inferenziale sale fino a 10 volte
Per misurare il comportamento della nuova piattaforma, NVIDIA ha utilizzato DeepSeek R1, uno dei modelli di ragionamento più citati nella crescita delle applicazioni agentiche. La valutazione si è concentrata sul rapporto tra throughput di token per megawatt e interattività, ciòè la rapidità di risposta percepita da utenti o agenti durante l’elaborazione.
Nel confronto a parità di target di interattività e sullo stesso carico DeepSeek R1, Vera Rubin NVL72 ha raggiunto una throughput di token per megawatt 10 volte superiore rispetto a GB200 NVL72, ciòè la piattaforma Blackwell NVL72 citata nel confronto. In termini pratici, significa più inferenza utile per ogni unità di energia assorbita, un fattore centrale per i grandi cluster AI.
- Benchmark eseguito con il modello di reasoning DeepSeek R1.
- Metrica osservata: throughput di token per megawatt.
- Confronto effettuato mantenendo costante l’obiettivo di interattività.
- Vantaggio dichiarato: 10x rispetto a GB200 NVL72 sullo stesso workload.

