NVIDIA Vera Rubin NVL72

NVIDIA Vera Rubin NVL72: con DeepSeek R1 fino a 10 volte più token per megawatt

NVIDIA ha annunciato che la piattaforma Vera Rubin sta entrando in una fase di deployment su scala enorme, con l’obiettivo di arrivare a installazioni da trilioni di parametri e con sistemi già operativi presso diversi provider cloud di primo piano.

Il dato più interessante riguarda l’inferenza AI: nei test basati sul modello DeepSeek R1, la configurazione Vera Rubin NVL72 ha mostrato una throughput di token per megawatt fino a 10 volte superiore rispetto a Blackwell NVL72 a parità di obiettivo di interattività.

DeepSeek R1 推理 AI 测试:英伟达 Vera Rubin NVL72 每兆瓦 Tokens 吞吐量提升 10 倍

Vera Rubin NVL72 entra nella fase di deployment su larga scala

NVIDIA sta accelerando la produzione di Vera Rubin NVL72 e ha già portato la piattaforma all’interno delle infrastrutture di CoreWeave, Google Cloud, Microsoft Azure e Oracle Cloud Infrastructure. Il messaggio è chiaro: non si tratta più di un progetto solo da laboratorio, ma di una piattaforma che si avvicina alla distribuzione concreta nei datacenter.

L’azienda indica anche una base industriale molto ampia, con oltre 350 fabbriche in 30 Paesi, costruita per sostenere una supply chain a livello rack tra le più estese mai messe in campo. Per chi segue il settore AI, questo è un segnale pratico di maturità produttiva oltre che di ambizione tecnologica.

  • Produzione di Vera Rubin NVL72 in accelerazione.
  • Sistemi già in esecuzione presso CoreWeave, Google Cloud, Microsoft Azure e Oracle Cloud Infrastructure.
  • Supply chain rack-scale distribuita su 30 Paesi con oltre 350 fabbriche.
  • Focus esplicito su deployment AI di scala molto elevata.
Copertura produttiva
30 Paesi
Il passaggio più rilevante è l’ingresso di Vera Rubin NVL72 in ambienti cloud reali, non solo in dimostrazioni tecniche.
CoreWeave ha inoltre comunicato di aver completato a inizio giugno la prima accensione e validazione del settore per un sistema NVIDIA Vera Rubin NVL72, verificando alimentazione, raffreddamento, rete e calcolo in un rack end-to-end.
Dati chiave della piattaforma
Piattaforma
NVIDIA Vera Rubin NVL72
Stato
in produzione accelerata e già operativa presso partner selezionati
Scala dichiarata
deployment verso livelli estremamente elevati

Nei test con DeepSeek R1 l’efficienza inferenziale sale fino a 10 volte

Per misurare il comportamento della nuova piattaforma, NVIDIA ha utilizzato DeepSeek R1, uno dei modelli di ragionamento più citati nella crescita delle applicazioni agentiche. La valutazione si è concentrata sul rapporto tra throughput di token per megawatt e interattività, ciòè la rapidità di risposta percepita da utenti o agenti durante l’elaborazione.

Nel confronto a parità di target di interattività e sullo stesso carico DeepSeek R1, Vera Rubin NVL72 ha raggiunto una throughput di token per megawatt 10 volte superiore rispetto a GB200 NVL72, ciòè la piattaforma Blackwell NVL72 citata nel confronto. In termini pratici, significa più inferenza utile per ogni unità di energia assorbita, un fattore centrale per i grandi cluster AI.

  • Benchmark eseguito con il modello di reasoning DeepSeek R1.
  • Metrica osservata: throughput di token per megawatt.
  • Confronto effettuato mantenendo costante l’obiettivo di interattività.
  • Vantaggio dichiarato: 10x rispetto a GB200 NVL72 sullo stesso workload.
Tipo di test
inferenza AI
Parametro di confronto
token throughput per megawatt
Condizione
stesso carico DeepSeek R1 e stessa interattività target
Il punto forte non è solo la velocità assoluta, ma la quantità di inferenza ottenibile entro lo stesso budget energetico.
Per i datacenter che puntano su modelli di reasoning e agenti AI, questo indicatore può incidere direttamente sul costo operativo e sulla densità di calcolo sostenibile per rack.
Confronto dichiarato nel benchmark
Sistema in test
Vera Rubin NVL72
Sistema di riferimento
GB200 NVL72
Modello usato
DeepSeek R1
Risultato
fino a 10 volte più token per megawatt

Altre notizie da leggere

Condividi con i tuoi amici

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *

Questo sito utilizza Akismet per ridurre lo spam. Scopri come vengono elaborati i dati derivati dai commenti.

Verified by ExactMetrics