NVIDIA ha annunciato una nuova versione di DGX Spark, il suo desktop AI pensato per lo sviluppo locale di modelli e agenti, introducendo il taglio con 64 GB di memoria.
L’obiettivo è portare attività come prototipazione, inferenza locale e piccoli cicli di fine-tuning direttamente sulla scrivania, riducendo il ricorso costante al cloud. È un tema sempre più rilevante per chi lavora con modelli open source di grandi dimensioni, dove costi operativi, latenza e gestione dei dati stanno diventando fattori decisivi.
DGX Spark 64 GB punta sullo sviluppo locale di modelli e agenti
La nuova configurazione si basa sul chip supercomputing GB10 Grace-Blackwell e adotta un’architettura di memoria unificata che mette in comunicazione CPU e GPU nello stesso spazio. Nel modello da 64 GB, circa 8 GB sono riservati al sistema, mentre il resto può essere sfruttato per pesi del modello e cache KV, con circa 56 GB effettivamente disponibili per i carichi AI.
NVIDIA indica il supporto al formato di quantizzazione NVFP4 e cita la possibilità di eseguire in locale diversi modelli open source oggi molto usati, tra cui Gemma4 26B, Qwen3.8-27B, Meta Muse Glimmer e Nemotron3.5 Lightning. Il punto interessante è che, una volta caricato il modello, resta ancora margine per gestire contesti lunghi in inferenza, un aspetto importante per gli agenti AI e per i workflow complessi.
Prezzi, disponibilità e supporto multi nodo completano il posizionamento
La nuova versione da 64 GB sarà in vendita dal 23 ottobre, mentre NVIDIA ha aggiornato anche il listino della variante 128 GB FE, ora proposta a 6.950 dollari, circa 5.900 euro. Per la distribuzione sono previsti diversi produttori partner, tra cui Acer, Dell, Asus, Gigabyte, MSI e H3C, un dettaglio utile perché amplia le opzioni di configurazione e acquisto della piattaforma.
Uno degli elementi più interessanti è la possibilità di creare piccoli cluster desktop. DGX Spark integra una scheda di rete ConnectX-7 e può sfruttare il pacchetto NVIDIA Sync con assistente dedicato alla configurazione, così da collegare fino a quattro unità senza dover gestire manualmente tutta la parte di rete e ambiente SSH.
L’ecosistema software resta il vero valore della piattaforma
Sul piano pratico, DGX Spark arriva con lo stack AI accelerato CUDA e con una compatibilità dichiarata con strumenti come vLLM e llama. cpp, oltre a ottimizzazioni specifiche per i flussi di lavoro degli agenti locali. NVIDIA parla di velocità fino a 1,9 volte superiori in alcuni scenari di inferenza per agenti eseguiti in locale, mentre Perplexity ha già adattato il proprio software alla macchina.
Il quadro che emerge è quello di un prodotto pensato non per l’utente consumer, ma per ricercatori, sviluppatori indipendenti e piccoli team che vogliono una base locale seria per test, prototipi e inferenza continuativa.





