Google sta lavorando a Frozen v2, un nuovo chip server dedicato all’intelligenza artificiale pensato per rendere più efficiente l’esecuzione dei modelli Gemini. L’idea alla base è piuttosto chiara: spostare direttamente nel silicio parte dell’architettura di calcolo del modello, così da ridurre consumi e latenza durante l’inferenza.
Il progetto nasce anche per rispondere a un problema concreto di capacità computazionale interna. Con Frozen v2, Google punta a ottenere prestazioni per watt da 6 a 10 volte superiori rispetto agli attuali chip AI proprietari, con una possibile prima distribuzione non prima del 2028.
Frozen v2 punta su un design specializzato per Gemini
Frozen v2 non sarà un chip general purpose come una GPU Nvidia o come gli attuali TPU usati in più contesti, ma una soluzione costruita attorno alla famiglia Gemini. Il principio è quello di incidere in hardware la logica di base del modello, eliminando una parte delle decisioni e dei passaggi che i chip più generici devono gestire in tempo reale.
Questo approccio può ridurre in modo sensibile sia il numero di operazioni sia il volume di dati da spostare durante l’inferenza. Il risultato atteso è una risposta più rapida alle richieste degli utenti e un miglior rapporto tra consumi energetici e lavoro svolto, due aspetti centrali per chi deve far girare modelli AI su larga scala.
- Frozen v2 è un chip server dedicato all’AI progettato specificamente per Gemini.
- L’obiettivo è abbassare consumi e latenza nelle attività di inferenza.
- Le prestazioni per watt attese sono da 6 a 10 volte superiori rispetto agli attuali chip AI proprietari di Google.
- Il chip non sostituirà i TPU, ma aprirà una linea di prodotto complementare.
Per Google il nodo è la carenza di potenza di calcolo
Il progetto prende forma in un momento in cui Google sta affrontando una forte pressione sulla disponibilità di risorse AI. La carenza interna di capacità avrebbe già inciso anche sull’attività cloud, al punto da limitare la possibilità di accettare alcuni ordini esterni.
In questo contesto, Frozen v2 viene considerato come una risposta strutturale al collo di bottiglia computazionale. L’orizzonte temporale, però, resta lungo: la prima implementazione è prevista non prima del 2028, segno che il chip è ancora in una fase di definizione tecnica importante.
- Il progetto nasce per affrontare la scarsità di risorse di calcolo AI.
- Le tensioni sulla capacità disponibile hanno avuto impatto anche sul business cloud.
- La prima distribuzione del chip è attesa dal 2028 in poi.
Il nuovo approccio evita il limite che aveva bloccato la prima versione
Google aveva già tentato in passato di portare il modello direttamente nel chip con una prima idea di Frozen guidata da Jeff Dean. In quel caso l’obiettivo era incidere direttamente nel silicio l’intero insieme dei pesi del modello, ma il risultato sarebbe stato un hardware vincolato a una sola versione di Gemini, con un ciclo di vita troppo breve per essere davvero pratico.
Frozen v2 cambia impostazione: non fissa più i pesi completi del modello, ma solo la sua architettura di base, lasciando margine per aggiornare i pesi interni nel tempo. È una scelta più equilibrata, anche se comporta una scommessa precisa: le future evoluzioni di Gemini dovranno continuare a usare una struttura di fondo compatibile con quella prevista oggi dal chip.
- La prima idea di Frozen puntava a scrivere in hardware anche i pesi del modello.
- Quel design era troppo rigido, perché compatibile con una sola versione di Gemini.
- Frozen v2 mantiene aggiornabili i pesi, ma congela la logica architetturale di base.
- Il team sta ancora definendo moduli principali e livello di specializzazione ottimale.


[…] Chinasmartbuy.com […]