Tencent presenta Hunyuan 3D 3.0, un tool di generazione 3D basato su AI che punta a ridurre drasticamente tempi e costi della modellazione. La novità principale è un’architettura di raffinamento progressivo che promette modelli più coerenti e dettagliati, con accesso gratuito via piattaforma e API cloud per l’integrazione.
Novità e architettura: 3D‑DiT a raffinamento progressivo
Il cuore dell’aggiornamento è 3D‑DiT, un approccio che costruisce l’oggetto “a strati”: dalle forme base fino ai dettagli fini, evitando gli artefatti tipici dei generatori che producono tutto in un unico passaggio. Secondo l’azienda, la precisione è migliorata di circa 3× rispetto alla versione precedente, con un salto netto nella consistenza geometrica.
– Supporto fino a 36 miliardi di voxel, utile per catturare geometrie complesse.
– Risoluzione massima dichiarata fino a 1536^3, che abilita dettagli più credibili su superfici e silhouette.
– Migliore stabilità tra i passaggi di raffinamento, con riduzione di distorsioni e “wonky shapes”.
In pratica, il pipeline multi‑stadio riduce gli errori cumulativi e consente un controllo più fine del livello di dettaglio, risultando più adatto a scenari di produzione rispetto ai modelli “one‑shot”.

Qualità dei modelli: personaggi, occlusioni e texture
Uno dei punti critici della generazione 3D AI è sempre stato il realismo dei personaggi. Con la 3.0, Tencent dichiara netti progressi su volti, proporzioni e pose:
– Volti e anatomie più coerenti; le pose risultano meno rigide e più naturali.
– Migliore gestione delle occlusioni: il sistema ricostruisce in modo plausibile le parti non visibili, riducendo “buchi” o anatomie impossibili.
– Texture wrapping più preciso: le texture avvolgono correttamente le superfici, con meno artefatti da “pittura” o slittamenti su curvature complesse.
Questi avanzamenti incidono sul lavoro di rigging e animazione, perché riducono la necessità di correzioni manuali su mesh e UV in fase di post‑processing.
Strumenti e workflow: piattaforma, API e studio avanzato
Il servizio è disponibile gratuitamente via piattaforma Hunyuan 3D e offre un’API cloud per sviluppatori che desiderano integrarlo nei propri toolchain. Per i professionisti, Tencent sta testando Hunyuan 3D Studio, una suite che copre il flusso di produzione completo, inclusi UV mapping e rigging. La suite è attualmente in accesso su invito.
– Piattaforma: accesso gratuito per creare modelli e sperimentare prompt e parametri.
– Cloud API: integrazione server‑side in pipeline esistenti, utile per studi e tool proprietari.
– Hunyuan 3D Studio (beta, su invito): ambiente end‑to‑end per preparazione asset a uso produttivo.
Prezzo e disponibilità
– Accesso alla piattaforma: gratuito.
– Cloud API: disponibile per integrazione (termini e quote d’uso da verificare sulla piattaforma).
– Hunyuan 3D Studio: in test, su invito; è possibile fare richiesta di accesso.
Per l’utilizzo commerciale degli asset generati, è consigliabile verificare le condizioni d’uso e le licenze della piattaforma.
Apertura del codice: Hunyuan 3D Omni
Tencent annuncia l’intenzione di open‑source una variante chiamata Hunyuan 3D Omni, orientata a una maggiore controllabilità del processo di generazione. L’apertura del codice può favorire audit, riproducibilità e adozione in ambito enterprise e accademico. Tempistiche e portata della release non sono state dettagliate.

Prodotti correlati: Baidu PP‑OCRv5 ed Ernie X1.1
PP‑OCRv5 (OCR compatto)
Baidu ha rilasciato PP‑OCRv5, un modello OCR compatto che, secondo i benchmark citati dall’azienda, supera rivali più grandi in accuratezza. Il focus è l’efficienza, utile per dispositivi edge o scenari a risorse limitate. I test non sono stati qui verificati in modo indipendente.
Ernie X1.1 (ragionamento profondo)
La stessa Baidu ha presentato Ernie X1.1, definito un modello di “deep thinking” che, a detta dell’azienda, supera DeepSeek R1 in compiti di ragionamento e comprensione. Anche in questo caso, i risultati dipendono dai benchmark scelti e restano da corroborare con valutazioni terze.
Confronto: 3D generativo vs OCR e ragionamento
Le novità di Tencent e Baidu si collocano in domini diversi: generazione 3D da un lato, OCR e ragionamento dall’altro. Il filo conduttore è l’efficienza: Hunyuan 3D 3.0 promette qualità superiore senza costi di licenza; PP‑OCRv5 punta a battere modelli più grandi con meno risorse; Ernie X1.1 cerca un primato nel reasoning. Nel complesso, il quadro conferma la spinta dell’ecosistema cinese su strumenti pratici e orientati alla produzione.
Hunyuan 3D 3.0 si posiziona come una proposta forte per studi indie, team di game dev e creator che necessitano di asset credibili senza budget elevati. L’insieme di 3D‑DiT, supporto a 36 miliardi di voxel e risoluzione 1536^3, unito all’accesso gratuito e all’API cloud, alza l’asticella nella generazione 3D. Restano da valutare capacità e limiti in scenari complessi (tempi di generazione, gestione di topologie pulite per pipeline AAA, policy d’uso commerciale), ma l’annunciata versione open‑source potrebbe accelerare adozione e trasparenza. In un mercato dove molti strumenti sono ancora sperimentali o costosi, l’offerta di Tencent appare competitiva e concretamente orientata all’uso reale.

