Tencent avrebbe accolto nel team Hunyuan l’ex ricercatore OpenAI Yonglong Tian, nome ben noto nell’ambito della computer vision e dei modelli generativi. L’indiscrezione lo indica come possibile nuovo riferimento per la direzione multimodale della piattaforma AI del gruppo.
La nomina non sarebbe ancora definitiva, ma il segnale è chiaro: Tencent continua a rafforzare Hunyuan con profili di alto livello, puntando in particolare su VLM e modelli che combinano immagini e linguaggio. È una mossa che pesa soprattutto per il profilo tecnico del ricercatore e per il momento in cui arriva.

Tencent accelera su Hunyuan multimodale con un profilo arrivato da OpenAI
Yonglong Tian avrebbe recentemente lasciato OpenAI per unirsi a Tencent, dove andrebbe a riportare al chief AI scientist Yao Shunyu. Il suo possibile incarico riguarda il filone multimodale di Hunyuan, con coinvolgimento nelle attività di ricerca e sviluppo legate ai modelli visione-linguaggio.
Se l’ingresso verrà confermato in modo definitivo, si tratterà di un altro passaggio rilevante da OpenAI a Tencent dopo quello di Yao Shunyu. I due hanno già lavorato nello stesso periodo nel team di ricerca di OpenAI, seguendo da vicino l’evoluzione dei modelli GPT e delle tecnologie multimodali.
- Possibile ruolo di riferimento per Hunyuan multimodale.
- Riporto diretto al chief AI scientist Yao Shunyu.
- Coinvolgimento atteso nei modelli VLM, ciòè visione e linguaggio.
- La nomina viene descritta come non ancora completamente finalizzata.
Chi è Yonglong Tian e perché il suo curriculum conta nella corsa ai modelli visivi
Il percorso accademico di Yonglong Tian parte da Tsinghua University, prosegue con un master di ricerca alla Chinese University of Hong Kong e arriva al dottorato al MIT, concluso nel 2022 sotto la guida di Phillip Isola. Nel tempo il suo focus si è spostato dalla visione artificiale classica verso i modelli generativi e il representation learning.
Dopo il dottorato è entrato in Google Research come senior research scientist, per poi passare a Google DeepMind nel 2024 e successivamente a OpenAI come member of technical staff. Nel suo lavoro recente si è concentrato su visione artificiale, apprendimento delle rappresentazioni visive e modelli generativi.
- La sua ricerca più influente è Supervised Contrastive Learning, oggi molto citata nella computer vision.
- Ha contribuito anche a Fluid 10.5B, progetto su modelli autoregressivi text-to-image scalabili.
- Tra i temi seguiti: qualità della rappresentazione visiva, generazione di immagini e training con dati sintetici.
- Il suo profilo unisce esperienza accademica forte e passaggi in Google, DeepMind e OpenAI.
La riorganizzazione di Tencent mostra una spinta più decisa sui modelli multimodali
L’arrivo di Tian si inserisce in una fase di riassetto più ampia. Dopo l’uscita di Liu Wei, che in precedenza seguiva il coordinamento multimodale di Hunyuan, la responsabilità del settore era passata temporaneamente a Jiang Jie, vicepresidente di Tencent.
Nel 2025 Tencent ha poi formalizzato all’interno della divisione tecnica TEG due dipartimenti distinti, uno per i grandi modelli linguistici e uno per i modelli multimodali. L’obiettivo è rendere meno frammentata la struttura e concentrare meglio risorse e responsabilità.
- A fine 2024 è uscito Liu Wei, ex figura chiave del coordinamento multimodale.
- Nel 2025 Tencent ha creato reparti separati per LLM e multimodale.
- Nei mesi successivi sono arrivati altri ricercatori di alto profilo da laboratori e aziende del settore.
- La direzione è chiara: meno struttura virtuale, più organizzazione dedicata e competenze verticali.

