Alibaba ha deciso di alzare significativamente la posta nella corsa all’intelligenza artificiale, scalando contemporaneamente tre livelli: modelli, processori proprietari e data center.
Il team di Qwen sta già addestrando Qwen 4, mentre le future versioni Qwen 4.5 e Qwen 5 l’azienda prevede di aumentare fino a 5–10 trilioni di parametri. Per confronto, l’attuale modello di punta Qwen 3.8 Max contiene 2,4 trilioni di parametri. Alibaba intende utilizzare i modelli della prossima generazione per compiti più complessi con un orizzonte di pianificazione più lungo e muoversi gradualmente verso sistemi in grado di operare in modo sempre più autonomo.
L’architettura del futuro Qwen 4 l’azienda sta già testando su modelli sperimentali della famiglia Qwen3.8.
Il numero di parametri di per sé non indica direttamente la qualità del modello. In particolare, il confronto semplice funziona male per le architetture Mixture of Experts, dove durante l’elaborazione di ogni token viene utilizzata solo una parte della rete complessiva. Tuttavia, il passaggio da 2,4 trilioni a un massimo di 10 trilioni aumenta significativamente i requisiti di memoria, interconnessioni e infrastruttura di calcolo.
Per far fronte a tale carico, Alibaba ha presentato il nuovo acceleratore Zhenwu V900, sviluppato dal sottogruppo T-Head. L’azienda afferma che il chip è tre volte più performante del predecessore M890 e supporta la combinazione di fino a 500.000 acceleratori in un unico cluster per l’addestramento e l’esecuzione dei modelli più grandi. La generazione precedente Zhenwu M890 Alibaba l’ha presentata a maggio insieme al sistema server Panjiu AL128 con 128 acceleratori.
Lo Zhenwu V900 dovrebbe entrare in produzione di massa e fornitura commerciale nel primo trimestre del 2027. La possibilità di assemblare un cluster con 500.000 processori rappresenta attualmente il limite superiore dell’architettura, non un sistema esistente di tali dimensioni.
La scala, tuttavia, mostra bene la direzione dell’industria cinese: Huawei ha recentemente rivelato i propri supercluster con centinaia di migliaia di acceleratori e piani per sistemi con circa un milione di processori.
Alibaba sta contemporaneamente espandendo la base energetica per tale hardware. Il CEO della compagnia, Eddy Wu, ha fissato l’obiettivo di aumentare la potenza totale dei data center globali di Alibaba Cloud a più di 20 GW entro il 2032. L’azienda si trova già di fronte a una situazione in cui la domanda di calcolo per l’IA cresce più velocemente delle capacità disponibili, quindi il dispiegamento commerciale dei nuovi supernodi IA dovrebbe iniziare già in questo trimestre. Nel frattempo, i produttori cinesi di acceleratori dipendono sempre più dalla disponibilità di memoria HBM, che si è trasformata in uno dei principali colli di bottiglia del settore.
Alibaba cerca di controllare l’intera catena di produzione in modo autonomo: dall’architettura Qwen e dal design dei processori ai server, alla rete e ai data center cloud. Questo approccio riduce la dipendenza da Nvidia sullo sfondo delle restrizioni all’esportazione americane e permette di ottimizzare i modelli direttamente per il proprio hardware. A maggio, T-Head ha dichiarato di aver fornito ai clienti già oltre 560.000 processori Zhenwu delle generazioni precedenti.
I nuovi piani di Alibaba sono stati presentati il 22 settembre alla conferenza Apsara a Hangzhou. Dopo l’annuncio, le azioni della compagnia a Hong Kong sono aumentate del 5,1%, raggiungendo il massimo di circa un mese. La scala della futura infrastruttura mostra che la prossima fase della competizione per l’IA è sempre più orientata verso la capacità di collegare centinaia di migliaia di acceleratori in un unico sistema di calcolo.
La famiglia Qwen è già riuscita a finire in un episodio politico-tecnologico insolito negli USA. A settembre, un piccolo modello di Alibaba è stato trovato nel sistema di ricerca del Federal Register americano, dopo di che i regimi di ricerca aggiuntivi sono scomparsi dal sito.
Parallelamente, Alibaba ottiene accesso a un enorme mercato di consumatori attraverso partnership. Apple sta preparando per gli utenti cinesi una versione separata di Apple Intelligence, dove le tecnologie Qwen dovrebbero diventare una delle basi dell’infrastruttura IA locale.
La corsa delle compagnie cinesi assomiglia sempre meno a una competizione per il processore più veloce. I produttori compensano le limitazioni all’accesso agli acceleratori avanzati occidentali con i propri chip, interconnessioni complesse e giganti cluster. Se Alibaba si avvicinerà davvero al limite dichiarato di 500.000 Zhenwu V900, l’infrastruttura sarà paragonabile per scala ai progetti di calcolo più ambiziosi della Cina.
Se i modelli di Alibaba riusciranno a raggiungere le prestazioni dei principali modelli di frontiera, l’accesso a AI open-weight sempre più potenti potrebbe diventare la nuova normalità nel mondo dell’intelligenza artificiale. Per le grandi aziende questo scenario potrebbe ridurre sensibilmente la necessità di affidarsi esclusivamente a servizi AI in cloud, spesso più costosi e caratterizzati da maggiori implicazioni sul fronte della privacy, della sovranità dei dati e del controllo delle informazioni.
Modelli avanzati eseguibili direttamente su infrastrutture proprie permetterebbero infatti di mantenere dati e processi critici all’interno dell’organizzazione, con un controllo molto maggiore sull’intera filiera dell’AI.
A questo punto il fenomeno dei grandi laboratori AI che detengono il monopolio dei modelli più performanti cesserà facendo diventare l’AI democratica e non un controllo per pochi eletti.
Carolina Vivianti è consulente/Advisor autonomo in sicurezza informatica con esperienza nel settore tech e security. Ha lavorato come Security Advisor per Ford EU/Ford Motor Company e Vodafone e ha studi presso la Sapienza Università di Roma.
Aree di competenza: Cybersecurity, IT Risk Management, Security Advisory, Threat Analysis, Data Protection, Cloud Security, Compliance & Governance