The Pulse
Alibaba punta a un modello Qwen da 10 trilioni di parametri con un nuovo chip
Alibaba afferma che la roadmap di Qwen 4.5 e Qwen 5 potrebbe arrivare a 5-10 trilioni di parametri. L’azienda ha inoltre presentato il processore per l’IA Zhenwu V900 e prevede di portare la capacità globale dei data center di Alibaba Cloud

AI.info Team ·
«Il tema della conferenza Apsara di quest’anno è “L’intelligenza va oltre”.»
Joe Tsai, presidente di Alibaba Group
Alibaba ha delineato un piano per addestrare modelli diverse volte più grandi dei sistemi più grandi che abbia mai presentato, sviluppando al contempo un proprio processore e un’infrastruttura cloud per supportarli. Alla conferenza Apsara, tenutasi a Hangzhou il 22 settembre, l’azienda ha dichiarato che le future serie di modelli Qwen 4.5 e Qwen 5 potrebbero arrivare a una scala compresa tra 5 e 10 trilioni di parametri.
Alibaba ha dichiarato che Qwen 4 è già in fase di addestramento. Le cifre più alte fanno parte della roadmap futura dell’azienda, non si riferiscono a un modello disponibile oggi. L’annuncio riunisce sviluppo dei modelli, progettazione di semiconduttori ed espansione dei data center in un unico programma, offrendo ad Alibaba un modo per ridurre la dipendenza da hardware esterno mentre punta a cicli di addestramento più ampi e a un’inferenza meno costosa.
Qwen 4 avvia il prossimo ciclo di addestramento
L’azienda non ha indicato una data di uscita per Qwen 4 né ha specificato se l’intervallo da 5 a 10 trilioni si riferisca a un modello denso, a un sistema mixture-of-experts o a entrambi. Alibaba ha descritto queste cifre come la scala prevista per le serie Qwen 4.5 e Qwen 5, presentando quindi una roadmap anziché il lancio di un prodotto.
Alibaba ha inoltre messo in evidenza il lavoro sul miglioramento ricorsivo autonomo. Ha dichiarato che Qwen3.8-Max ha completato 33 cicli di miglioramento automatizzati nell’arco di oltre un mese, che hanno riguardato la progettazione della pipeline, la convalida dei dati, gli esperimenti e la diagnosi degli errori. Secondo l’azienda, il punteggio del modello aggiornato su Artificial Analysis è salito da 40 a 45.
In un esperimento separato di progettazione di chip, Alibaba ha dichiarato che un modello ha lavorato per oltre 60 ore lungo l’intero ciclo di progettazione e ha effettuato più di 10.000 chiamate a strumenti di automazione della progettazione elettronica. Secondo l’azienda, i moduli bus del chip risultante hanno ridotto l’area del 42% senza cali di prestazioni. Alibaba ha presentato il risultato come prova del fatto che i suoi modelli possono assistere in alcune fasi dello sviluppo hardware, oltre a operare sui sistemi completati.
Zhenwu V900 aggiunge memoria alla piattaforma di Alibaba
T-Head, l’unità di progettazione dei chip di Alibaba, ha presentato Zhenwu V900 per l’addestramento e l’inferenza dell’IA. Alibaba afferma che il processore offre prestazioni tre volte superiori a quelle di Zhenwu M890, lanciato a maggio, e dispone di 216 gigabyte di memoria GPU e di una larghezza di banda tra chip di 1.200 gigabyte al secondo.
V900 supporta i formati di dati FP8 e FP4, oltre ai carichi di lavoro a precisione più elevata. Queste specifiche sono importanti perché i modelli di grandi dimensioni devono distribuire i calcoli su molti acceleratori, mentre chi gestisce l’inferenza spesso sacrifica la precisione numerica per ridurre i costi e accelerare i tempi di risposta. Alibaba afferma che il chip è destinato sia ai carichi di addestramento più impegnativi sia all’inferenza a precisione ridotta.
La produzione di massa e il lancio commerciale sono previsti per il primo trimestre del 2027. L’azienda afferma che i suoi chip Zhenwu sono già utilizzati da oltre 650 clienti in settori tra cui automobili, finanza, modelli linguistici di grandi dimensioni, intelligenza incarnata, energia e manifattura.
Alibaba ha inoltre mostrato un server supernodo che combina V900 con ICN Switch, Panmai SmartNIC e il controller SSD Zhenyue. Secondo l’azienda, il sistema è progettato per supportare cluster fino a 500.000 schede. Questa cifra descrive la scala dell’architettura prevista, non una distribuzione produttiva già annunciata.
20 gigawatt di capacità cloud entro il 2032
I piani hardware di Alibaba si inseriscono in un’espansione più ampia di Alibaba Cloud. L’amministratore delegato Eddie Wu ha dichiarato che l’azienda punta a gestire oltre 20 gigawatt di capacità globale nei data center entro il 2032, un obiettivo pensato per soddisfare la crescente domanda di addestramento dei modelli e di servizi di IA.
«Alla luce di questo, il nostro obiettivo è che entro il 2032 la capacità globale dei data center gestiti da Alibaba Cloud superi i 20 GW, per alimentare la domanda di IA in rapida crescita esponenziale nel settore», ha dichiarato Wu nell’annuncio dell’azienda.
Nel comunicato, Alibaba non ha associato una cifra di spesa al nuovo obiettivo di 20 gigawatt. Il piano indica comunque la scala fisica necessaria per la roadmap di Qwen: i modelli più grandi richiedono più acceleratori, connessioni più veloci tra loro, archiviazione ad alto throughput e una quantità sufficiente di elettricità e raffreddamento per mantenere i sistemi in funzione alla massima capacità.
Alibaba abbina i chip a una piattaforma per agenti
Gli annunci dell’azienda vanno oltre l’addestramento dei modelli. Alibaba Cloud ha presentato un’architettura cloud agentica basata su infrastruttura per i modelli, implementazione di agenti aziendali e servizi di contesto. La piattaforma AgentCore è progettata per aiutare le aziende a creare, gestire e monitorare agenti di IA, mentre Agent Context collega documenti, sistemi aziendali, registrazioni delle chat e dati multimodali per l’uso in tempo reale e la memoria a lungo termine.
Alibaba ha dichiarato che il suo servizio di contesto può ridurre l’uso di token fino al 67% negli scenari di assistenza clienti, programmazione e analisi dei dati. Ha inoltre affermato che l’architettura lakehouse OpenLake aggiornata riduce i costi complessivi del 38% e i tempi di risposta alle query del 40% rispetto alle architetture tradizionali. Si tratta di dati dichiarati dall’azienda e riferiti ai sistemi di Alibaba; il comunicato non fornisce dettagli indipendenti sui benchmark.
Il prodotto hardware nell’immediato è V900, ma la scommessa strategica più ampia riguarda il collegamento tra i chip di Alibaba, i sistemi cloud, i modelli Qwen e le applicazioni aziendali. Qwen 4 è già in fase di addestramento, mentre l’obiettivo da 5 a 10 trilioni di parametri riguarda le generazioni successive di Qwen. Il lancio commerciale di V900 è previsto solo per il primo trimestre del 2027: i piani più ambiziosi di Alibaba per i modelli dipendono quindi da un’infrastruttura ancora in fase di preparazione.