Il supernode Lingjun Zhenwu M890 di Alibaba Cloud è entrato in servizio commerciale il 12 agosto presso il sito dell’azienda a Ulanqab, in Mongolia Interna — presentato come la prima architettura in Cina a servire modelli linguistici oltre i 2 trilioni di parametri.

La rivendicazione tecnica

L’M890 amplia il dominio di scale-up da 16 schede a 64 utilizzando un chip di interconnessione proprietario, ICNSwitch 1.0, con 800 GB/s tra le schede e supporto per FP8 e FP4. Alibaba lo classifica per l’inferenza mixture-of-experts su modelli fino a 10 trilioni di parametri e sostiene prestazioni di training tre volte superiori rispetto alla Zhenwu 810E di precedente generazione.

Cosa ci gira sopra

Kimi K3 e Qwen3.8-Max sono già erogati dal sistema. Poiché viene venduto come istanza cloud e non come hardware, i clienti possono accedere a modelli di queste dimensioni senza costruire un proprio data center AI — ed è questo il punto commerciale del lancio.

Presentato prima, ora in servizio

L’M890 era stato mostrato al WAIC in precedenza. L’evento del 12 agosto segna la disponibilità generale, quindi la formulazione corretta è che sia entrato in servizio, non che sia stato annunciato.

La domanda a cui Alibaba non ha risposto

Il componente domestico confermato è l’interconnessione. Alibaba non ha reso noto quali acceleratori si trovino dietro ICNSwitch, quindi le affermazioni secondo cui si tratterebbe di uno stack interamente domestico non sono supportate. Dato che i controlli sulle esportazioni sono l’intero sottotesto, quell’omissione è il dettaglio più informativo dell’annuncio.

Da dove arrivano i numeri

Tutti i dati sulle prestazioni qui riportati sono dichiarati dal fornitore, senza benchmark di terze parti. La copertura dei media statali ha affiancato una cornice di autosufficienza e commenti favorevoli di analisti; si tratta di un posizionamento editoriale attorno al lancio di un prodotto, non di una sua verifica indipendente.