Shanghai ha risposto alla domanda evitata a luglio

Il 3 agosto Alibaba ha lanciato Qwen3.8-Max, il modello presentato il 19 luglio alla World AI Conference di Shanghai senza i numeri che contavano. La specifica è ora pubblica: 2.400 miliardi di parametri totali, 95 miliardi dei quali attivi durante l'inferenza, costruito sull'architettura Qwen 3.5 e capace di trattare testo, immagini, video e documenti in un unico sistema. Il titolo quotato a Hong Kong è salito di circa il 6 per cento a 124,00 dollari di Hong Kong nelle prime ore di contrattazione.

L'azienda si è anche impegnata sul punto che a luglio non aveva voluto datare. I pesi saranno pubblicati in forma aperta la prossima settimana, il che ne farebbe il primo modello Max di Qwen che chiunque può scaricare ed eseguire su hardware proprio. Per un'impresa europea che osserva i modelli cinesi proprio perché i pesi aperti consentono di ospitare, ispezionare e uscire, è questa la parte dell'annuncio che ha conseguenze.

I 95 miliardi attivi sono la vera buona notizia

Perché conta: il tasso di attivazione è ciò che trasforma un numero di parametri in una fattura. Qwen3.8-Max impegna circa il 4 per cento della propria rete a ogni richiesta, quindi il calcolo consumato per interrogazione somiglia più a un modello da 95 miliardi di parametri che a uno da 2.400 miliardi. Alibaba colloca i costi di inferenza sotto quelli della generazione precedente e, per una volta, l'architettura divulgata sostiene l'affermazione invece di offuscarla.

È esattamente la cifra che mancava all'anteprima di luglio ed è arrivata dal lato favorevole. Per chi acquista token tramite un'interfaccia, la lettura pratica è che un modello promosso con 2.400 miliardi di parametri non deve essere prezzato come tale. L'anteprima resta al 10 per cento della tariffa standard tramite Token Plan, Qoder e QoderWork, e il precedente Qwen3.7-Max è a listino a 2,50 dollari per milione di token in ingresso e 7,50 per milione in uscita, circa 2,30 e 6,90 euro. Giudicate ogni offerta su quel listino, mai sul prezzo promozionale.

Poi contate la memoria, non i parametri

Il numero che nessuno ha messo in un titolo: tenere 2.400 miliardi di parametri richiede circa 2,4 terabyte di memoria a precisione 8 bit e circa 1,2 terabyte se quantizzate a 4 bit accettando la perdita di qualità. Un server con otto processori grafici H200 offre in tutto circa 1,1 terabyte di memoria ad alta velocità. Pesi aperti di questa dimensione non significano dunque un server. Significano almeno due nodi completi a 8 bit, oppure un incastro stretto su un nodo dopo una quantizzazione aggressiva, prima ancora di destinare un solo byte alla cache chiave-valore che serve davvero gli utenti simultanei.

Tutto questo cade nel mese peggiore possibile. La memoria è oggi l'input più scarso del settore: circa il 70 per cento della fornitura dell'anno prossimo è già impegnato, i prezzi contrattuali di DRAM e HBM sono saliti per tutto il trimestre e la stretta arriva tanto in basso che Apple non riesce a tenere a magazzino un portatile d'ingresso e dirotta gli acquirenti su uno più caro. La libertà concessa dai pesi aperti è reale e per la maggior parte degli operatori europei è oggi teorica. Vi consegnano le chiavi di un edificio di cui non potete affittare la superficie.

L'affermazione sui benchmark resta Alibaba che misura Alibaba

Alibaba sostiene che il modello sia complessivamente competitivo con i principali sistemi statunitensi, che li superi in diversi test di programmazione, multimodalità e ingegneria e che resti indietro in alcune prove di ragionamento generale, e ancora una volta si colloca appena dietro il Fable 5 di Anthropic. Ognuna di quelle posizioni proviene dal materiale di lancio della stessa Alibaba. Nessuna classifica indipendente ha finora valutato Qwen3.8-Max, esattamente come per l'anteprima di luglio.

Sì, ma: l'apertura dei pesi cambia il peso di quella riserva invece di cancellarla. Quando i pesi sono pubblici, la valutazione indipendente smette di dipendere dalla benevolenza del fornitore o dall'accesso all'interfaccia, e un'affermazione di classifica diventa confutabile in pochi giorni da chiunque disponga della macchina per caricarla. Un fornitore che apre i pesi una settimana dopo aver rivendicato una posizione è quantomeno disposto a farsi controllare. La risposta giusta è attendere quel controllo, che ora dista giorni e non un tempo indefinito.

Che cosa cambia questo mese per un acquirente europeo

Nel vostro sistema in produzione, ancora nulla. La sequenza da seguire è stretta: lasciate arrivare i pesi, lasciate arrivare i punteggi indipendenti, poi valutate sul vostro carico di lavoro a listino pieno e non alla tariffa d'anteprima. È una decisione di settembre e non di agosto, e non si paga alcuna penale ad arrivare secondi su un modello che fra sei settimane sarà ancora lì.

In sintesi: la domanda strategica sollevata da questo lancio non è se un modello cinese sia abbastanza buono. È se i pesi aperti comprino ancora indipendenza quando l'hardware necessario a esercitarla è razionato. Se l'autonomia di hosting è la ragione per cui seguite queste uscite, il vincolo stringente si è spostato in silenzio dalle condizioni di licenza all'approvvigionamento di memoria, ed è lì che va ora lo sforzo di pianificazione.