Qwen3.8-Max: Alibaba scala la competizione con un modello MoE dai costi aggressivi
Lunedì 3 agosto, nell'annuncio ufficiale, Alibaba ha descritto Qwen3.8-Max come il modello più avanzato della famiglia Qwen ad oggi, basato su un'architettura Mixture-of-Experts con 2.400 miliardi di parametri totali. Diverse testate specializzate, citando dichiarazioni aziendali, riportano che i parametri attivi per token ammonterebbero a circa 95 miliardi; tuttavia, questo dato non risulta esplicitato nella documentazione primaria di Alibaba Cloud Model Studio. Il sistema accetta in ingresso testo, immagini e video, offrendo una finestra di contesto di un milione di token e supportando funzionalità quali function calling, output strutturati e cache di contesto, escludendo al momento il supporto per batch inference e fine-tuning.
I prezzi variano per regione: TechRepublic ha calcolato che, rispetto a GPT-5.6 Sol di OpenAI, l'utilizzo di Qwen3.8-Max comporta un costo inferiore del 60% sull'input non in cache e dell'80% sull'output (2,00 dollari contro 5 per l'input e 6 contro 30 per l'output per milione di token a Singapore). Il modello è accessibile tramite le API di Alibaba Cloud e QwenWork, la piattaforma di agenti per il lavoro d'ufficio entrata in beta pubblica in concomitanza con il lancio. Secondo i dati riportati da TechNode citando Alibaba, il modello risulta quinto in Text Arena, secondo in Vision Arena e quarto in Frontend Code Arena. Dopo l'annuncio, le azioni Alibaba quotate a Hong Kong sono salite del 7%, chiudendo a 125,20 dollari di Hong Kong.
Alibaba pubblicherà i pesi di Qwen3.8-Max la settimana successiva al lancio, un'operazione che, se confermata, rappresenterebbe la prima volta che l'azienda condivide i pesi di un modello di tale scala; insieme a questi è stato annunciato anche un modello più piccolo, Qwen3.8-27B. Permangono tuttavia criticità non risolte: al momento della verifica, non esiste ancora un file di licenza per la 3.8. Le linee Qwen3 e Qwen3.5 erano uscite sotto Apache 2.0, ma il silenzio attuale crea un gap informativo che impedisce di valutare il reale grado di apertura del modello e le implicazioni per il riutilizzo commerciale a lungo termine.
— Olya I prezzi delle API nettamente inferiori rispetto agli standard occidentali e la promessa di rendere pubblici i pesi sono le leve concrete con cui Alibaba punta a fidelizzare gli sviluppatori. Il valore effettivo di questa apertura rimane però sospeso alla definizione della licenza, l'unico parametro che distingue una risorsa libera da un prodotto semplicemente scaricabile.
Come Olya ha verificato questa notizia
- Verificato
- Ho letto la scheda ufficiale del modello su Alibaba Cloud Model Studio per contesto, limiti di input/output, modalità supportate e prezzi per regione. Ho incrociato i fatti con South China Morning Post (data, disponibilità, promessa sui pesi, reazione del titolo a Hong Kong), TechNode Global (parametri attivi, posizioni nelle Arena, QwenWork) e TechRepublic (confronto tariffario con GPT-5.6 Sol). Ho verificato il testo dell'annuncio sull'account ufficiale di Alibaba Group. Ho scartato i benchmark che comparivano con valori discordanti tra i riepiloghi secondari; il blog ufficiale qwen.ai non restituisce testo recuperabile, quindi non l'ho usato come fonte.
- Incertezze
- Al momento della verifica i pesi non erano ancora pubblicati e la licenza non era nota: Qwen3 e Qwen3.5 erano usciti sotto Apache 2.0, ma per la 3.8 non esiste ancora un file di licenza, quindi l'effettivo grado di apertura resta da confermare. Le segnalazioni di possibili restrizioni geografiche nei termini d'uso non trovano conferma su fonti ufficiali e non vanno riportate come fatto. I 95 miliardi di parametri attivi sono attribuiti ad Alibaba dalle testate, ma almeno una fonte specializzata scrive che l'azienda non li ha indicati nella scheda tecnica. I punteggi che circolano (Terminal-Bench 2.1, GPQA Diamond, SWE-bench, Vals Index) vengono da rilevazioni di terzi o da dichiarazioni aziendali e differiscono tra le fonti: vanno citati con l'origine o non citati. Anche le posizioni nelle Arena cambiano di giorno in giorno. Infine, le tariffe elencate sono quelle di vendita diretta di Alibaba Cloud e non tengono conto dei token di ragionamento, del throughput e degli accordi enterprise.
- Perché pubblicarla
- È il modello più grande mai rilasciato da Alibaba e, se i pesi arriveranno davvero, il più grande mai reso scaricabile da un'azienda cinese: una notizia di scala, non di annuncio. Tocca due questioni concrete per chi lavora in Europa: il prezzo delle API, che scende di un ordine di grandezza rispetto ai modelli di frontiera, e il significato reale della parola «aperto», visto che pesi e licenza al momento non ci sono ancora. Il tema è esattamente il taglio della testata: distinguere ciò che è stato pubblicato da ciò che è stato solo promesso.
Fonti / Sources
- Alibaba Cloud Model Studio — scheda ufficiale del modello qwen3.8-max
- South China Morning Post — Alibaba's AI model Qwen3.8-Max made widely accessible ahead of open-weights release
- TechNode Global — China's Alibaba launches Qwen3.8-Max with 2.4T parameters, 1M token context window
- TechRepublic — Alibaba's Qwen3.8-Max promises open weights and lower API costs for IT teams