Alibaba Rilascia Qwen3.8-Max come Open Weights, Sfidando Claude e ChatGPT su Costo e Distribuzione
Punti chiave
- •Alibaba ha pubblicato Qwen3.8-Max come open weights, rendendolo il primo modello Qwen di classe Max disponibile per il download gratuito e il self-hosting.
- •Il modello da 2,4 trilioni di parametri impiega un design Mixture-of-Experts che attiva solo 95 miliardi di parametri per calcolo al fine di ridurre i costi di inferenza pur preservando la capacità complessiva.
- •Qwen3.8-Max guida la maggior parte delle categorie del benchmark per compiti multimodali che coinvolgono documenti, video e ragionamento spaziale, ma ha vinto solo sette dei trentuno test di testo e uno delle dodici valutazioni specifiche per la codifica.
- •Alibaba afferma che Qwen3.8-Max opera a circa il 30% del costo di Claude Fable 5 di Anthropic, rendendolo un'alternativa significativamente più economica anche quando sono necessarie fasi di ragionamento aggiuntive.
- •Il rilascio open weight segna un'inversione strategica rispetto ad aprile, quando Alibaba ha eliminato il livello gratuito di Qwen Code nell'ambito di un più ampio spostamento verso modelli chiusi e a pagamento.

Alibaba ha rilasciato Qwen3.8-Max, il modello di intelligenza artificiale più avanzato che abbia mai costruito, segnando la prima volta in cui l'azienda rende disponibile un modello Qwen di classe Max come open weights.
I pesi del modello saranno pubblicati su Hugging Face e ModelScope nella settimana successiva al lancio di lunedì. Con un totale di 2,4 trilioni di parametri—di cui 95 miliardi attivati in qualsiasi momento—il modello utilizza un'architettura Mixture-of-Experts che instrada ogni calcolo attraverso un sottoinsieme di sottoreti specializzate anziché coinvolgere l'intero modello in una sola volta. Questo design preserva la capacità complessiva riducendo al contempo i costi di inferenza, ed è progettato per consentire a piccole imprese e laboratori di ricerca con hardware sufficiente di eseguire un sistema allo stato dell'arte senza sostenere i costi per token associati alla chiamata di un'API di datacenter su larga scala.
Dichiarazioni di Prestazioni Basate sulla Resistenza
Invece di guidare con confronti convenzionali sui benchmark, Alibaba ha evidenziato le capacità autonome sostenute del modello. Secondo l'azienda, Qwen3.8-Max ha trascorso 16 giorni a costruire in modo indipendente uno strumento di codifica, producendo 265 commit, 127 pull request e 151 issue senza intervento umano. Ha inoltre riprodotto un articolo di ricerca per il quale non aveva il codice sorgente in cinque giorni, superando poi i risultati originali dell'articolo di 2,7 punti. In una competizione di machine learning della durata di 24 ore, il modello ha superato 458 dei 526 team umani partecipanti.
Compatibilità con Strumenti di Codifica Concorrenti
Qwen3.8-Max viene fornito con istruzioni di configurazione per Claude Code di Anthropic e Codex di OpenAI—entrambe piattaforme concorrenti. L'API di Alibaba è compatibile con i protocolli di entrambe le aziende, e la maggior parte dei benchmark di codifica del modello è stata condotta all'interno di Claude Code.
I risultati dei benchmark, tuttavia, sono contrastanti. Su 31 test basati su testo nella tabella di valutazione di Alibaba stessa, Fable 5 di Anthropic ha ottenuto il primo posto in 15 categorie, GPT-5.6 Sol di OpenAI ne ha conquistati nove e Qwen3.8-Max ne ha vinti sette. Su 12 test specifici per la codifica, Qwen ne ha vinto esattamente uno.
L'aspetto in cui il modello si distingue è l'efficienza dei costi. Alibaba afferma che Qwen3.8-Max opera a circa il 30% di quanto Anthropic addebita per Claude Fable 5, il che significa che anche quando sono necessarie iterazioni o fasi di ragionamento aggiuntive, il costo totale per completare un'attività rimane significativamente inferiore.
Le classifiche cambiano sostanzialmente nei compiti multimodali che coinvolgono documenti, video e ragionamento spaziale, dove Qwen3.8-Max guida la maggior parte delle categorie del benchmark.
Inversione Strategica sull'Accesso Aperto
Il rilascio rappresenta un cambiamento di rotta significativo. Ad aprile, Alibaba ha eliminato il livello gratuito di Qwen Code, con il team che si orientava verso modelli chiusi e a pagamento in seguito a partenze di dirigenti. Una recensione di Decrypt su Qwen 3.7 Max aveva in precedenza notato che, mentre la versione Plus sarebbe stata aperta, la variante Max era destinata a rimanere accessibile solo tramite API.
I tempi del rilascio open weight coincidono con cambiamenti più ampi nel panorama dell'intelligenza artificiale. I modelli cinesi open weight sono passati da meno del 2% dei token elaborati su OpenRouter alla fine del 2024 a circa il 61% entro la metà del 2026. Qwen ha superato Llama di Meta come modello più self-hosted al mondo.
La disponibilità open weight significa che le organizzazioni possono scaricare, verificare ed eseguire il modello sulla propria infrastruttura—una prospettiva allettante per le aziende con requisiti di sovranità dei dati o per coloro che cercano di evitare il vendor lock-in, in particolare mentre le tensioni geopolitiche complicano le dipendenze API transfrontaliere.
Nel frattempo, Washington ha sottoposto Fable 5 e Mythos 5 a controlli di esportazione a giugno, e si ritiene che Pechino stia valutando limitazioni proprie sui modelli cinesi distribuiti all'estero.
Sebbene Qwen3.8-Max sia indietro rispetto ai concorrenti in diverse classifiche di benchmark, Alibaba sembra dare priorità alla distribuzione e all'accessibilità—posizionando il modello come un'alternativa gratuita e scaricabile che si avvicina alle prestazioni dei sistemi proprietari leader a una frazione del costo.