Il 3 agosto 2026 Alibaba ha presentato Qwen3.8-Max, il modello di intelligenza artificiale più grande e capace mai rilasciato dal gruppo cinese: 2,4 trilioni di parametri totali, un contesto da 1 milione di token e capacità multimodali su testo, immagini e video. L'annuncio ha spinto il titolo Alibaba a Hong Kong di circa il 7% e ha portato il modello ai vertici delle classifiche, primo tra i modelli cinesi per il testo e secondo a livello globale nei test multimodali, dietro a una variante della famiglia Claude di Anthropic.

Qwen3.8-Max è un modello mixture-of-experts: attiva solo una parte dei parametri per ogni richiesta.

Cosa c'è sotto il cofano

Nonostante la cifra impressionante, Qwen3.8-Max non attiva tutti i 2,4 trilioni di parametri a ogni richiesta. È costruito con un'architettura mixture-of-experts (MoE) che, secondo Alibaba, mette al lavoro circa 95 miliardi di parametri per singola richiesta: molti «esperti» specializzati, di cui solo alcuni vengono attivati di volta in volta. È il modo in cui i laboratori riescono a scalare la dimensione totale senza far esplodere i costi di calcolo per ogni risposta. Il contesto da 1 milione di token, poi, permette di dare in pasto al modello documenti molto lunghi, interi codebase o raccolte di file, mantenendo il filo del discorso.

Accanto al modello di punta, Alibaba ha annunciato il rilascio con pesi aperti della famiglia Qwen3.8, incluso un modello più piccolo, Qwen3.8-27B, pensato per chi vuole eseguire il modello in proprio. È la stessa strategia che ha reso Qwen una delle famiglie open più usate al mondo: un modello enorme come vetrina e versioni ridotte scaricabili per sviluppatori e ricercatori.

Come provarlo subito, senza installare nulla

Il modo più rapido è l'interfaccia web ufficiale, Qwen Chat, raggiungibile dal sito qwen.ai. Si accede con un account, si seleziona il modello più recente dal menu e si inizia a scrivere. Per gli sviluppatori, Qwen è disponibile via API attraverso la piattaforma cloud di Alibaba (Model Studio), con un'interfaccia in larga parte compatibile con lo standard OpenAI: questo significa che spesso basta cambiare l'URL di base e la chiave per riutilizzare codice già scritto per altri modelli.

Ecco un esempio di prompt utile per testare la comprensione di documenti lunghi, uno dei punti di forza del modello:

Ho incollato qui sotto il testo integrale di un contratto di 40 pagine.
Compito:
1) riassumi gli obblighi di ciascuna parte in massimo 8 punti;
2) elenca le clausole di recesso e le relative scadenze;
3) segnala eventuali contraddizioni tra articoli, citando i numeri.
Rispondi in italiano, con elenchi puntati.

[testo del contratto...]

Con un contesto così ampio, il modello può ragionare sull'intero documento invece che su frammenti, riducendo il rischio di perdere riferimenti incrociati tra le clausole.

La versione aperta Qwen3.8-27B può essere scaricata ed eseguita in proprio.

Scaricare la versione aperta 27B

Chi vuole eseguire il modello sul proprio hardware può puntare a Qwen3.8-27B. I pesi si scaricano dai repository ufficiali su Hugging Face e ModelScope. Con lo strumento a riga di comando di Hugging Face il comando è nella forma:

pip install -U huggingface_hub
huggingface-cli download Qwen/Qwen3.8-27B --local-dir ./qwen38-27b

Per l'esecuzione locale, un modello da 27 miliardi di parametri richiede risorse consistenti: in quantizzazione a 4 bit servono all'incirca 18-24 GB di memoria video (o di RAM di sistema, più lentamente), quindi è adatto a schede grafiche di fascia alta o a Mac con molta memoria unificata. I nomi esatti dei repository e le eventuali versioni quantizzate vanno verificati sulla scheda del modello, che riporta anche i requisiti aggiornati.

Conviene a un utente italiano?

Per l'uso quotidiano via web, Qwen è un'alternativa gratuita e capace ai chatbot più noti, con buone prestazioni sul contesto lungo. Per gli sviluppatori, l'attrattiva è il rapporto tra capacità e costo delle API cinesi e la disponibilità di versioni aperte, che consentono di eseguire i modelli in locale per motivi di privacy. Due avvertenze pratiche: la resa in italiano è buona ma va provata sui propri casi d'uso, e per dati sensibili conviene preferire la versione locale o verificare con attenzione dove vengono elaborati i dati inviati al servizio cloud. Come sempre, il modello più grande non è automaticamente la scelta migliore: per molti compiti quotidiani una versione più leggera è più veloce ed economica.

Le caratteristiche tecniche derivano dagli annunci di Alibaba e dalla stampa di settore; i benchmark citati sono dichiarazioni dell'azienda.