Il 3 agosto 2026 Alibaba ha presentato Qwen3.8-Max, il modello di intelligenza artificiale più grande e capace mai rilasciato dal gruppo cinese: 2,4 trilioni di parametri totali, un contesto da 1 milione di token e capacità multimodali su testo, immagini e video. L'annuncio ha spinto il titolo Alibaba a Hong Kong di circa il 7% e ha portato il modello ai vertici delle classifiche, primo tra i modelli cinesi per il testo e secondo a livello globale nei test multimodali, dietro a una variante della famiglia Claude di Anthropic.
Cosa c'è sotto il cofano
Nonostante la cifra impressionante, Qwen3.8-Max non attiva tutti i 2,4 trilioni di parametri a ogni richiesta. È costruito con un'architettura mixture-of-experts (MoE) che, secondo Alibaba, mette al lavoro circa 95 miliardi di parametri per singola richiesta: molti «esperti» specializzati, di cui solo alcuni vengono attivati di volta in volta. È il modo in cui i laboratori riescono a scalare la dimensione totale senza far esplodere i costi di calcolo per ogni risposta. Il contesto da 1 milione di token, poi, permette di dare in pasto al modello documenti molto lunghi, interi codebase o raccolte di file, mantenendo il filo del discorso.
Accanto al modello di punta, Alibaba ha annunciato il rilascio con pesi aperti della famiglia Qwen3.8, incluso un modello più piccolo, Qwen3.8-27B, pensato per chi vuole eseguire il modello in proprio. È la stessa strategia che ha reso Qwen una delle famiglie open più usate al mondo: un modello enorme come vetrina e versioni ridotte scaricabili per sviluppatori e ricercatori.
Come provarlo subito, senza installare nulla
Il modo più rapido è l'interfaccia web ufficiale, Qwen Chat, raggiungibile dal sito qwen.ai. Si accede con un account, si seleziona il modello più recente dal menu e si inizia a scrivere. Per gli sviluppatori, Qwen è disponibile via API attraverso la piattaforma cloud di Alibaba (Model Studio), con un'interfaccia in larga parte compatibile con lo standard OpenAI: questo significa che spesso basta cambiare l'URL di base e la chiave per riutilizzare codice già scritto per altri modelli.
Ecco un esempio di prompt utile per testare la comprensione di documenti lunghi, uno dei punti di forza del modello:
Ho incollato qui sotto il testo integrale di un contratto di 40 pagine.
Compito:
1) riassumi gli obblighi di ciascuna parte in massimo 8 punti;
2) elenca le clausole di recesso e le relative scadenze;
3) segnala eventuali contraddizioni tra articoli, citando i numeri.
Rispondi in italiano, con elenchi puntati.
[testo del contratto...]
Con un contesto così ampio, il modello può ragionare sull'intero documento invece che su frammenti, riducendo il rischio di perdere riferimenti incrociati tra le clausole.
Scaricare la versione aperta 27B
Chi vuole eseguire il modello sul proprio hardware può puntare a Qwen3.8-27B. I pesi si scaricano dai repository ufficiali su Hugging Face e ModelScope. Con lo strumento a riga di comando di Hugging Face il comando è nella forma:
pip install -U huggingface_hub
huggingface-cli download Qwen/Qwen3.8-27B --local-dir ./qwen38-27b
Per l'esecuzione locale, un modello da 27 miliardi di parametri richiede risorse consistenti: in quantizzazione a 4 bit servono all'incirca 18-24 GB di memoria video (o di RAM di sistema, più lentamente), quindi è adatto a schede grafiche di fascia alta o a Mac con molta memoria unificata. I nomi esatti dei repository e le eventuali versioni quantizzate vanno verificati sulla scheda del modello, che riporta anche i requisiti aggiornati.
Conviene a un utente italiano?
Per l'uso quotidiano via web, Qwen è un'alternativa gratuita e capace ai chatbot più noti, con buone prestazioni sul contesto lungo. Per gli sviluppatori, l'attrattiva è il rapporto tra capacità e costo delle API cinesi e la disponibilità di versioni aperte, che consentono di eseguire i modelli in locale per motivi di privacy. Due avvertenze pratiche: la resa in italiano è buona ma va provata sui propri casi d'uso, e per dati sensibili conviene preferire la versione locale o verificare con attenzione dove vengono elaborati i dati inviati al servizio cloud. Come sempre, il modello più grande non è automaticamente la scelta migliore: per molti compiti quotidiani una versione più leggera è più veloce ed economica.
Le caratteristiche tecniche derivano dagli annunci di Alibaba e dalla stampa di settore; i benchmark citati sono dichiarazioni dell'azienda.




