
Qwen3.8 è il nuovo modello di punta di Alibaba da 2,4 trilioni di parametri, annunciato il 19 luglio 2026, con pesi aperti promessi "a breve" e una Max-Preview già chiamabile oggi. Quello che non ha è un solo benchmark pubblicato. Alibaba lo posiziona come "secondo solo a Fable 5" — è un'affermazione del fornitore, non un risultato misurato, e qui la differenza conta più del solito.
Cosa ha annunciato davvero Alibaba
Tutto ciò che è verificato su Qwen3.8 riconduce a un'unica fonte: l'annuncio di Alibaba del 19 luglio 2026. Ecco cosa dice esattamente:
- Qwen3.8 esiste, con 2,4 trilioni di parametri
- I pesi diventeranno open "a breve" — nessuna data associata
- Qwen3.8-Max-Preview è già attiva
- L'accesso avviene tramite Token Plan, Qoder e QoderWork di Alibaba
- Alibaba descrive il modello come "uno dei modelli più potenti oggi disponibili, compatibile con i principali modelli AI di frontiera, secondo solo a Fable 5"
Quest'ultimo punto è posizionamento, non un risultato. Tenete i due aspetti in caselle separate.
Vale la pena notare il tempismo. Qwen3.8 è il quarto lancio di frontiera in undici giorni — Grok 4.5 l'8 luglio, GPT-5.6 il 9 luglio, ora questo. Arriva anche quattro giorni dopo l'approvazione da parte dei regolatori cinesi dell'integrazione Apple-Alibaba Qwen il 15 luglio, quindi l'attenzione sul marchio Qwen era già alta quando è uscito l'annuncio.
Qwen3.8 vs Qwen3-8B: non è lo stesso modello
Vale la pena chiarirlo subito, perché i motori di ricerca al momento confondono i due nomi. Qwen3.8 è il modello di punta di Alibaba da 2,4 trilioni di parametri annunciato oggi. Qwen3-8B è un modello denso da 8 miliardi di parametri della serie Qwen3, scaricabile su Hugging Face dal 2025. Nomi simili, ma circa 300 volte di distanza in termini di dimensione.
Cosa sappiamo e cosa (ancora) non sappiamo
Nessuno sa ancora quanto sia buono Qwen3.8, inclusi i post che vi dicono di saperlo. Quindi ecco tre categorie ben distinte.
Fatti confermati su Qwen3.8 (fonte ufficiale Alibaba, 19-07-2026)
| Fatto su Qwen3.8 | Cosa ha confermato Alibaba |
|---|---|
| Modello annunciato | Qwen3.8 |
| Numero di parametri | 2,4 trilioni |
| Pesi aperti | Promessi, "diventerà open-weight a breve" |
| Disponibilità preview | Qwen3.8-Max-Preview già attiva |
| Superfici di accesso | Token Plan, Qoder, QoderWork |
| Stato di sviluppo | "In continua evoluzione", secondo Alibaba |
| Posizionamento del fornitore | "Secondo solo a Fable 5" — affermazione di Alibaba, non un risultato indipendente |
Benchmark, prezzi e specifiche di Qwen3.8: cosa non è pubblicato
| Incognita su Qwen3.8 | Stato al 19 luglio 2026 |
|---|---|
| Qualsiasi punteggio benchmark di Qwen3.8 | Nessuno pubblicato |
| Data di rilascio dei pesi aperti | "A breve", nessuna data |
| Licenza | Non annunciata |
| Prezzo per token | Non reso pubblico nel dettaglio |
| Parametri attivi / configurazione MoE | Non divulgata |
| Finestra di contesto e output massimo | Non annunciati |
| Modalità (multimodale?) | Non annunciata |
| Scheda modello su Hugging Face | Verificata assente |
| Presenza su OpenRouter | Verificata assente (76 modelli Qwen elencati, nessuno è il 3.8) |
| Disponibilità regionale (UE/USA) | Non dichiarata |
| Valutazione indipendente | Ancora nessuna — attesa entro pochi giorni |
L'assenza di una model card e di una voce su OpenRouter è la prova più solida disponibile che i pesi aperti non sono ancora davvero usciti.
Proxy etichettato: Qwen3.7-Max (predecessore — NON Qwen3.8)
Ogni numero qui sotto appartiene a Qwen3.7-Max, la generazione precedente. Nessuno di questi è un risultato di Qwen3.8, e nessuno è una previsione. È qui per farvi capire che tipo di laboratorio sta facendo questa affermazione.
| Metrica Qwen3.7-Max (annunciata il 20-05-2026) | Valore |
|---|---|
| Artificial Analysis Intelligence Index v4.0 | 56,6 — 5° posto assoluto, #1 modello cinese (dato di Qwen3.7-Max) |
| Contesto / output massimo | 1M token / 65.536 (dato di Qwen3.7-Max) |
| Prezzo | $2,50 in / $7,50 out per M, 90% di sconto sull'input in cache (dato di Qwen3.7-Max) |
| Pesi | Chiusi, solo API — nessun GGUF, nessun checkpoint su HF (Qwen3.7-Max) |
| SWE-bench Verified / SWE-Bench Pro / SWE-Multilingual | 80,4 / 60,6 / 78,3 (dati di Qwen3.7-Max) |
| SciCode / Terminal Bench 2.0-Terminus | 53,5 / 69,7 (dati di Qwen3.7-Max) |
| Tasso di allucinazioni | 22,9%, il più basso tra i modelli di frontiera (dato di Qwen3.7-Max) |
| Operatività autonoma | Fino a ~35 ore (dato di Qwen3.7-Max) |
| Compatibilità API | Specifiche OpenAI e Anthropic (Qwen3.7-Max) |

2,4 trilioni di parametri: il più grande modello open-weight mai promesso
Qwen3.8 ha 2,4 trilioni di parametri, secondo l'annuncio di Alibaba. Se Alibaba rilascerà davvero quei pesi, sarà circa 1,5 volte più grande di qualsiasi modello open-weight uscito finora — l'attuale detentore del record è DeepSeek V4 Pro con 1,6T. Tutto il resto nel campo open è ben al di sotto del trilione.
I modelli open-weight più grandi per numero di parametri (2026)
Tabella dei dati
| Parametri (miliardi) | Parametri (B) |
|---|---|
| Qwen3.8 (promesso) | 2400 |
| DeepSeek V4 Pro | 1600 |
| Kimi K2.7 | 1000 |
| GLM-5.2 | 744 |
| DeepSeek-V3.2 | 685 |
Un avvertimento prima di entusiasmarvi per quel grafico. Alibaba non ha divulgato il numero di parametri attivi né la configurazione mixture-of-experts, quindi 2,4T è un numero da titolo, non una cifra di calcolo effettivo. Per dare un'idea, i 1,6T di DeepSeek V4 Pro attivano solo circa 49 miliardi di parametri per token — circa il 3% della rete — ed è per questo che riesce a girare a un costo tutto sommato ragionevole. Un modello sparso da 2,4T e uno denso da 2,4T sono animali completamente diversi da servire, e al momento non sappiamo quale dei due sia questo. Se volete lo stato attuale del settore, teniamo traccia di dove si colloca già Qwen tra gli LLM open source, e GLM 5.2, l'altro grande rilascio open-weight cinese, dà un'idea di come appare questa fascia quando esce davvero.
Pesi aperti di Qwen3.8: l'inversione di rotta di cui nessuno parla
Alibaba ha promesso pesi aperti per Qwen3.8, ma non ha annunciato né una data né una licenza. Sembra routine finché non si guarda alla storia della famiglia di modelli — che è esattamente ciò che la maggior parte delle coperture del primo giorno salterà.
Alibaba ha costruito per due generazioni una divisione deliberata: modelli operativi open-weight per tutti, modello di punta chiuso al vertice.
| Generazione | Pesi | Note |
|---|---|---|
| Qwen 3.5 (0,8B–397B-A17B) | Aperti, Apache 2.0 | Intera famiglia rilasciata pubblicamente |
| Qwen 3.6 (27B denso, 35B-A3B MoE) | Aperti, Apache 2.0 | Stesso schema mantenuto |
| Qwen3.7-Max | Chiuso | Solo API DashScope. Nessun GGUF, nessun checkpoint Hugging Face |
Poi Qwen3.8 promette pesi aperti nella fascia di frontiera. Rileggete questa sequenza: Alibaba ha tenuto chiusa la fascia di punta per due generazioni consecutive, e ora dice che aprirà il modello più grande che abbia mai costruito.
Se accadrà davvero, è una vera inversione di strategia, ed è questa la notizia reale — non il numero di parametri. Mette anche pressione concreta su ogni laboratorio a pesi chiusi che ha trattato "la fascia di frontiera resta chiusa" come una norma di settore consolidata.
L'onesta riserva: la licenza non è ancora annunciata. Apache 2.0 su 3.5 e 3.6 è un precedente incoraggiante, e un precedente non è un impegno. Una licenza community restrittiva a 2,4T soddisferebbe tecnicamente la definizione di "pesi aperti" pur cambiando radicalmente cosa potete effettivamente farci.

Potete davvero eseguire Qwen3.8 da soli? (Risposta onesta: no)
No — non su hardware consumer, e realisticamente nemmeno sul budget GPU della vostra startup, neppure dopo il rilascio dei pesi. Anche DeepSeek-V3.2 con i suoi 685B viene descritto da chi lo ha provato come un vero progetto infrastrutturale da autogestire. Qwen3.8 è circa 3,5 volte più grande.
Quindi "pesi aperti" a 2,4T non significa che potete eseguirlo voi. Cosa ottenete realmente:
- I provider di inferenza potranno ospitarlo, il che significa concorrenza sui prezzi, il che significa che il vostro costo per token scenderà
- Diventano possibili per la prima volta a questa fascia deployment sovrani, regolamentati e air-gapped
- Ricercatori e chi fa fine-tuning ottengono accesso a un modello base di scala frontiera
- Non significa che gira sulla vostra macchina, sulla vostra singola A100, o realisticamente sul budget GPU della vostra startup
Al momento la Preview vive solo su superfici gestite da Alibaba, e secondo la Legge sull'Intelligence Nazionale cinese, Alibaba è tenuta a collaborare con le richieste di dati del governo. Qoder in particolare ha attirato l'attenzione critica dei revisori occidentali sul fronte sicurezza.
La sfumatura che nessuno collega: quella preoccupazione riguarda l'API ospitata, non i pesi self-hosted eseguiti su infrastruttura USA o UE. Ed è esattamente per questo che la promessa dei pesi aperti, non la Preview, è la metà davvero rilevante di questo annuncio per chi ha obblighi di residenza dei dati.
Se state pianificando in base a questo scenario, la nostra rassegna dei framework per costruire su modelli open-weight copre il livello di orchestrazione che vorrete avere pronto prima che arrivino i pesi.
Come provare Qwen3.8-Max-Preview oggi
Qwen3.8-Max-Preview è già attiva. Tre vie d'accesso, tutte gestite da Alibaba:
- Token Plan — accesso API in bundle di Alibaba
- Qoder — la superficie di coding di Alibaba
- QoderWork — la superficie per agenti di Alibaba
Cosa è disponibile ora rispetto a cosa arriverà
| Fase | Stato | Cosa ottenete realmente | A chi si adatta |
|---|---|---|---|
| Ora — Qwen3.8-Max-Preview | Attiva (19-07-2026) | Accesso API tramite Token Plan, Qoder, QoderWork. Tariffa per token non resa pubblica nel dettaglio. Nessuna presenza su OpenRouter, nessuna scheda HF, nessuna GA DashScope confermata | Team già su un harness per agenti che vogliono coding quasi-frontiera senza accesso a Fable 5, e che accettano un endpoint ospitato da Alibaba |
| A breve — pesi aperti | Promessi, nessuna data | Checkpoint scaricabili. Licenza non annunciata. Consumati realisticamente tramite provider di inferenza, non hardware locale | Chi fa self-hosting con infrastruttura seria, chi fa fine-tuning, organizzazioni sovrane o vincolate da residenza dei dati |
| Non disponibile | — | Benchmark indipendenti, prezzi pubblicati, finestra di contesto confermata, modalità confermata, disponibilità UE/USA dichiarata | Chiunque debba giustificare una migrazione sulla base di numeri — aspettate |
Chiamarlo da codice
Qwen3.7-Max parlava sia le specifiche API OpenAI sia quelle Anthropic, quindi bastava sostituire l'URL di base. La compatibilità di Qwen3.8 è non confermata — trattatela come lo schema da verificare, non come un endpoint funzionante.
# Pattern dell'era Qwen3.7-Max. La superficie API e l'ID modello di
# Qwen3.8-Max-Preview sono NON CONFERMATI - verificate la documentazione
# Alibaba Cloud attuale prima di mettere questo codice in produzione.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DASHSCOPE_API_KEY"],
base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)
resp = client.chat.completions.create(
model="qwen3.8-max-preview",
messages=[{"role": "user", "content": "Refactor this function for readability."}],
)
print(resp.choices[0].message.content)Essendo un client con forma OpenAI, si inserisce nella maggior parte degli harness senza modifiche — incluso gli agenti di coding in cui lo collegherete davvero. Se volete che raggiunga i vostri sistemi, potete esporre i vostri strumenti tramite un server MCP e puntare l'agente lì.
Prezzi API di Qwen3.8: quanto potrebbe costare
Nessun prezzo di Qwen3.8 è pubblicato. L'unico punto di riferimento difendibile è il predecessore: $2,50 in / $7,50 out per milione di token con uno sconto del 90% sull'input in cache (dato di Qwen3.7-Max). Un 3.8 con prezzi simili si collocherebbe a circa metà di GPT-5.6 Sol e un quarto di Fable 5. È un punto di riferimento, non una previsione — e leggete la sezione successiva prima di costruirci sopra un business case.

Qwen3.8 contro Claude Fable 5: quanto seriamente prendere l'affermazione di Alibaba?
Alibaba dice che Qwen3.8 è "secondo solo a Fable 5". Nessun benchmark pubblicato lo conferma — è posizionamento, non un risultato misurato. Ecco la lettura equilibrata in entrambe le direzioni.
Le ragioni per prenderla semi-seriamente. Qwen3.7-Max ha ottenuto un punteggio misurato in modo indipendente di 56,6 sull'Artificial Analysis Intelligence Index — 5° posto assoluto e primo modello cinese in classifica (entrambi dati di Qwen3.7-Max). Un laboratorio con quel predecessore che dichiara che il suo prossimo modello è secondo solo a Fable 5 non sta facendo un'affermazione palesemente assurda — è una situazione diversa da quella di chi debutta annunciando parità di frontiera al primo colpo.
Le ragioni contrarie. È un dato riportato dal fornitore, senza un benchmark nominato, senza metodologia, senza valutazione indipendente. E la soglia di benchmark di Fable 5 a cui Alibaba punta è 80,4 su SWE-Bench Pro — che non è lo stesso benchmark degli 80,4 di Qwen3.7-Max su SWE-bench Verified. Numero identico, test diverso, difficoltà diversa. Su SWE-Bench Pro — l'unico benchmark che condividono davvero — Qwen3.7-Max ha ottenuto 60,6 (dato di Qwen3.7-Max), circa 20 punti indietro. Chiunque presenti i due 80,4 come un pareggio è confuso oppure spera che lo siate voi. Abbiamo visto lo stesso schema di recente con l'ultimo modello che ha rivendicato parità di frontiera sui propri numeri.
Un'insidia per il vostro modello di costo: i modelli Qwen tendono a emettere più token di output per attività rispetto ai concorrenti. Qwen3.5-27B ha bruciato 98M di token di output completando l'Artificial Analysis Intelligence Index, contro 56M di MiniMax-M2.5 e 61M di DeepSeek V3.2. I token di output sono il lato costoso, quindi i confronti $/M da titolo sovrastimano sistematicamente il risparmio di Qwen. È un'osservazione della generazione 3.5, non una misurazione di Qwen3.8 — ma è il genere di cosa che raddoppia silenziosamente una fattura.
Qwen3.8 contro GPT-5.6 e Grok 4.5: dove si posizionerebbe
La copertura mediatica occidentale del lancio ha quasi del tutto ignorato i concorrenti cinesi. Un articolo molto condiviso sulla "settimana caotica" che ha ridisegnato la mappa dell'AI ha coperto GPT-5.6, Grok 4.5 e Fable 5 — e non ha menzionato Qwen nemmeno una volta. Nel frattempo DeepSeek V4-Pro, Qwen3.7-Max e Kimi K2.6 si collocano tutti entro mezzo punto l'uno dall'altro su SWE-bench Verified, circa 14 punti dietro Claude e con prezzi di circa due ordini di grandezza inferiori.
| Modello | Rilasciato | Prezzo (in/out per M) | Risultato coding principale |
|---|---|---|---|
| Claude Fable 5 | 09-06-2026 | $10 / $50 | SWE-Bench Pro 80,4; DeepSWE 1.1 70% |
| GPT-5.6 Sol | 09-07-2026 | $5 / $30 | Agents' Last Exam 53,6; AA Coding Agent Index 80 |
| Grok 4.5 | 08-07-2026 | $2 / $6 | SWE-Bench Pro 64,7% |
| Claude Opus 4.8 | — | — | SWE-Bench Pro 69,2% |
| Qwen3.8 | 19-07-2026 (preview) | Non pubblicato | Non ancora pubblicato |
| Qwen3.7-Max (predecessore) | 20-05-2026 | $2,50 / $7,50 | SWE-bench Verified 80,4; AA Index 56,6 |
Notate i nomi dei benchmark in quella tabella. Non sono intercambiabili, e una parte della copertura di questa settimana li tratterà come se lo fossero. Per il lato Claude del confronto, abbiamo analizzato come si comporta Opus 4.8 sugli stessi benchmark di coding.
Passare a Qwen3.8, testarlo o aspettare?
| La vostra situazione | Cosa fare |
|---|---|
| State già usando Qwen in produzione | Testate la Max-Preview sul vostro set di valutazione questa settimana. Avete l'harness e il baseline — siete tra i pochi che possono generare un vero numero su Qwen3.8 in questo momento |
| State valutando i modelli cinesi sul costo | Aspettate i benchmark indipendenti. Mancano pochi giorni. Poi rifate i conti applicando la riserva sulla verbosità, non il $/M da titolo |
| Siete soddisfatti con Claude o GPT | Niente da fare oggi. Impostate un promemoria per il rilascio dei pesi aperti — quello è l'evento che potrebbe cambiare la vostra struttura di costo, non la preview |
Il metodo conta più del verdetto, in questo caso. Ogni modello che abbiamo testato in produzione si è comportato in modo diverso rispetto alla sua posizione in classifica, perché i vostri prompt, il vostro codebase e la vostra tolleranza ai tentativi ripetuti non sono nel benchmark di nessuno. Il vostro set di valutazione batte l'affermazione di un fornitore, e batte anche una classifica. Costruirne uno richiede un pomeriggio e si ripaga da solo la prima volta che un modello "migliore" regredisce silenziosamente sul vostro carico di lavoro reale.
Non sapete cosa misurare, o volete un secondo parere sui conti della migrazione? Fate mettere alla prova il vostro workload dal nostro team →
Domande frequenti
Qwen3.8 è open source?
Non ancora, e "pesi aperti" non è la stessa cosa di open source. Alibaba ha promesso pesi scaricabili, ma la licenza non è stata annunciata. Qwen 3.5 e 3.6 sono usciti entrambi sotto Apache 2.0, un precedente incoraggiante — ma un precedente non è un impegno, e oggi non esiste alcun testo di licenza per Qwen3.8.
Quando usciranno i pesi aperti di Qwen3.8?
Alibaba ha detto "a breve" senza indicare una data. Questa è l'intera risposta, e chiunque nomini una settimana precisa sta indovinando. Il segnale più chiaro che non è ancora uscito: al 19 luglio 2026 non esiste ancora una model card di Qwen3.8 su Hugging Face.
Quanti parametri ha Qwen3.8?
2,4 trilioni, secondo l'annuncio di Alibaba. Ciò che manca è il numero di parametri attivi e la configurazione mixture-of-experts, quindi non potete dedurre il costo di calcolo per token da quel numero da titolo. Un modello sparso da 2,4T e uno denso da 2,4T sono cose molto diverse da servire.
Posso eseguire Qwen3.8 in locale?
Realisticamente no, nemmeno dopo il rilascio dei pesi. DeepSeek-V3.2 con i suoi 685B è già un serio progetto infrastrutturale da autogestire, e Qwen3.8 è circa 3,5 volte più grande. Aspettatevi di consumarlo tramite provider di inferenza piuttosto che sulle vostre GPU, a meno che non gestiate un vero data center.
Quanto costa Qwen3.8-Max-Preview?
Alibaba non ha reso pubblica una tariffa per token — l'accesso è incluso in Token Plan, Qoder e QoderWork. Solo come riferimento, il predecessore Qwen3.7-Max costa $2,50 in / $7,50 out per milione di token con uno sconto del 90% sull'input in cache (dato di Qwen3.7-Max). Non basate un budget su quel numero.
Qwen3.8 è migliore di Claude Fable 5?
Nessuno lo sa ancora. "Secondo solo a Fable 5" è il posizionamento di Alibaba stessa, pubblicato senza un benchmark nominato, una metodologia o una valutazione indipendente. La soglia misurata in modo indipendente di Fable 5 è 80,4 su SWE-Bench Pro. Finché non arrivano le valutazioni di terze parti, trattate il confronto come genuinamente aperto.
Qwen3.8 è già su OpenRouter o Hugging Face?
No — verificato al 19 luglio 2026. OpenRouter elenca 76 modelli Qwen e nessuno di essi è il 3.8, e non esiste nemmeno una model card su Hugging Face. Questa assenza è la prova più affidabile disponibile che i pesi aperti non sono ancora davvero usciti.
Cosa sono Qoder e QoderWork?
Sono le superfici di coding e di agenti proprie di Alibaba, e al momento due delle tre vie di accesso a Qwen3.8-Max-Preview insieme al Token Plan. Da sapere prima di impegnarvi: Qoder ha attirato l'attenzione critica dei revisori occidentali sul fronte sicurezza, il che conta se il vostro codice tocca dati regolamentati.
Che finestra di contesto ha Qwen3.8?
Non annunciata. Il predecessore Qwen3.7-Max offriva 1M di token di contesto con 65.536 di output massimo (dato di Qwen3.7-Max), quindi qualcosa di simile è plausibile — ma è una specifica del predecessore, non un'affermazione su Qwen3.8. Non progettate ancora una pipeline a contesto lungo basandovi su questo.
Punti chiave da ricordare
- I 2,4T di parametri e la promessa open-weight sono confermati. I benchmark no — non esiste un solo punteggio pubblicato di Qwen3.8, e qualsiasi numero che vedrete associato a esso questa settimana è quasi certamente un dato di Qwen3.7-Max.
- L'inversione di strategia è la vera notizia. Alibaba ha tenuto chiusa la fascia di punta per due generazioni, e ora promette di aprire il modello più grande che abbia mai costruito.
- A 2,4T, i pesi aperti significano inferenza ospitata più economica e deployment sovrani — non eseguirlo voi stessi.
- "Secondo solo a Fable 5" è un'affermazione di Alibaba. I numeri indipendenti arriveranno entro pochi giorni. Aspettateli.
State valutando un modello open-weight rispetto al vostro stack attuale, o cercate di capire cosa cambia tutto questo per la vostra infrastruttura? Ottenete una revisione gratuita del vostro stack LLM →