Qwen3.8-Max è rapidamente diventato una delle uscite di modelli AI più discusse del 2026.
Il team Qwen di Alibaba lo ha introdotto ufficialmente come il “modello più capace di sempre” dell’azienda. Con circa 2,4 trilioni di parametri totali, Qwen3.8-Max è posizionato come modello di punta per programmazione autonoma, lavoro professionale, agenti con orizzonti di lungo periodo e intelligenza multimodale.
L’annuncio ufficiale fornisce anche diversi dettagli mancanti durante il periodo di anteprima. Qwen ha ora pubblicato i prezzi dell’API, i risultati dei benchmark su linguaggio e visione, esempi di attività per agenti a esecuzione prolungata e una timeline per il rilascio dei pesi del modello open.
Il risultato è più di un semplice aggiornamento di un altro chatbot. Qwen3.8-Max riflette un cambiamento più ampio: dalle AI che generano risposte isolate alle AI agenti che possono pianificare, usare strumenti, ispezionare il proprio lavoro e portare a termine progetti complessi.
Cos’è Qwen3.8-Max?
Qwen3.8-Max è l’ultima punta di diamante di Alibaba nella famiglia Qwen. È progettato per ragionamento avanzato, sviluppo software, analisi multimodale, flussi di lavoro professionali e attività di agenti autonomi.
Il modello era inizialmente disponibile con l’identificatore:
qwen3.8-max-preview
L’anteprima ha dato agli sviluppatori accesso anticipato, ma ha lasciato diverse domande senza risposta, in particolare su prezzi API standard, disponibilità dei pesi open e prestazioni complete nei benchmark.
Questi dettagli sono diventati più chiari nel annuncio ufficiale di Qwen3.8-Max pubblicato il 3 agosto.
Qwen descrive il modello come un nuovo riferimento per il “coding and cowork”, mettendo in evidenza quattro aree principali:
- Sviluppo software autonomo
- Consegne di qualità professionale
- Pianificazione ed esecuzione su orizzonte lungo
- Intelligenza nativa di agenti multimodali
Qwen3.8-Max, quindi, non è posizionato solo come un modello conversazionale più grande. È pensato per operare come motore di ragionamento dietro sistemi AI che lavorano con codice, documenti, interfacce visive, strumenti esterni e cronologie di attività estese.
Caratteristiche principali di Qwen3.8-Max
Circa 2,4 trilioni di parametri
La specifica principale di Qwen3.8-Max è la sua scala dichiarata da 2,4 trilioni di parametri.
Questo lo rende uno dei modelli più grandi annunciati pubblicamente dal team Qwen. Tuttavia, i parametri totali non vanno confusi con il numero di parametri usati per ogni singola risposta.
Se il modello utilizza un’architettura mixture-of-experts, solo una parte della rete completa può essere attivata per una richiesta specifica. Le prestazioni nel mondo reale dipendono anche da:
- Numero di parametri attivi
- Qualità dei dati di training
- Metodi di reinforcement learning
- Accuratezza nell’uso degli strumenti
- Gestione del contesto
- Infrastruttura di inferenza
- Latenza della risposta
- Affidabilità su attività ripetute
Il conteggio dei parametri dimostra la scala del modello, ma non prova che Qwen3.8-Max supererà ogni altro modello concorrente in ogni scenario.
Programmazione autonoma
Secondo Qwen, Qwen3.8-Max può sostenere più di dieci giorni di sviluppo software che evolve in autonomia.
L’azienda presenta un esempio in cui il modello passa da una cartella vuota a un progetto pronto per la produzione con interventi umani limitati. Una traccia pubblica del progetto è disponibile tramite il repository GitHub collegato nell’annuncio ufficiale.
È un’attività più impegnativa rispetto alla generazione di una semplice funzione o alla correzione di un singolo bug. La programmazione autonoma a lungo termine può richiedere a un modello di:
- Comprendere l’obiettivo del prodotto.
- Progettare un’architettura appropriata.
- Creare e modificare più file.
- Installare o configurare dipendenze.
- Eseguire test e interpretare gli errori.
- Rivedere l’applicazione risultante.
- Correggere problemi di implementazione.
- Continuare a iterare senza perdere l’obiettivo originale.
La dimostrazione è un esempio fornito dal vendor, non un benchmark indipendente. Ciononostante, illustra il tipo di flusso di sviluppo esteso che Qwen3.8-Max è progettato per supportare.
Lavoro di agenti su orizzonte lungo
Qwen evidenzia anche due scenari per agenti insoliti per durata:
- Più di 500 turni di ottimizzazione per il chip-design
- Una strategia di e-commerce simulata di 365 giorni
Questi esempi hanno lo scopo di mostrare un apprendimento adattivo a circuito chiuso. In questo tipo di flusso di lavoro, un agente non produce semplicemente un piano una tantum: osserva ripetutamente i risultati, aggiorna la propria strategia e decide cosa fare dopo.
Un agente capace con orizzonte lungo deve preservare contesto importante evitando l’accumulo di cronologie irrilevanti. Serve anche una memoria affidabile, il monitoraggio dei progressi, permessi sugli strumenti, regole di validazione e meccanismi di recupero.
Il modello è solo una parte di quel sistema. Le prestazioni dell’agente dipendono anche dal software circostante e dalla progettazione del flusso di lavoro.
Intelligenza multimodale nativa
Qwen3.8-Max supporta input di testo, immagini e video.
Qwen descrive la visione come un ciclo continuo di feedback, più che come un singolo canale di input. Un agente visivo può ripetutamente:
- Osservare un’interfaccia
- Identificare lo stato corrente
- Decidere l’azione successiva
- Usare uno strumento
- Ispezionare il risultato
- Rilevare un errore
- Correggere la sua azione precedente
Questo è particolarmente rilevante per automazione del browser, test del software, gestione dei documenti, revisione delle interfacce e flussi di lavoro che combinano istruzioni scritte con informazioni visive.
Contesto da un milione di token
I record di integrazione di Qwen Code pubblici hanno indicato una finestra di contesto di circa un milione di token per Qwen3.8-Max.
Una finestra di contesto di queste dimensioni può supportare:
- Grandi repository software
- Collezioni di paper di ricerca
- Documenti aziendali lunghi
- Cronologie estese degli agenti
- Più file e sorgenti dati
- Video o trascrizioni lunghe
Tuttavia, più contesto non produce automaticamente una risposta migliore. Input molto grandi possono aumentare la latenza e rendere più difficile per il modello concentrarsi sulle evidenze rilevanti.
Per ottenere risultati migliori, gli utenti dovrebbero comunque organizzare i propri materiali, rimuovere informazioni non correlate, riassumere le fasi completate e chiedere al modello di citare i file o i passaggi che supportano conclusioni importanti.
Benchmark linguistici e degli agenti di Qwen3.8-Max
Qwen ha pubblicato un grafico di benchmark ufficiale che confronta Qwen3.8-Max con Opus 4.8, Fable 5, GPT-5.6 Sol e Qwen3.7-Max.

I risultati selezionati di Qwen3.8-Max includono:
| Benchmark | Punteggio Qwen3.8-Max |
|---|---|
| Terminal Bench 2.1 | 89,8 |
| FrontierSWE | 73,5 |
| PaperBench | 83,0 |
| AndroidBench | 75,1 |
| QwenSWEBench | 80,7 |
| QwenCoderBench | 58,4 |
| QwenReactBench | 1.724 |
| QwenSVGBench | 1.713 |
| CoWorkBench | 74,8 |
| WorkSpaceBench | 67,7 |
| JobBench | 53,4 |
| SkillsBench | 70,2 |
| GPQA Diamond | 92,6 |
| MMLU-Pro | 92,9 |
| LongBench v2 | 68,3 |
Il grafico indica guadagni sostanziali rispetto a Qwen3.7-Max in diverse categorie.
Ad esempio, il punteggio riportato di Terminal Bench 2.1 passa da 74,5 per Qwen3.7-Max a 89,8 per Qwen3.8-Max. Il risultato di CoWorkBench aumenta da 64,8 a 74,8, mentre WorkSpaceBench sale da 61,4 a 67,7.
Il modello riporta anche risultati solidi di ragionamento generale, tra cui 92,6 su GPQA Diamond e 92,9 su MMLU-Pro.
Qwen3.8-Max non guida ogni benchmark della tabella. Altri modelli mantengono punteggi più alti in alcune valutazioni su ingegneria del software e agenti professionali. Pertanto, i risultati supportano la descrizione di Qwen3.8-Max come estremamente competitivo, ma non universalmente superiore.
Queste cifre sono state pubblicate da Qwen. Prima di trarre conclusioni sulle prestazioni in produzione è ancora necessario un test indipendente.
Benchmark multimodali di Qwen3.8-Max
Qwen ha rilasciato un grafico benchmark separato che copre ragionamento multimodale, agenti visivi, intelligenza dei documenti, comprensione spaziale, visual grounding e attività video.

Risultati selezionati includono:
| Benchmark | Punteggio Qwen3.8-Max |
|---|---|
| MMMU-Pro | 82,3 |
| MathVision | 95,2 / 97,7 |
| LogicVista | 91,9 |
| SLAKE | 90,8 |
| OSWorld-Verified | 86,1 |
| AndroidWorld | 85,3 |
| Parametric CAD Bench | 91,5 |
| OmniDocBench 1.5 | 92,1 |
| RealWorldQA | 88,0 |
| MMStar | 85,9 |
| CountQA | 82,4 |
| Dense200 | 87,0 |
| VideoMME con sottotitoli | 90,4 |
| VideoMMMU | 88,7 |
| MLVU | 90,8 |
I risultati suggeriscono che Qwen3.8-Max non è semplicemente un modello linguistico con una funzione di upload immagini. È ottimizzato per attività in cui le informazioni visive influenzano la pianificazione e l’uso degli strumenti.
Benchmark come OSWorld-Verified e AndroidWorld testano parti di questo flusso di lavoro per agenti. Richiedono al modello di comprendere un’interfaccia e determinare come interagirci.
Qwen3.8-Max riporta prestazioni solide in molte di queste valutazioni, anche se non guida ogni benchmark per agenti visivi. Punteggi elevati nella comprensione dei documenti o nel visual question answering non garantiscono automaticamente anche un controllo affidabile del computer.
Guarda Qwen3.8-Max in azione
Vuoi dare un’occhiata più da vicino a Qwen3.8-Max e a come si confronta con altri modelli open di punta? Guarda il video qui sotto per una spiegazione pratica delle sue capacità, delle prestazioni nei benchmark e delle potenziali applicazioni nel mondo reale.

Prezzi API di Qwen3.8-Max
L’annuncio ufficiale elenca i seguenti prezzi API:
| Tipo di utilizzo | Prezzo ufficiale |
|---|---|
| Input | $2,00 per un milione di token |
| Output | $6,00 per un milione di token |
| Cache implicita | $0,25 per un milione di token |
Questo è un aggiornamento importante rispetto al periodo di anteprima, quando il pricing standard per token non era disponibile in modo chiaro.
Il prezzo della cache implicita può essere utile per agenti che accedono ripetutamente allo stesso repository, alle istruzioni di sistema, ai documenti aziendali o alla cronologia delle conversazioni.
I costi reali del flusso di lavoro dipenderanno comunque da:
- Dimensione del contesto di input
- Lunghezza del ragionamento
- Output generato
- Numero di chiamate agli strumenti
- Tentativi falliti e retry
- Comportamento della cache del contesto
- Requisiti di revisione umana
Di conseguenza, le aziende dovrebbero calcolare il costo per attività completata invece di confrontare i modelli solo in base alle tariffe di token pubblicizzate.
Un modello con token economici può comunque diventare costoso se richiede correzioni ripetute. Un modello più costoso può offrire un miglior valore se completa l’attività correttamente al primo tentativo.
Qwen3.8-Max è open source?
Nel suo annuncio dell’3 agosto, Qwen ha dichiarato che i pesi open di Qwen3.8-Max sarebbero stati rilasciati la settimana successiva.
Il team ha annunciato anche un modello a pesi open Qwen3.8-27B.
Finché i pesi e la licenza non vengono effettivamente pubblicati, la descrizione più accurata è:
Qwen ha ufficialmente annunciato un imminente rilascio di pesi open per Qwen3.8-Max e Qwen3.8-27B. Gli sviluppatori dovrebbero verificare il repository finale, la licenza, i checkpoint e i requisiti di deployment quando il rilascio diventerà disponibile.
Il deployment locale di un modello con 2,4 trilioni di parametri totali richiederebbe infrastrutture importanti. Il modello più piccolo da 27B potrebbe essere più pratico per sviluppatori individuali, team di ricerca e aziende con capacità GPU limitata.
Chi dovrebbe usare Qwen3.8-Max?
Team di sviluppo software
Qwen3.8-Max può essere utile per:
- Esplorare repository non familiari
- Pianificare cambiamenti di architettura
- Modificare più file
- Eseguire debug di fallimenti complessi
- Eseguire test
- Creare applicazioni complete
- Gestire agenti di coding a esecuzione prolungata
Prima di consentire al modello di modificare codice in produzione, i team dovrebbero testare se segue le istruzioni del repository, usa la directory di lavoro corretta, limita le modifiche all’ambito richiesto e convalida le sue modifiche.
Team di ricerca e contenuti
Il contesto lungo e le capacità multimodali del modello possono supportare:
- Sintesi della ricerca
- Analisi della concorrenza
- Revisione di documenti
- Analisi video
- Estrazione di conoscenza
- Generazione di report
Uno strumento come iWeaver può aiutare gli utenti a raccogliere e organizzare PDF, pagine web, video e altri materiali prima di chiedere a un modello avanzato di confrontare le fonti o generare un’analisi strutturata.
Il punto chiave è preservare la tracciabilità. Le affermazioni importanti devono rimanere collegate alle rispettive fonti originali.
Team di automazione enterprise
Le aziende possono valutare Qwen3.8-Max per:
- Assistenti interni basati sulla conoscenza
- Flussi di lavoro per l’assistenza clienti
- Elaborazione documenti
- Automazione d’ufficio
- Operazioni software
- Agenti business che usano strumenti
La valutazione in produzione dovrebbe includere sicurezza, controlli di accesso, conservazione dei dati, auditabilità, stabilità dell’API, concorrenza, recupero dagli errori e costo totale dell’attività.
Dovresti passare a Qwen3.8-Max?
Qwen3.8-Max vale la pena testarlo se il tuo flusso di lavoro coinvolge coding complesso, documenti lunghi, analisi multimodale o strumenti che richiedono più cicli di pianificazione ed esecuzione.
Tuttavia, passare direttamente da un grafico di benchmark al deployment in produzione sarebbe prematuro.
Un approccio più affidabile è creare un benchmark che includa 20-50 attività del tuo flusso di lavoro reale. Confronta Qwen3.8-Max con Qwen3.7-Max e almeno un altro modello di punta usando gli stessi prompt, file sorgente, strumenti e criteri di valutazione.
Monitora:
- Tasso di completamento delle attività
- Tasso di successo al primo tentativo
- Tempo di risposta
- Errori nell’uso degli strumenti
- Tempo per correzioni umane
- Consumo di input e output
- Coerenza su esecuzioni ripetute
- Qualità del deliverable finale
Il modello migliore non è necessariamente quello con più parametri o con il punteggio medio più alto nei benchmark. È quello che completa le tue attività specifiche in modo affidabile a un costo accettabile.
Considerazione finale
Qwen3.8-Max combina una scala riportata da 2,4 trilioni di parametri con programmazione autonoma, pianificazione su orizzonte lungo, ragionamento multimodale, finestra di contesto da un milione di token e prezzi API competitivi.
I benchmark ufficiali suggeriscono progressi significativi rispetto a Qwen3.7-Max in agenti di coding, flussi di lavoro professionali, ragionamento generale, comprensione dei documenti e attività visive. Qwen ha anche annunciato rilasci open-weight sia per Qwen3.8-Max sia per Qwen3.8-27B.
La domanda che resta non è se il modello appaia impressionante in un annuncio. È se valutazioni indipendenti e utenti reali in produzione possano riprodurre le prestazioni dichiarate.
Per ora, Qwen3.8-Max è uno dei modelli più importanti da tenere d’occhio—e un forte candidato per test controllati nel coding, nella ricerca e nei flussi di lavoro basati su agenti.
Domande frequenti
Cos’è Qwen3.8-Max?
Qwen3.8-Max è il modello AI di punta di Alibaba per ragionamento avanzato, coding autonomo, analisi multimodale e flussi di lavoro di agenti a lungo termine. Ha circa 2,4 trilioni di parametri totali.
Qual è il prezzo API di Qwen3.8-Max?
I prezzi ufficiali sono $2 per un milione di token di input, $6 per un milione di token di output e $0,25 per un milione di token per la cache implicita.
Qwen3.8-Max supporta immagini e video?
Sì. Qwen3.8-Max supporta input di testo, immagini e video. Qwen posiziona la visione come parte di un ciclo continuo di pianificazione e auto-correzione per gli agenti AI.
Quanto è grande la finestra di contesto di Qwen3.8-Max?
Le informazioni di integrazione di Qwen Code pubbliche indicano una finestra di contesto di circa un milione di token. I limiti reali dovrebbero essere verificati per la specifica piattaforma o endpoint API utilizzato.
Qwen3.8-Max è open source?
Qwen ha annunciato che i pesi open di Qwen3.8-Max verranno rilasciati dopo l’annuncio del 3 agosto. Gli sviluppatori dovrebbero verificare la disponibilità del repository finale, della licenza e dei checkpoint prima di pianificare un deployment locale.
Cos’è Qwen3.8-27B?
Qwen3.8-27B è un modello più piccolo annunciato insieme a Qwen3.8-Max. Qwen ha dichiarato che verrà rilasciato anche con pesi open, potenzialmente rendendolo più pratico per deployment locali o privati.

