Qwen 3.8 open weights : uscita del 14 agosto 2026
I pesi aperti di Qwen 3.8 sono stati rilasciati: Alibaba ha pubblicato Qwen3.8-27B su Hugging Face il 14 agosto 2026, sotto licenza Apache 2.0, con un tag Ollama ufficiale subito dopo. Questa guida ripercorre la cronologia completa — dall'annuncio al WAIC a fine luglio al lancio di Qwen 3.8-Max tramite API il 3 agosto, fino al rilascio dei pesi — e spiega la confusione persistente tra il Max, proprietario e fuori portata per l'uso locale, e il 27B denso che puoi installare a casa. Per l'installazione passo passo, consulta la nostra guida dedicata a Qwen 3.8 27B in locale.
#Il punto in un minuto
Se sei venuto alla ricerca di un tag Ollama per Qwen 3.8, esiste dal 14 agosto 2026: « ollama run qwen3.8:27b ». Ciò che bisogna capire prima di procedere è che la versione 3.8 include due modelli molto diversi — un modello proprietario gigante fornito tramite API e un modello denso da 27 miliardi di parametri che puoi scaricare.
- Qwen 3.8-Max
- Modello di punta di Alibaba, MoE di circa 2 400 miliardi di parametri, contesto 1M. Disponibile tramite l'API Alibaba Cloud dal 3 agosto 2026. Proprietario, non scaricabile — non è un modello locale.
- Qwen3.8-27B (pesi aperti)
- Versione densa multimodale pubblicata il 14 agosto 2026 su Hugging Face sotto licenza Apache 2.0. 262.144 token di contesto nativo, 18 GB in Q4_K_M, etichetta Ollama ufficiale qwen3.8:27b.
- Cosa puoi fare oggi
- Installare direttamente il 27B su una scheda grafica da 24 GB o su un Mac da 32 GB. La nostra guida di installazione descrive in dettaglio il comando, le quantizzazioni e le impostazioni.
#Cronologia verificata: da WAIC all'API
Il tuo ChatGPT privato e gratuito sulla tua macchina in 1 ora — LM Studio, Ollama, Open WebUI, i tuoi documenti, senza cloud.
- Spazio online a vita
- PDF + file
- Aggiornamenti a vita
Buona parte della confusione intorno a Qwen 3.8 nasce dalla sovrapposizione tra una demo presentata a una conferenza e il rilascio di un prodotto. Ecco la sequenza, rimessa in ordine.
- 01Fine luglio 2026 — WAIC (Shanghai)Alibaba presenta la generazione Qwen 3.8 alla World Artificial Intelligence Conference. È lì che compaiono i primi numeri (contesto 1M, architettura MoE massiva) e viene menzionata l'intenzione di pubblicare una variante open-weight. A questo stadio, nulla è scaricabile: sono solo annunci.
- 023 agosto 2026 — Lancio di Qwen 3.8-Max tramite APIIl modello proprietario diventa accessibile tramite l'API Alibaba Cloud (DashScope) e l'applicazione Qwen. Si tratta di un rilascio effettivo, ma solo in cloud. I benchmark comunicati risalgono a quel momento.
- 03Dal 3 al 13 agosto 2026 — Attesa dei pesiLa comunità attende Qwen3.8-27B con pesi aperti, menzionato al WAIC. Nei repository abituali (huggingface.co/Qwen, ModelScope) non vengono pubblicati pesi della generazione 3.8 durante questo periodo, il che alimenta i dubbi sul rispetto di quanto annunciato.
- 0414 agosto 2026 — Pubblicazione dei pesi Qwen3.8-27BAlibaba pubblica il repository Qwen/Qwen3.8-27B su Hugging Face con licenza Apache 2.0: modello denso da 27 miliardi di parametri, capacità native di visione e linguaggio, 262.144 token di contesto. La libreria Ollama include il tag ufficiale il giorno stesso, con dodici varianti (Q4_K_M, Q8, BF16, build MLX per Apple Silicon). Undici giorni separano quindi il lancio di Max tramite API dal rilascio dei pesi aperti.
#Quello che è realmente uscito: Qwen 3.8-Max
Qwen 3.8-Max è il solo modello di questa generazione realmente disponibile oggi, e bisogna essere chiari: non è un modello che potrai far girare a casa tua. Le sue dimensioni lo escludono dal self-hosting alla portata del grande pubblico, e comunque i suoi pesi non sono pubblicati.
- Architettura
- Mixture-of-Experts con circa 2,4 trilioni di parametri in totale, con una frazione attiva per token. Impossibile da caricare su hardware di massa, anche di alta gamma.
- Contesto
- Finestra annunciata di 1 milione di token, orientata ai documenti lunghi e a intere basi di codice.
- Disponibilità
- API Alibaba Cloud (DashScope) e applicazione Qwen. Fatturazione a consumo, nessun download dei pesi.
- Posizionamento
- Concorrente diretto dei modelli proprietari di frontiera. Da confrontare con modelli cloud, non con modelli locali.
#Open weights: ciò che viene promesso e ciò che viene effettivamente fornito
Ora è facile fare chiarezza: ciò che era stato annunciato al WAIC è stato effettivamente rilasciato, con uno scarto di undici giorni rispetto al modello API. Ecco il bilancio dei fatti.
- Promesso
- Un Qwen3.8-27B denso, open-weight, con licenza permissiva, pensato per stare nella memoria di una GPU da 24 GB in versione quantizzata.
- Rilasciato
- Esattamente questo, il 14 agosto 2026: pesi safetensors su Hugging Face, licenza Apache 2.0, GGUF e build MLX distribuiti tramite Ollama, 18 GB in Q4_K_M — quindi ampiamente entro l'obiettivo dei 24 GB.
- In aggiunta
- La visione nativa (immagini e video) e un contesto di 262.144 token estendibile a 1M tramite YaRN, cosa che non era garantita dagli annunci iniziali.
#Il rilascio del 14 agosto su Hugging Face
Il riferimento più affidabile per verificare la disponibilità resta il repository ufficiale. Ecco come verificare di persona, oggi come per la prossima generazione, anche le informazioni di questo articolo, che a sua volta invecchierà.
Il repository ufficiale è Qwen/Qwen3.8-27B. La scheda del modello dichiara 27 miliardi di parametri, 64 layer, attenzione ibrida, visione nativa e licenza Apache 2.0. Su Ollama sono pubblicate dodici varianti, dalla Q4_K_M da 18 GB alla BF16 da 56 GB.
#Bisogna abbandonare Qwen 3.6?
Se stai già usando Qwen 3.6-27B, la domanda non è più «cosa installare nel frattempo», ma «vale la pena scaricare l'aggiornamento?». Risposta breve: sì, a parità di occupazione della memoria — ma conserva il vecchio modello finché non avrai verificato nuovamente i tuoi prompt.
- Qwen3.8-27B
- Stesse dimensioni della 3.6-27B (24 GB di VRAM in Q4), licenza Apache 2.0, visione nativa, contesto 262k. I punteggi comunicati migliorano soprattutto nella programmazione agentica e nell'uso del computer.
- Qwen 3.6-27B
- Sempre valido: stabile, provato, eccellente in francese. Niente ti costringe a migrare se utilizzi il modello in contesti conversazionali.
- Qwen3-Coder-Next
- Il modello specializzato nel codice resta più veloce nell'autocompletamento. Qwen 3.8 27B si giustifica quando un agente deve leggere, pianificare e modificare diversi file.
Un riferimento rapido per la memoria in Q4_K_M, per dimensionare senza sbagliare: un 14B richiede circa 9 GB di VRAM, un 27-32B circa 19 GB e un 70B circa 40 GB. Per un 27B in Q4, punta quindi a una scheda da 24 GB (RTX 4090, RTX 3090) o a un Mac con almeno 24 GB di memoria unificata.
- RTX 3060 12 GB
- Adatta a eseguire comodamente modelli da 8–14B. Il 27B non entra interamente in VRAM: parte del modello viene eseguita sulla CPU, con conseguente lentezza.
- RTX 4090 / 3090 (24 GB)
- La configurazione ideale per un modello da 27-32B in Q4_K_M, interamente sulla GPU.
- Mac M4 Pro (24-48 GB di memoria unificata)
- Il modello 27B funziona molto bene grazie alla memoria unificata; mira a 32 GB e oltre per un contesto lungo.
#Installare: il percorso più breve
L'installazione completa — quantizzazioni, variante MLX su Mac, regolazione del contesto, modalità thinking, risoluzione dei problemi — è trattata in una guida dedicata. Ecco il riepilogo in tre comandi.
- 011. Aggiornare OllamaI layer ibridi di Qwen 3.8 richiedono una versione recente del motore. Una versione precedente ad agosto 2026 restituirà un errore di architettura.
- 022. Scaricare il modello18 GB in Q4_K_M, il formato predefinito. Su Mac Apple Silicon, preferisci il tag -mlx.
- 033. Verificare la distribuzioneollama ps indique si le modèle tourne entièrement sur le GPU. Tant que ce n'est pas 100 % GPU, le débit reste médiocre.
Per un uso dedicato esclusivamente alla programmazione, la variante specializzata della generazione precedente resta pertinente e più leggera.
#Ciò che bisogna ricordare
L'episodio Qwen 3.8 è un caso esemplare della confusione tra annuncio, disponibilità tramite API e pubblicazione dei pesi. Ecco i fatti verificati, con le relative date.
- L'etichetta Ollama
- qwen3.8:27b, pubblicato il 14 agosto 2026, 18 GB in Q4_K_M. Dodici varianti in totale, tra cui due build MLX per Apple Silicon.
- La licenza
- Apache 2.0: uso commerciale, modifica e redistribuzione autorizzati, senza soglie sul numero di utenti né clausole restrittive sull'uso.
- Le dimensioni pubblicate
- Per ora è disponibile una sola taglia di modello denso, il 27B. A oggi non è stata pubblicata alcuna variante più piccola della generazione 3.8.
- I benchmark
- I punteggi disponibili provengono dalla scheda modello ufficiale. Non è stata ancora pubblicata alcuna riproduzione indipendente.
#Per approfondire
Per passare dalla cronologia alla pratica, queste guide approfondiscono questa guida:
- Qwen 3.8 27B in locale
- La guida completa all'installazione: comando Ollama, VRAM per livello di quantizzazione, variante MLX su Mac, insidia del contesto 256k e impostazioni della modalità thinking.
- Installare Ollama correttamente
- « Installare Ollama : Windows, macOS e Linux » elenca i requisiti RAM/GPU e il primo modello da lanciare partendo da zero.
- Scegliere la quantizzazione giusta
- « Scegliere la quantizzazione (Q4, Q5, Q8, FP16) » spiega il compromesso tra qualità e memoria, decisivo per far entrare un modello da 27B in 24 GB.
- Dimensionare la GPU
- «Scegliere la GPU per l'IA locale» ti aiuta a non sottovalutare la VRAM prima di acquistare una GPU per un futuro modello 27B.
Un feedback, un errore, una precisazione? Facci sapere, così la guida migliora per tutti.