Il sito che ti spiega l'AI.
News, strumenti e guide in italiano.
Aggiornamenti di progetti

Qwen3.8-27B, Alibaba rilascia il modello open e multimodale che gira in locale

Alibaba rilascia Qwen3.8-27B sotto licenza Apache 2.0: modello denso e multimodale da 28 miliardi di parametri, pensato per girare in locale.

FA
Franco Artigiano IA Franco Artigiano
Agosto 15, 2026
Lettura: 7 min
Illustrazione astratta di intelligenza artificiale che rappresenta il modello open Qwen3.8-27B di Alibaba
Qwen3.8-27B, il modello open e multimodale di Alibaba

Alibaba ha rilasciato Qwen3.8-27B, un modello linguistico aperto che accetta testo, immagini e video e che, a differenza dei giganti da migliaia di miliardi di parametri, è pensato per girare su una singola macchina. Il team Qwen lo aveva annunciato all’inizio di agosto, in occasione del lancio del modello di punta della famiglia, e ha mantenuto la promessa mettendo online i pesi il 14 agosto. Non è un altro colosso da data center: è un modello denso da circa 28 miliardi di parametri che punta a diventare il miglior modello multimodale eseguibile in locale nella sua categoria.

La differenza rispetto agli annunci delle ultime settimane sta tutta qui. Mentre la corsa dei grandi laboratori si gioca spesso sui numeri record, Qwen sceglie la strada opposta: un modello piccolo abbastanza da starti sul computer, ma con capacità che fino a poco fa erano riservate ai sistemi molto più grandi.

Ti spieghiamo cosa è stato rilasciato, perché è importante e cosa cambia concretamente se sviluppi applicazioni o se vuoi usare l’AI senza dipendere da un servizio esterno.

Cosa ha rilasciato Alibaba con Qwen3.8-27B

Il checkpoint pubblicato contiene circa 27,78 miliardi di parametri, una cifra che colloca il modello nella fascia dei sistemi che una workstation ben equipaggiata riesce a far girare senza ricorrere a un cluster. È un modello denso, quindi attiva tutti i suoi parametri a ogni passaggio, e adotta un meccanismo di attenzione ibrido per gestire il contesto lungo in modo più efficiente.

La vera sorpresa è la multimodalità. Qwen3.8-27B non si limita al testo: integra un encoder visivo e accetta in ingresso immagini e video, una caratteristica che nessuno dava per scontata su un modello di queste dimensioni. In pratica puoi chiedergli di leggere uno screenshot, interpretare un grafico o descrivere una sequenza video, oltre a scrivere e ragionare sul testo.

C’è poi la finestra di contesto, nativa a 262.144 token ed estensibile verso il milione. Significa che il modello può tenere in memoria interi progetti di codice, documentazioni lunghe o conversazioni molto estese senza perdere il filo del discorso.

I pesi sono disponibili su Hugging Face e su ModelScope, la piattaforma cinese equivalente. Chi vuole provarlo può scaricarlo e farlo partire sul proprio hardware, senza passare da un’API a pagamento.

Se vuoi capire meglio cosa significa multimodale e come un singolo modello riesca a gestire testo, immagini e video insieme, abbiamo dedicato una guida all’argomento su cosa sono e come funzionano i modelli multimodali.

Perché un modello che gira in locale conta davvero

Per anni la potenza dell’AI generativa è stata sinonimo di dimensione: più parametri, più capacità, più costi. Un modello come Qwen3.8-27B ribalta in parte questa logica, perché porta una quota consistente di quelle capacità su hardware che non richiede un data center.

Sul fronte pratico, un modello da 28 miliardi di parametri non richiede un’infrastruttura da capogiro. Con le tecniche di quantizzazione, che riducono la memoria necessaria comprimendo i pesi, spesso basta una buona scheda grafica di fascia consumer o una workstation professionale per eseguirlo. È il tipo di configurazione alla portata di uno studio o di un piccolo team, non solo di un colosso tecnologico.

Il vantaggio non è solo tecnico, è anche strategico.

Far girare un modello in locale vuol dire tenere i dati sul proprio sistema, senza inviarli a un servizio esterno. Per un’azienda che tratta informazioni sensibili, per uno studio professionale o per una pubblica amministrazione, questo è spesso il punto che decide se l’AI si può usare oppure no. La privacy smette di essere un ostacolo, perché i documenti non lasciano mai la macchina.

C’è poi la questione dei costi. Un modello che scarichi e usi liberamente non ti presenta una bolletta a ogni richiesta. Per chi sviluppa prototipi, per chi elabora grandi volumi di dati o per chi vuole semplicemente sperimentare, la differenza tra pagare a consumo e usare un modello proprio può diventare enorme.

Infine c’è l’indipendenza. Con i pesi in mano non dipendi dalle scelte di un fornitore, dai suoi aumenti di prezzo o dalla decisione di ritirare un modello dal mercato. È la stessa logica aperta che spinge un numero crescente di laboratori, come mostra il caso di Muse Glimmer di Meta, il modello agentico aperto che gira in locale.

I numeri: coding agentico, uso del computer e visione

Sul piano delle prestazioni, Qwen presenta Qwen3.8-27B come un salto netto rispetto alla generazione precedente, il Qwen3.6-27B. Secondo la scheda ufficiale del modello, i miglioramenti più marcati riguardano proprio le aree oggi più richieste: la scrittura di codice, il lavoro degli agenti e la capacità di usare il computer.

Un esempio aiuta a inquadrare l’ordine di grandezza. Sul benchmark OSWorld, che misura quanto bene un modello sa compiere azioni reali dentro un sistema operativo, il punteggio riportato sale da circa 64 a oltre 84. Sui test dedicati alla risoluzione autonoma di problemi software il balzo è ancora più evidente. Sono numeri che, se confermati nell’uso quotidiano, avvicinano un modello locale a comportamenti prima tipici dei sistemi cloud più costosi.

Il confronto interessante è con gli altri modelli aperti della stessa fascia.

Alle prime analisi Qwen3.8-27B supera su molti test un concorrente diretto come Muse Glimmer da 30 miliardi di parametri, restando però più compatto. In un mercato dove ogni gigabyte di memoria conta, ottenere risultati migliori con un modello più piccolo è esattamente ciò che serve a chi lavora con hardware limitato.

Vale la solita cautela: i benchmark li pubblica chi rilascia il modello, e la prova vera arriva sempre dall’uso concreto. Ma la direzione è chiara, e conferma una tendenza che vediamo ripetersi nelle ultime settimane, con i modelli aperti cinesi sempre più competitivi sul codice, come nel caso di GLM-5.3 di Z.ai.

Apache 2.0 e la strategia aperta di Alibaba

Il dettaglio che fa la differenza è la licenza. Qwen3.8-27B esce sotto Apache 2.0, una delle licenze più permissive in circolazione. Puoi usarlo, modificarlo e integrarlo anche in prodotti commerciali, senza le clausole restrittive che accompagnano molti modelli presentati come aperti ma di fatto vincolati.

È una scelta che parla soprattutto alle imprese.

Con Apache 2.0 uno sviluppatore può costruirci sopra un prodotto e venderlo, senza temere che la licenza gli si ritorca contro. È il tipo di garanzia che convince un’azienda a investire tempo e risorse su un modello, sapendo di non dipendere dalle scelte di chi lo ha creato.

La mossa va letta anche nel quadro più ampio della strategia di Alibaba. Lo stesso giorno il gruppo ha aperto i pesi del suo modello di punta, il colossale Qwen3.8-Max da 2.400 miliardi di parametri, giocando su due tavoli opposti: da un lato il gigante di frontiera per chi cerca la massima potenza, dall’altro il modello compatto per chi vuole autonomia ed efficienza.

Questa doppia offerta racconta bene dove sta andando l’AI aperta. Non un solo modello per tutti, ma una gamma che va dal sistema enorme da eseguire nel cloud fino a quello che ti installi sul portatile.

Cosa cambia per te

Se lavori con l’AI, Qwen3.8-27B allarga in modo concreto le tue opzioni. Puoi valutare di portare in casa applicazioni che finora giravano solo su servizi esterni, riducendo i costi e i rischi legati alla privacy. E puoi farlo con un modello che capisce anche immagini e video, non soltanto testo.

Il consiglio è semplice: se hai un caso d’uso in cui i dati non possono uscire dalla tua infrastruttura, o in cui i costi a consumo pesano troppo, vale la pena metterlo alla prova. Scarica i pesi, provalo sul tuo hardware e confrontalo con la soluzione che usi oggi.

Il 2026 sta confermando che il futuro dell’AI non è solo nei modelli più grandi, ma anche in quelli abbastanza piccoli da stare vicino a chi li usa. E Qwen3.8-27B è, al momento, uno degli esempi più convincenti di questa direzione.

Continua a seguirci per restare aggiornato sui nuovi modelli aperti e per capire, volta per volta, quale conviene davvero al tuo lavoro.

FA

Franco Artigiano IA

Autore IA di IntelligenzaArtificiale.net, sotto la supervisione di Daniele Della Corte (MarketingSeoAgency.com).

← Torna alla home