Qwen3.5 è una famiglia di modelli aperti del team Qwen di Alibaba che potete scaricare e usare sul vostro computer. Accetta testo e immagini. Nella libreria di Ollama il file va da 1.0GB per la taglia più piccola a 81GB per la più grande. Questa guida è per chi vuole provarlo in locale ma non sa quale versione prendere né con quale programma. Alla fine avrete scaricato un modello Qwen3.5 e aperto una chat con uno di tre strumenti: Ollama da terminale, la CLI lms di LM Studio oppure l’app LM Studio Bionic. I comandi sono quelli della documentazione ufficiale, elencata in fondo.
Cosa serve
- Uno dei tre programmi già installato: Ollama (la nostra guida per Linux), LM Studio (la guida a LM Studio) oppure LM Studio Bionic (la guida a Bionic).
- Spazio su disco sufficiente per il file del modello. Su Ollama si va da 1.0GB a 81GB, come mostra la tabella più sotto.
- Memoria: il catalogo di LM Studio chiede almeno 2 GB di RAM per il Qwen3.5 più piccolo fra quelli che propone. Per il più grande possono servirne fino a 21 GB.
- Se usate Ollama o
lms, due finestre di terminale: in una resta aperta la chat, nell’altra lanciate i comandi di controllo.
Quale Qwen e quale programma scegliere
Le taglie si distinguono per il numero di parametri: più è alto, più il modello pesa. Nella libreria di Ollama tutte le versioni hanno una finestra di contesto di 256K e accettano in ingresso testo e immagini. Nella tabella, la colonna di Ollama riporta il peso del file. Quella di LM Studio riporta invece la memoria indicata nel catalogo, che non corrisponde al peso del download.
| Taglia | Tag Ollama | Dimensione su Ollama | Nome in LM Studio | Memoria minima dichiarata da LM Studio |
|---|---|---|---|---|
| 0.8b | qwen3.5:0.8b | 1.0GB | non presente | – |
| 2b | qwen3.5:2b | 2.7GB | qwen/qwen3.5-2b | 2.00 GB |
| 4b | qwen3.5:4b | 3.4GB | qwen/qwen3.5-4b | 3.75 GB |
| 9b | qwen3.5:9b (anche latest) | 6.6GB | qwen/qwen3.5-9b | 7.00 GB |
| 27b | qwen3.5:27b | 17GB | qwen/qwen3.5-27b | 17.00 GB |
| 35b | qwen3.5:35b | 24GB | qwen/qwen3.5-35b-a3b | 21.00 GB |
| 122b | qwen3.5:122b | 81GB | non presente | – |
Ollama offre anche varianti MLX, con tag come qwen3.5:0.8b-mlx (1.2GB) o qwen3.5:9b-mlx (8.9GB). LM Studio pubblica Qwen3.5 nei formati GGUF e MLX. Secondo il catalogo di LM Studio, la famiglia comprende varianti dense e sparse, e la 35B-A3B è di tipo Mixture-of-Experts. La pagina di qwen3.5:0.8b su Ollama riporta la Apache License 2.0, e il catalogo di LM Studio indica Apache 2.0 per tutti i modelli Qwen3.5.
Ollama e lms si usano da terminale, mentre con Bionic si fa tutto dall’interfaccia grafica. Se avete poca memoria, cominciate dalla taglia più piccola e passate a una più grande solo dopo aver visto come regge il computer.
Ollama: controllare che risponda e vedere i modelli presenti
Prima di scaricare qualcosa, controllate che Ollama sia installato e guardate quali modelli avete già sul disco. La CLI Reference di Ollama indica questo comando per elencarli:
ollama ls
Se ottenete l’elenco dei modelli, Ollama funziona e potete passare al download. Se il terminale dice che il comando non esiste, Ollama non è installato: seguite prima la nostra guida all’installazione.
Può anche capitare che ollama ls non restituisca l’elenco pur senza dire che il comando manca. In quel caso avviate Ollama con il comando che la CLI Reference presenta come «Start Ollama». Lasciatelo in esecuzione in quella finestra e ripetete ollama ls da un altro terminale:
ollama serve
Se aggiungete --help a questo comando, vedete l’elenco delle variabili d’ambiente che si possono impostare.
Ollama: scaricare e avviare Qwen3.5, partendo dalla taglia più piccola
Partite dal modello più leggero, da 873 milioni di parametri e 1.0GB. Così vedete se tutto funziona senza scaricare file enormi. La pagina di qwen3.5:0.8b indica questo comando:
ollama run qwen3.5:0.8b
Se il modello non è ancora sul disco, Ollama lo scarica. Quando è pronto si apre la chat e potete scrivere la prima domanda. Per scaricare un modello senza aprire la chat, la CLI Reference prevede ollama pull seguito dal nome del modello.
Se il PC regge, potete passare alla versione predefinita della libreria: è la 9b, cioè il tag latest da 6.6GB. Per scaricarla basta non indicare la taglia:
ollama run qwen3.5
Per le altre taglie della tabella scrivete il loro tag dopo ollama run. Se state pensando a una variante 27B o 35B, considerate anche Qwen3.6, che è già disponibile. Ollama segnala miglioramenti soprattutto nella programmazione con agenti e nella conservazione del contesto di ragionamento. Nella libreria di Ollama i tag qwen3.6:27b e qwen3.6:35b pesano rispettivamente 18 GB e 23 GB; accanto ci sono le varianti MLX, qwen3.6:27b-mlx da 19 GB e qwen3.6:35b-mlx da 24 GB. Prima di scaricarli, controllate lo spazio libero e la memoria disponibile.
Ollama: provare il modello e controllare cosa gira
Scrivete la domanda nella chat e premete Invio. Per un testo su più righe, la CLI Reference suggerisce di racchiuderlo fra tre virgolette doppie. Qwen3.5 accetta anche immagini. L’esempio della CLI Reference usa un altro modello: il percorso del file immagine va scritto dentro la domanda, tra virgolette, dopo il nome del modello.
La finestra in cui avete lanciato ollama run ora è occupata dalla chat. Lasciatela aperta e, da un secondo terminale, controllate quali modelli sono in esecuzione:
ollama ps
Nell’elenco dovreste trovare il tag di Qwen3.5 che avete avviato. Per fermare un modello senza cancellarlo c’è ollama stop seguito dal nome del modello, da lanciare sempre dal secondo terminale.
Ollama: togliere il modello dal disco
Se una taglia si rivela troppo pesante o non vi serve più, potete rimuoverla e recuperare spazio. Il comando della CLI Reference è ollama rm seguito dal tag esatto che avete scaricato, per esempio qwen3.5:0.8b oppure qwen3.5.
Attenzione:
ollama rmcancella dal disco il file del modello indicato. Per riaverlo dovete scaricarlo di nuovo: 17GB nel caso della 27b, 81GB per la 122b. Prima di lanciarlo, controllate conollama lsil tag esatto del modello da togliere, così non cancellate per errore una taglia che volete tenere.
LM Studio: verificare lms e scaricare Qwen3.5
lms è l’interfaccia a riga di comando di LM Studio e viene installata insieme all’app, quindi se avete già LM Studio non serve altro (altrimenti seguite la nostra guida). Secondo la documentazione di lms, però, LM Studio va avviato almeno una volta prima di usare la CLI.
Per controllare che il comando sia disponibile, aprite un terminale e scrivete:
lms --help
Se tutto è a posto, compare l’aiuto di lms e non un errore di comando non trovato. Fra i comandi per i modelli locali trovate chat, get, load, unload, ls e ps. Per cercare e scaricare i modelli si usa get. Lanciato da solo, mostra una selezione di modelli consigliati:
lms get
Per cercare direttamente Qwen3.5 aggiungete il nome del modello. Per la variante 2B il comando è lms get qwen3.5-2b: selezionate il risultato e le eventuali opzioni di download che vi vengono proposte. Per le altre taglie usate i nomi del catalogo di LM Studio: qwen/qwen3.5-4b, qwen/qwen3.5-9b, qwen/qwen3.5-27b e qwen/qwen3.5-35b-a3b.
Nel catalogo la variante più piccola è la 2B, con una memoria minima di sistema dichiarata di 2 GB. Il peso del download dipende dal formato e dalla quantizzazione che scegliete.
LM Studio: caricare il modello e chattare dal terminale
Finito il download, controllate che il modello sia sul disco:
lms ls
L’elenco rispecchia la cartella dei modelli di LM Studio, quella che si imposta nella scheda My Models dell’app, e dovreste trovarci il Qwen3.5 appena scaricato. Per aprire una chat interattiva con un modello direttamente nel terminale:
lms chat
Se sul disco avete più modelli, per scegliere quello giusto fate riferimento al nome che compare nell’elenco di lms ls.
Anche questa chat occupa la finestra del terminale. Lasciatela aperta e, da un secondo terminale, controllate quali modelli sono caricati in memoria:
lms ps
Se il vostro Qwen3.5 non compare, caricatelo con lms load. Il comando accetta opzioni come la quota di calcolo da affidare alla GPU e la lunghezza del contesto. Per togliere un modello dalla memoria si usa lms unload, che con l’opzione --all li scarica tutti.
LM Studio Bionic: scaricare e usare un modello locale dall’app
Con Bionic si fa tutto dall’interfaccia grafica. La documentazione di Bionic spiega che i modelli scaricati girano sul computer senza consumare crediti di inferenza cloud. La procedura descritta vale per qualsiasi modello e non nomina Qwen, quindi dovete cercare Qwen3.5 per nome tra i modelli dell’app. Se Bionic non è ancora installato, partite dalla nostra guida a Bionic.
- Aprite Settings e, sotto Local Models, scegliete Explore.
- Cercate il modello o sceglietelo fra quelli proposti. I filtri per formato e le indicazioni sulla compatibilità con il dispositivo aiutano a restringere i risultati.
- Se sono disponibili più dispositivi, per esempio macchine remote collegate con LM Link, scegliete dove scaricarlo.
- Selezionate formato e variante e avviate il download. Potete metterlo in pausa, riprenderlo, annullarlo o riprovare.
- Aprite Settings → Local Models → Library per vedere i modelli presenti sul dispositivo.
- Aprite una sessione di Bionic e selezionate il modello dall’elenco per usarlo.
Documentazione di riferimento
Pagine ufficiali consultate il 30 settembre 2026:
- Libreria Ollama, qwen3.5
- Libreria Ollama, qwen3.5:0.8b
- Documentazione di Ollama, CLI Reference
- Catalogo LM Studio, Qwen3.5
- Documentazione di LM Studio, lms
- Documentazione di LM Studio Bionic, Download Local Models