Marco Consiglio · Volta Institute

Qwen AI
per Principianti

I modelli open-source di Alibaba: dalla chat locale agli agenti frontier · Guida 2026

Aggiornato 2026

Sviluppatore: Alibaba (Qwen Team)
Licenza: Apache 2.0 (open-source)
Flagship: Qwen3-235B-A22B + Qwen 3.7-Max
01 · Introduzione

Cos'è Qwen AI

Qwen è la famiglia di modelli AI sviluppata dal Qwen Team di Alibaba — uno dei più completi ecosistemi open-source al mondo per l'intelligenza artificiale. La terza generazione (Qwen3, aprile 2026) copre tutto: dalla chat testuale alla generazione di immagini, dal coding agli agenti autonomi, con modelli eseguibili su un laptop consumer fino a cluster multi-GPU.

💡 Il vantaggio chiave di Qwen

A differenza di molti modelli cinesi, Qwen3 è rilasciato sotto licenza Apache 2.0 — puoi scaricarlo, modificarlo, usarlo commercialmente senza royalties. È l'unica famiglia che compete con GPT e Claude sia via API (Alibaba Cloud) sia in esecuzione locale su hardware consumer.

Perché conoscere Qwen nel 2026

  • 🆓
    Completamente gratuito per uso localeI modelli open-weight si scaricano e si eseguono senza costi di API.
  • 🌍
    119 lingue incluso l'italianoAddestrato su 36 trilioni di token in oltre 119 lingue e dialetti.
  • 🤖
    Agenti e tool-calling nativiSupporto nativo al protocollo MCP per l'integrazione con strumenti esterni.
  • 📊
    Benchmark di livello frontierQwen3-235B-A22B supera DeepSeek-R1 su 17 dei 23 benchmark — il miglior open-weight nel 2026.
02 · La Famiglia Qwen3

Da 0.6B a 235B:
tutti i modelli

Qwen3 copre uno spettro di dimensioni unico — da modelli che girano su uno smartphone ai modelli flagship che competono con i migliori sistemi chiusi. Tutti con la stessa API e lo stesso formato.

Qwen3 Dense (piccoli)
0.6B · 1.7B · 4B · 8B
Per dispositivi edge, smartphone, laptop senza GPU dedicata. Il 4B è l'entry-point consigliato per chi inizia localmente.
Qwen3 Dense (medi)
14B · 32B
Per workstation con GPU 16-24GB. Il 32B è il punto di equilibrio ideale tra qualità e costo hardware.
Qwen3-30B-A3B (MoE)
30B totali, 3B attivi
Architettura Mixture-of-Experts leggera: qualità da 30B con il costo computazionale di un 3B. Ideale per server budget.
Qwen3-235B-A22B (MoE)
235B totali, 22B attivi · Flagship
Il modello di punta. Supera DeepSeek-R1 e Gemini 2.5 Pro su competitive programming. Richiede multi-GPU o cloud.
💡 Qual è il modello giusto per iniziare

Per chi ha un laptop normale: Qwen3-8B via Ollama (5-6 GB RAM GPU). Per chi vuole qualità alta su cloud o workstation: Qwen3-32B. Per uso professionale API senza ospitare nulla: Qwen3-235B-A22B via DashScope.

03 · Dual-Mode Thinking

Thinking Mode
vs Non-Thinking Mode

La caratteristica più innovativa di Qwen3 è la modalità di ragionamento ibrida: lo stesso modello può rispondere con pensiero approfondito passo per passo, oppure in modo immediato — e puoi scegliere quale usare per ogni singola domanda.

ModalitàCome si attivaQuando usarla
Thinking ModeAggiungi /think nel prompt, oppure abilita nelle impostazioniMatematica, coding complesso, ragionamento multi-step, decisioni importanti
Non-Thinking ModeAggiungi /no_think oppure disabilita nelle impostazioniRisposte rapide, domande semplici, conversazioni, brainstorming leggero
AutomaticoNon specificare nullaIl modello decide in base alla complessità apparente del task
Esempio prompt con Thinking Mode
/think
Analizza i pro e i contro di implementare una campagna email per un e-commerce B2C che vende abbigliamento sostenibile. Il budget è limitato a €500/mese. Fornisci una raccomandazione finale motivata.
🎓 Perché questa funzione è importante per il lavoro professionale

Prima di Qwen3, avere pensiero approfondito richiedeva modelli separati (es. o1 vs GPT-4o). Con il Dual-Mode, puoi usare lo stesso modello per entrambi i casi — il Thinking Mode per analisi critiche che richiedono qualità, il Non-Thinking Mode per le decine di task quotidiani dove la velocità è prioritaria.

04 · Qwen Studio

L'interfaccia web
Qwen Chat

Qwen Studio (accessibile su qwen.ai o chat.qwen.ai) è l'interfaccia consumer ufficiale di Alibaba per interagire con i modelli Qwen — gratuita, multilingue, con funzioni che vanno oltre la semplice chat.

  • 💬
    Chat testualeAccesso ai modelli Qwen3 con dual-mode, supporto nativo all'italiano e ad altre 119 lingue.
  • 🔍
    Deep ResearchAgent di ricerca autonomo che naviga il web in più step per rispondere a domande complesse con fonti citate.
  • 🖼️
    Generazione immaginiAccesso a Qwen Image e Qwen VLo direttamente dall'interfaccia chat.
  • 📄
    Analisi documentiCarica PDF, immagini, file di testo — il modello li analizza e risponde sul contenuto.
  • 📱
    App mobileDisponibile come app per iOS e Android.
⚠️ Disponibilità geografica e privacy

Qwen Studio è principalmente orientata al mercato cinese. Per utenti europei funziona, ma i dati vengono processati su server Alibaba in Cina. Per uso professionale con dati sensibili, valuta l'accesso via API con regione europea o l'uso locale dei modelli open-weight.

05 · Uso Open-Source

Qwen in locale:
Ollama e LM Studio

Uno dei vantaggi più concreti di Qwen3 è la possibilità di eseguirlo direttamente sul proprio computer — nessun abbonamento, nessun dato che esce dalla propria macchina, nessun limite di utilizzo.

Avviare Qwen3 con Ollama (terminale)
ollama run qwen3:8b
# oppure per il modello più leggero:
ollama run qwen3:4b

# Per usare Thinking Mode in Ollama:
# Invia il messaggio con /think davanti alla domanda

Requisiti hardware indicativi

ModelloRAM GPU minimaTipo di hardware
Qwen3-4B~4 GBGPU consumer entry-level (GTX 1660, M1 Mac)
Qwen3-8B~6 GBGPU consumer (RTX 3060, M2 Mac)
Qwen3-14B~10 GBGPU mid-range (RTX 3080, M2 Pro Mac)
Qwen3-32B~20 GBGPU professionale o Mac M3 Max/Ultra
🎓 LM Studio come alternativa no-code

Se Ollama richiede il terminale, LM Studio offre un'interfaccia grafica drag-and-drop per scaricare e avviare Qwen3 con un clic — ideale per chi vuole sperimentare localmente senza familiarità con la riga di comando. Vedi la guida LM Studio nella stessa collezione.

06 · Immagini con Qwen

Qwen Image
e Qwen VLo

Qwen non è solo testo — la famiglia include modelli dedicati alla generazione e all'editing di immagini, con una capacità di rendering del testo particolarmente avanzata.

  • 🖼️
    Qwen Image (20B)Modello di generazione immagini con rendering superiore di testo complesso (multi-riga, paragrafi, layout specifici). Supporta sia caratteri latini che CJK.
  • ✏️
    Qwen-Image-EditLa versione di editing di Qwen Image — estende le capacità di rendering al ritocco di immagini esistenti: modifica testo, trasferisci stile, genera partendo da un'immagine di riferimento.
  • 🎨
    Qwen VLoIl modello visivo-linguistico multimodale unificato: genera, modifica, trasferisci stile, combina più elementi — tutto con comprensione profonda del contesto.
💡 Quando usare Qwen Image vs Seedream vs Recraft

Per testo in italiano dentro le immagini: Qwen Image e Seedream sono le migliori opzioni. Per SVG nativi: Recraft. Per video: Kling o Veo. Qwen Image eccelle nei layout editoriali con testo complesso (infografiche, packaging, locandine con paragrafi interi).

07 · Qwen 3.7-Max

Il modello frontier
per gli agenti

Qwen 3.7-Max (lanciato il 19 maggio 2026) è la versione closed-source di punta di Alibaba — non scaricabile, accessibile solo via API, progettata specificamente per flussi di lavoro agentici di lunga durata.

CaratteristicaQwen3 Open-SourceQwen 3.7-Max
LicenzaApache 2.0 (libero)API-only, closed-source
Contesto128K token1 milione di token
SpecializzazioneGeneral-purposeAgent frontier, task lunghi
Costo APIGratuito (locale)~$1.25/M input, $3.75/M output
Quando usarloTutto il restoTask agentici che durano ore, 1M token context
💡 Il caso d'uso distintivo di Qwen 3.7-Max

Alibaba ha dimostrato una sessione di esecuzione autonoma di 35 ore con 1.158 tool call senza intervento umano. Il context window da 1M token significa poter caricare un'intera codebase o raccolta documentale in un singolo prompt — un vantaggio concreto per repository-level analysis e multi-session agent memory.

⚠️ Accesso tramite DashScope o OpenRouter

Qwen 3.7-Max non ha un'interfaccia consumer dedicata come Qwen Chat — si accede tramite Alibaba Cloud DashScope (API diretta) o aggregatori come OpenRouter e Yotta AI Gateway che lo includono nel loro catalogo modelli.

08 · Esercizio 1

Prima sessione
con Qwen Chat

01
Dual-Mode a confronto
Tempo: 15 minuti · Qwen Chat (gratuito)
Obiettivo: Sperimentare concretamente la differenza tra Thinking Mode e Non-Thinking Mode sulla stessa domanda.
  1. Vai su chat.qwen.ai e accedi (o crea un account gratuito).
  2. Invia questo prompt in modalità normale: "Qual è la strategia migliore per aumentare le vendite di un e-commerce di nicchia?"
  3. Ora invia lo stesso prompt preceduto da /think — osserva il pensiero step-by-step che appare prima della risposta finale.
  4. Confronta le due risposte: qual è più approfondita? Quale più rapida e pratica?
  5. Prova la funzione Deep Research su una domanda di mercato reale del tuo settore.
09 · Esercizio 2

Qwen3 in locale
con Ollama

02
Eseguire Qwen senza connessione
Tempo: 20 minuti · Richiede Ollama installato
Obiettivo: Avviare Qwen3-8B in locale e confrontare velocità e qualità con la versione cloud.
  1. Se non hai Ollama, scaricalo da ollama.ai e installalo (vedi guida Ollama nella stessa collezione).
  2. Apri il terminale ed esegui: ollama run qwen3:8b — il download avviene automaticamente la prima volta (~5 GB).
  3. Fai la stessa domanda usata nell'Esercizio 1 — confronta la qualità della risposta locale vs quella cloud.
  4. Prova a inviare /think Risolvi: se 3x + 7 = 22, quanto vale x? — osserva il ragionamento passo per passo in locale.
  5. Valuta: per quali tipi di task useresti il modello locale? Per quali preferiresti il cloud?
10 · Glossario

Tutti i termini spiegati

Qwen3
base
La terza generazione di modelli linguistici di Alibaba, rilasciata nell'aprile 2026 con licenza Apache 2.0. Include 8 modelli dense (0.6B-32B) e 2 MoE (30B-A3B, 235B-A22B).
Dual-Mode Thinking
importante
La capacità di Qwen3 di operare in due modalità: Thinking (chain-of-thought step-by-step) e Non-Thinking (risposta immediata), selezionabili per ogni singolo prompt.
MoE (Mixture-of-Experts)
tecnico
Architettura in cui il modello ha molti parametri totali ma ne "attiva" solo una frazione per ogni token — efficienza computazionale alta con qualità da modello grande.
Apache 2.0
importante
La licenza open-source che permette uso commerciale, modifica e redistribuzione senza royalties — la stessa usata da aziende come Google e Meta per i loro modelli open.
DashScope
tecnico
La piattaforma API di Alibaba Cloud per accedere ai modelli Qwen via HTTP — compatibile con il formato OpenAI per facilitare la migrazione.
Qwen 3.7-Max
avanzato
Il modello flagship closed-source di Alibaba (maggio 2026), API-only, con 1M token di context window, ottimizzato per flussi agentici di lunga durata.
Qwen VLo
base
Il modello visivo-linguistico unificato di Qwen per generazione e modifica di immagini con comprensione contestuale profonda.