Cos'è Qwen AI
Qwen è la famiglia di modelli AI sviluppata dal Qwen Team di Alibaba — uno dei più completi ecosistemi open-source al mondo per l'intelligenza artificiale. La terza generazione (Qwen3, aprile 2026) copre tutto: dalla chat testuale alla generazione di immagini, dal coding agli agenti autonomi, con modelli eseguibili su un laptop consumer fino a cluster multi-GPU.
A differenza di molti modelli cinesi, Qwen3 è rilasciato sotto licenza Apache 2.0 — puoi scaricarlo, modificarlo, usarlo commercialmente senza royalties. È l'unica famiglia che compete con GPT e Claude sia via API (Alibaba Cloud) sia in esecuzione locale su hardware consumer.
Perché conoscere Qwen nel 2026
- 🆓Completamente gratuito per uso localeI modelli open-weight si scaricano e si eseguono senza costi di API.
- 🌍119 lingue incluso l'italianoAddestrato su 36 trilioni di token in oltre 119 lingue e dialetti.
- 🤖Agenti e tool-calling nativiSupporto nativo al protocollo MCP per l'integrazione con strumenti esterni.
- 📊Benchmark di livello frontierQwen3-235B-A22B supera DeepSeek-R1 su 17 dei 23 benchmark — il miglior open-weight nel 2026.
Da 0.6B a 235B:
tutti i modelli
Qwen3 copre uno spettro di dimensioni unico — da modelli che girano su uno smartphone ai modelli flagship che competono con i migliori sistemi chiusi. Tutti con la stessa API e lo stesso formato.
Per chi ha un laptop normale: Qwen3-8B via Ollama (5-6 GB RAM GPU). Per chi vuole qualità alta su cloud o workstation: Qwen3-32B. Per uso professionale API senza ospitare nulla: Qwen3-235B-A22B via DashScope.
Thinking Mode
vs Non-Thinking Mode
La caratteristica più innovativa di Qwen3 è la modalità di ragionamento ibrida: lo stesso modello può rispondere con pensiero approfondito passo per passo, oppure in modo immediato — e puoi scegliere quale usare per ogni singola domanda.
| Modalità | Come si attiva | Quando usarla |
|---|---|---|
| Thinking Mode | Aggiungi /think nel prompt, oppure abilita nelle impostazioni | Matematica, coding complesso, ragionamento multi-step, decisioni importanti |
| Non-Thinking Mode | Aggiungi /no_think oppure disabilita nelle impostazioni | Risposte rapide, domande semplici, conversazioni, brainstorming leggero |
| Automatico | Non specificare nulla | Il modello decide in base alla complessità apparente del task |
/think Analizza i pro e i contro di implementare una campagna email per un e-commerce B2C che vende abbigliamento sostenibile. Il budget è limitato a €500/mese. Fornisci una raccomandazione finale motivata.
Prima di Qwen3, avere pensiero approfondito richiedeva modelli separati (es. o1 vs GPT-4o). Con il Dual-Mode, puoi usare lo stesso modello per entrambi i casi — il Thinking Mode per analisi critiche che richiedono qualità, il Non-Thinking Mode per le decine di task quotidiani dove la velocità è prioritaria.
L'interfaccia web
Qwen Chat
Qwen Studio (accessibile su qwen.ai o chat.qwen.ai) è l'interfaccia consumer ufficiale di Alibaba per interagire con i modelli Qwen — gratuita, multilingue, con funzioni che vanno oltre la semplice chat.
- 💬Chat testualeAccesso ai modelli Qwen3 con dual-mode, supporto nativo all'italiano e ad altre 119 lingue.
- 🔍Deep ResearchAgent di ricerca autonomo che naviga il web in più step per rispondere a domande complesse con fonti citate.
- 🖼️Generazione immaginiAccesso a Qwen Image e Qwen VLo direttamente dall'interfaccia chat.
- 📄Analisi documentiCarica PDF, immagini, file di testo — il modello li analizza e risponde sul contenuto.
- 📱App mobileDisponibile come app per iOS e Android.
Qwen Studio è principalmente orientata al mercato cinese. Per utenti europei funziona, ma i dati vengono processati su server Alibaba in Cina. Per uso professionale con dati sensibili, valuta l'accesso via API con regione europea o l'uso locale dei modelli open-weight.
Qwen in locale:
Ollama e LM Studio
Uno dei vantaggi più concreti di Qwen3 è la possibilità di eseguirlo direttamente sul proprio computer — nessun abbonamento, nessun dato che esce dalla propria macchina, nessun limite di utilizzo.
ollama run qwen3:8b # oppure per il modello più leggero: ollama run qwen3:4b # Per usare Thinking Mode in Ollama: # Invia il messaggio con /think davanti alla domanda
Requisiti hardware indicativi
| Modello | RAM GPU minima | Tipo di hardware |
|---|---|---|
| Qwen3-4B | ~4 GB | GPU consumer entry-level (GTX 1660, M1 Mac) |
| Qwen3-8B | ~6 GB | GPU consumer (RTX 3060, M2 Mac) |
| Qwen3-14B | ~10 GB | GPU mid-range (RTX 3080, M2 Pro Mac) |
| Qwen3-32B | ~20 GB | GPU professionale o Mac M3 Max/Ultra |
Se Ollama richiede il terminale, LM Studio offre un'interfaccia grafica drag-and-drop per scaricare e avviare Qwen3 con un clic — ideale per chi vuole sperimentare localmente senza familiarità con la riga di comando. Vedi la guida LM Studio nella stessa collezione.
Qwen Image
e Qwen VLo
Qwen non è solo testo — la famiglia include modelli dedicati alla generazione e all'editing di immagini, con una capacità di rendering del testo particolarmente avanzata.
- 🖼️Qwen Image (20B)Modello di generazione immagini con rendering superiore di testo complesso (multi-riga, paragrafi, layout specifici). Supporta sia caratteri latini che CJK.
- ✏️Qwen-Image-EditLa versione di editing di Qwen Image — estende le capacità di rendering al ritocco di immagini esistenti: modifica testo, trasferisci stile, genera partendo da un'immagine di riferimento.
- 🎨Qwen VLoIl modello visivo-linguistico multimodale unificato: genera, modifica, trasferisci stile, combina più elementi — tutto con comprensione profonda del contesto.
Per testo in italiano dentro le immagini: Qwen Image e Seedream sono le migliori opzioni. Per SVG nativi: Recraft. Per video: Kling o Veo. Qwen Image eccelle nei layout editoriali con testo complesso (infografiche, packaging, locandine con paragrafi interi).
Il modello frontier
per gli agenti
Qwen 3.7-Max (lanciato il 19 maggio 2026) è la versione closed-source di punta di Alibaba — non scaricabile, accessibile solo via API, progettata specificamente per flussi di lavoro agentici di lunga durata.
| Caratteristica | Qwen3 Open-Source | Qwen 3.7-Max |
|---|---|---|
| Licenza | Apache 2.0 (libero) | API-only, closed-source |
| Contesto | 128K token | 1 milione di token |
| Specializzazione | General-purpose | Agent frontier, task lunghi |
| Costo API | Gratuito (locale) | ~$1.25/M input, $3.75/M output |
| Quando usarlo | Tutto il resto | Task agentici che durano ore, 1M token context |
Alibaba ha dimostrato una sessione di esecuzione autonoma di 35 ore con 1.158 tool call senza intervento umano. Il context window da 1M token significa poter caricare un'intera codebase o raccolta documentale in un singolo prompt — un vantaggio concreto per repository-level analysis e multi-session agent memory.
Qwen 3.7-Max non ha un'interfaccia consumer dedicata come Qwen Chat — si accede tramite Alibaba Cloud DashScope (API diretta) o aggregatori come OpenRouter e Yotta AI Gateway che lo includono nel loro catalogo modelli.
Prima sessione
con Qwen Chat
- Vai su chat.qwen.ai e accedi (o crea un account gratuito).
- Invia questo prompt in modalità normale: "Qual è la strategia migliore per aumentare le vendite di un e-commerce di nicchia?"
- Ora invia lo stesso prompt preceduto da
/think— osserva il pensiero step-by-step che appare prima della risposta finale. - Confronta le due risposte: qual è più approfondita? Quale più rapida e pratica?
- Prova la funzione Deep Research su una domanda di mercato reale del tuo settore.
Qwen3 in locale
con Ollama
- Se non hai Ollama, scaricalo da ollama.ai e installalo (vedi guida Ollama nella stessa collezione).
- Apri il terminale ed esegui:
ollama run qwen3:8b— il download avviene automaticamente la prima volta (~5 GB). - Fai la stessa domanda usata nell'Esercizio 1 — confronta la qualità della risposta locale vs quella cloud.
- Prova a inviare
/think Risolvi: se 3x + 7 = 22, quanto vale x?— osserva il ragionamento passo per passo in locale. - Valuta: per quali tipi di task useresti il modello locale? Per quali preferiresti il cloud?