
Come usare Qwen Image 3.0 nel 2026 (e perché ancora non ha API)
Qwen Image 3.0 — niente API pubblica. Dove trovare la versione ufficiale e come generare testo nitido dal browser — le prime due gratis.
Qwen Image 3.0 è arrivata il 21 luglio, e la prima reazione di chiunque abbia letto l'annuncio è stata la stessa: ok, ma come la uso davvero? Il team Qwen di Alibaba l'ha presentata come terza generazione, puntando sul tratto distintivo di questa linea — il testo dentro le immagini che si legge davvero — poi ha indirizzato tutti verso Qwen Chat e, stranamente, da nessun'altra parte. Niente pesi, niente licenza, niente API, neanche una tabella comparativa.
Questa è la guida pratica che ho cercato ma non trovato: cosa fa davvero 3.0, se c'è un'API da chiamare (per il momento non c'è), e come sto generando nello stesso stile Qwen text-first da una semplice scheda del browser mentre i pesi 3.0 restano blindati.
Cosa fa davvero Qwen Image 3.0
L'annuncio fa tre affermazioni, che affinano ciò che la linea di immagini di Qwen era già nota per fare:
- Rendering di testo in 12 lingue e 20+ font. Titoli, insegne, etichette — che si posizionano netti dentro l'immagine invece di stemperarsi in pseudo-lettere — e non solo in alfabeto latino: il cinese è quello che questa linea ha sempre gestito meglio. È la caratteristica di punta, il motivo per cui la gente sceglie Qwen rispetto ai modelli più belli ma analfabeti.
- Layout ricchi di contenuti partendo da un prompt lunghissimo. 3.0 accetta fino a circa 4.500 token di istruzioni in una sola generazione (la versione precedente si fermava intorno a 1.000), e i demo spingono forte in questa direzione: formule, figure geometriche, derivazioni logiche, infografiche multi-pannello, mockup di interfacce, persino pagine dense come giornali e layout accademici pieni di matematica.
- Dettagli fotorealistici — pelle, capelli, texture della carta, tutta la storia del realismo, più simile a una fotografia che a un rendering.
Quello che non c'è nell'annuncio è altrettanto sonoro: niente numero di parametri, niente licenza, niente pesi, niente API. Ufficialmente incontri Qwen Image 3.0 solo dentro Qwen Chat e da nessun'altra parte, almeno per ora.
Qwen Image 3.0 ha un'API?
Risposta breve: non ancora. Non c'è un endpoint ufficiale da chiamare, e neanche pesi scaricabili da ospitare in autonomia.
Questo crea confusione perché qualsiasi sito terzo con un bottone "Qwen" ha un'API dietro — solo che non è quella di 3.0. Quelli fanno girare versioni precedenti del modello Qwen (2.0 e prima), quelle che già passano attraverso DashScope di Alibaba, più router come OpenRouter e bridge gratuiti come Puter. Chi oggi sostiene di servire i pesi 3.0 è, a essere generosi, solo un po' avanti rispetto ai fatti. Quando Alibaba apre una vera API 3.0, quello è il giorno in cui i tool possono davvero passarci.
Quindi "usarla" si divide in due percorsi: l'ufficiale 3.0 esattamente come Alibaba l'ha messa a punto vive in Qwen Chat, e generare nello stesso stile text-first di Qwen dal browser significa usare il modello Qwen già disponibile che risponde a un endpoint. Questo secondo percorso è quello che facciamo nella nostra pagina Qwen Image 3.0 — un sito indipendente, non affiliato ad Alibaba, che dice chiaramente che il motore live è il modello Qwen attualmente disponibile, non i pesi 3.0 non ancora rilasciati.
Cosa sa fare davvero il modello Qwen image disponibile (l'ho testato)
Prima di scrivere tutto questo, ho fatto girare prompt reali, e la reputazione di rendering testuale regge — con un limite che vale la pena conoscere.
Il testo breve e grande torna pulito al primo colpo. Ho chiesto una vetrina di panetteria al tramonto con una scritta "SUNRISE BAKERY" sopra il cinese "日出面包房" e ho ottenuto entrambi gli alfabeti nitidi e corretti, insegna al neon e tutto — il cartello bilingue che la maggior parte dei modelli trasforma in zuppa di lettere.

I poster funzionano allo stesso modo. Un brief di una riga — grande titolo, una piccola riga di dettagli — è tornato con "DESIGN WEEK 2026" e "Talks · Workshops · Exhibits" sistemati con una pulizia tale da poterli usare così come sono.

Il limite: quando ho spinto verso testo denso — una dashboard meteo con sei piccoli campi etichettati — le scritte piccole si sono dissolte in un guazzabuglio incomprensibile, il classico difetto del testo generato dall'IA. Quindi la regola a cui sono arrivato è semplice: pochi caratteri e grandi dentro l'immagine. Un titolo audace più due o tre etichette brevi rendono magnificamente; un muro di didascalie minuscole no. Un'infografica pulita con un titolo e una manciata di etichette da una parola cade proprio nella zona ideale.

Nessuno di questi ha avuto bisogno di trucchi nel prompt — solo testo breve fra virgolette e un layout chiaro. Se hai combattuto con lettere in disordine su altri modelli, questo da solo è un buon motivo per rivolgerti alla famiglia Qwen.
Come usare Qwen Image 3.0 oggi, in tre passi
- Vedi il massimo dentro Qwen Chat. Apri la 3.0 ufficiale dove Alibaba la ospita e lanciaci il tuo prompt testuale più complesso — un poster bilingue, un diagramma etichettato. Quello è il riferimento per ciò che i pesi 3.0 possono fare.
- Genera nello stesso stile da un browser. Apri il generatore Qwen Image 3.0, accedi con Google, e spendi i crediti di benvenuto — le prime due immagini sono gratis. Tieni breve il testo dentro l'immagine e metti le parole esatte fra virgolette. Fa text-to-image e image editing, su cinque proporzioni.
- Scegli la proporzione prima di scrivere il prompt. I cinque che Qwen offre sono 1:1, 3:4, 4:3, 9:16 e 16:9 — uno spettro diverso da quello di Grok che ha 3:2 e 2:3 — e il selettore non accetta altro al di fuori di questi cinque, quindi scegliere la cornice prima ti risparmia una correzione.
Come si colloca rispetto ai modelli che già conosci
Il rendering testuale non è appannaggio esclusivo di Qwen. GPT Image 2 è l'altro modello di cui mi fido per il testo dentro l'immagine, e arriva a 4K per la stampa — il motore di finitura quando una bozza deve andare in consegna. La linea Nano Banana di Google è il cavallo da lavoro veloce ed economico; Grok Imagine è la scelta del fotorealismo veloce, che ho comparato in 6 alternative a Grok Imagine. Il vantaggio specifico di Qwen è il testo bilingue e i layout ricchi di contenuti da un prompt lungo — scegli Qwen quando le parole dentro l'immagine contano tanto quanto l'immagine. Se preferisci provare piuttosto che leggere, lo studio text-to-image mette la rosa principale del sito in un unico menu a tendina.
La conclusione
Qwen Image 3.0 è un vero passo avanti per la generazione text-first, e per adesso c'è esattamente una porta ufficiale — Qwen Chat, senza pesi, senza API. Questo cambia il giorno in cui Alibaba rilascia i pesi o un endpoint; finché non accade, il modo onesto di lavorare nello stile Qwen da browser è il modello che risponde già a uno, che è quello che la nostra pagina esegue — nessuna impostura dei pesi 3.0, solo il rendering testuale della famiglia Qwen con le tue prime due immagini gratis. Mantieni le parole brevi e lascia che faccia l'unica cosa che fa meglio di quasi qualsiasi altro modello: scrivere correttamente.
Letture correlate
Altri articoli

GPT Image 2 vs Muse Image: 6 differenze reali per scegliere nel 2026
GPT Image 2 vs Muse Image — Muse di Meta è arrivato al

GPT Image 2 vs Grok Imagine: velocità o rifinitura? (2026)
GPT Image 2 vs Grok Imagine — ranking arena, accesso, prezzo e resa del testo a confronto, con lo stesso prompt di poster per concerto lanciato sul vero modello Grok e su GPT Image 2.

GPT Image 2 per il cross-border: hero image in 8 lingue
Usa GPT Image 2 per l'e-commerce cross-border: genera una sola hero image e pubblicala in 8 lingue con il testo corretto. Per Amazon, Shopee, TikTok Shop.
Generate your first image with GPT Image 2 — right now
Reliable non-Latin text rendering, directed editing, and 50+ ready-to-use prompts. No downloads — just open in your browser.