
Comment utiliser Qwen Image 3.0 en 2026 (et pourquoi il n'y a pas encore d'API)
Qwen Image 3.0 n'a pas encore d'API publique. Où essayer la 3.0 officielle, et comment générer des images au texte net dans le navigateur — deux premières gratuites.
Qwen Image 3.0 a fait ses débuts le 21 juillet, et la première chose que la plupart des gens ont tapée après l'annonce, c'était une variante de la même question : comment est-ce que j'utilise vraiment ça ? L'équipe Qwen d'Alibaba a appelé ça la troisième génération, en misant sur le tour de force qui a fait la réputation de cette ligne — du texte dans les images que vous pouvez vraiment lire — puis a renvoyé tout le monde vers Qwen Chat, et nulle part ailleurs. Pas de poids, pas de licence, pas d'API, pas même de tableau de benchmark.
Donc c'est le guide pratique que je suis allé chercher et que je n'ai pas trouvé : ce que 3.0 fait vraiment, s'il y a une API que vous pouvez appeler (il n'y en a pas, pour l'instant), et comment je génère dans le même style Qwen centré sur le texte à partir d'un simple onglet de navigateur pendant que les poids 3.0 restent verrouillés.
Ce que Qwen Image 3.0 fait vraiment
L'annonce fait trois affirmations, et elles précisent ce qui a toujours fait la réputation de la ligne d'images Qwen :
- Rendu de texte dans 12 langues et plus de 20 polices. Titres, panneaux, étiquettes — nets et lisibles au lieu de se dissoudre en pseudo-lettres — et pas seulement en alphabet latin : le chinois est celui que cette ligne a toujours le mieux géré. C'est la fonction vedette et la raison pour laquelle les gens cherchent Qwen plutôt que des modèles plus jolis mais analphabètes.
- Mises en page denses en connaissances à partir d'un très long prompt. 3.0 peut traiter jusqu'à environ 4 500 tokens d'instruction en une seule passe (la version précédente plafonnait à près de 1 000), et les démos en tirent pleinement parti : formules, figures géométriques, dérivations logiques, infographies multi-panneaux, mockups d'interface, même des pages aussi denses qu'une page de journal et des mises en page académiques riches en mathématiques.
- Détail photoréaliste — peau, cheveux, papier, la texture qu'on attend d'une vraie photo, plus proche de l'appareil photo que du rendu de synthèse.
Ce qui n'est pas dans l'annonce est aussi bruyant que ce qui l'est : pas de nombre de paramètres, pas de licence, pas de poids, pas d'API. Officiellement, vous rencontrez Qwen Image 3.0 uniquement dans Qwen Chat et nulle part ailleurs, du moins aujourd'hui.
Y a-t-il une API Qwen Image 3.0 ?
Réponse courte : pas encore. Il n'y a pas de point de terminaison officiel à appeler, et pas de poids téléchargeables à auto-héberger.
Cela déroute les gens parce que chaque site tiers avec un bouton « Qwen » a une API derrière — juste pas celle de 3.0. Ils exécutent un modèle d'image Qwen antérieur (2.0 et avant), les versions qui passent déjà par le DashScope propre d'Alibaba, plus des routeurs comme OpenRouter et des ponts gratuits comme Puter. N'importe qui prétend servir les poids 3.0 aujourd'hui va, pour rester charitable, un peu vite en besogne. Quand Alibaba ouvrira une vraie API 3.0, c'est ce jour-là que les outils pourront vraiment y basculer.
Donc « l'utiliser » se divise en deux : la 3.0 officielle, exactement comme Alibaba l'a mise au point, vit dans Qwen Chat, et générer dans le même style Qwen centré sur le texte depuis un navigateur signifie exécuter le modèle d'image Qwen qui répond déjà à un point de terminaison. C'est ce deuxième chemin que nous empruntons sur notre page Qwen Image 3.0 — un site indépendant, non affilié à Alibaba, qui reconnaît clairement que le moteur actif est le modèle d'image actuellement disponible de Qwen, et non les poids inédits 3.0.
Ce que le modèle d'image Qwen disponible sait bien faire (j'ai testé)
Avant d'écrire quoi que ce soit sur le sujet, j'ai fait tourner de vrais prompts dessus, et la réputation de rendu de texte tient — avec une limite qui mérite d'être connue.
Le texte court et grand revient net du premier coup. J'ai demandé une devanture de boulangerie au crépuscule avec une enseigne lisant « SUNRISE BAKERY » au-dessus du chinois « 日出面包房 » et j'ai obtenu les deux écritures nettes et correctement orthographiées, néon brillant et tout — le panneau bilingue que la plupart des modèles transforment en soupe alphabétique.

Les affiches se comportent de la même façon. Un brief d'une seule ligne — grand titre, une petite ligne de détails — est revenu avec « DESIGN WEEK 2026 » et « Talks · Workshops · Exhibits » assez net pour être utilisé tel quel.

La limite : quand j'ai poussé le curseur vers du texte dense — un tableau de bord météorologique avec six petits champs étiquetés — les petits caractères se sont dissous en charabia, l'échec classique du texte en IA. Donc la règle à laquelle je me suis arrêté est simple : gardez les mots dans l'image peu nombreux et grands. Un titre gras plus deux ou trois courtes étiquettes se rendent magnifiquement ; un mur de petites légendes non. Une infographie propre avec un titre et une poignée d'étiquettes d'un mot se situe juste dans la zone idéale.

Aucune de ces images n'avait besoin d'un tour de prompt — juste du texte court, entre guillemets, et une mise en page claire. Si vous avez lutté contre des lettres brouillées sur d'autres modèles, rien que ça, c'est la raison de choisir la famille Qwen.
Comment utiliser Qwen Image 3.0 aujourd'hui, en trois étapes
- Voir le plafond dans Qwen Chat. Ouvrez la version 3.0 officielle où Alibaba l'héberge et lancez votre prompt de texte le plus difficile — une affiche bilingue, un diagramme étiqueté. C'est la référence pour ce que les poids 3.0 peuvent faire.
- Générez dans le même style dans un navigateur. Ouvrez le générateur Qwen Image 3.0, connectez-vous avec Google, et dépensez les crédits de bienvenue — les deux premières images sont gratuites. Gardez tout texte dans l'image court et mettez les mots exacts entre guillemets. Il fait du texte-vers-image et de l'édition d'images, sur cinq formats.
- Réglez le format avant d'écrire le prompt. Les cinq de Qwen sont 1:1, 3:4, 4:3, 9:16 et 16:9 — un éventail différent de celui de Grok, qui propose 3:2 et 2:3 — et le sélecteur n'accepte rien d'autre, donc choisir le cadre d'abord vous économise une passe de recadrage.
Où il se situe à côté des modèles que vous connaissez déjà
Le rendu de texte n'est pas l'apanage de Qwen. GPT Image 2 est l'autre modèle en qui j'ai confiance pour les mots dans une image, et il monte jusqu'à 4K pour l'impression — le moteur de finition quand un brouillon doit partir. La ligne Nano Banana de Google est le cheval de trait rapide et bon marché ; Grok Imagine est le choix rapide et photoréaliste, que j'ai comparé dans 6 alternatives à Grok Imagine. L'avantage spécifique de Qwen est le texte bilingue et les mises en page denses en connaissances à partir d'un long prompt — utilisez-le quand les mots dans l'image comptent autant que l'image. Et si vous préférez tester par vous-même plutôt que de lire à ce sujet, l'atelier texte-vers-image met la gamme principale du site dans une seule liste déroulante.
En bref
Qwen Image 3.0 est une vraie avancée pour la génération centrée sur le texte, et pour l'instant il y a exactement une porte officielle — Qwen Chat, pas de poids, pas d'API. Cela change le jour où Alibaba expédie des poids ou un point de terminaison ; en attendant, la façon honnête de travailler dans le style Qwen à partir d'un navigateur est le modèle qui répond déjà à un point de terminaison, ce que notre page exécute — aucune usurpation des poids 3.0, juste le rendu de texte de la famille Qwen avec vos deux premières images gratuites. Gardez les mots courts et laissez-le faire la chose qu'il fait mieux que presque tout le reste : orthographier.
À lire aussi
Plus d'articles

Reverse prompt GPT Image 2 : reproduire n'importe quelle image
Un guide pratique de reverse-prompt GPT Image 2. Uploadez n'importe quelle image de référence, obtenez un prompt reproductible en quelques secondes. 4 techniques + modèles prêts à coller.

GPT Image 2 pour le cross-border : images de couverture en 8 langues
Utilisez GPT Image 2 pour l'e-commerce transfrontalier : générez une image de couverture, déclinez-la en 8 langues avec un texte correct. Pour Amazon, Shopee, TikTok Shop.

Qu'est-ce que GPT Image 2 ? Une introduction complète
GPT Image 2 est le modèle d'image multimodal nouvelle génération d'OpenAI — le premier à gérer de manière fiable le texte non latin et les mises en page complexes. Tout ce qu'il faut savoir.
Generate your first image with GPT Image 2 — right now
Reliable non-Latin text rendering, directed editing, and 50+ ready-to-use prompts. No downloads — just open in your browser.