Qwen Image 3.0 怎麼用?上手指南,以及為什麼它還沒有 API(2026)
2026/07/21

Qwen Image 3.0 怎麼用?上手指南,以及為什麼它還沒有 API(2026)

Qwen Image 3.0 怎麼用?阿里這款文字優先新模型暫無公開 API。這篇講清去哪兒試官方 3.0,以及今天怎麼在瀏覽器裡免費生成同款文字清晰的圖。

Qwen Image 3.0 在 7 月 21 日發佈,公告一出,大多數人打出來的第一句,翻來覆去都是同一個問題:*這玩意兒到底怎麼用?*阿里巴巴 Qwen 團隊稱它為第三代,主打這條產品線一貫的看家本領——圖裡能讀的文字——然後把大家指向 Qwen Chat,再無別處。沒有權重、沒有 license、沒有 API,連 benchmark 表都沒有。

所以這篇就是我自己去找、卻沒找到的實用指南:3.0 到底能做什麼,有沒有能呼叫的 API(暫時沒有),以及趁 3.0 權重還鎖著,我怎麼在一個普通瀏覽器標籤頁裡做出同款文字優先的 Qwen 風格。

Qwen Image 3.0 到底能做什麼

公告給了三條,都在把 Qwen 圖像模型本來就擅長的事做得更極致:

  • **12 種語言、20+ 字體的文字渲染。**標題、招牌、標籤,能乾淨地排進畫面,而不是糊成一團假字母——而且不只拉丁字母,中文尤其是這條線一直最拿手的。這是頭號賣點,也是大家寧可繞開那些「好看但文盲」的模型來找 Qwen 的原因。
  • **一條超長提示詞裡的知識密集排版。**3.0 單次能吃約 4,500 個 token 的指令(上一代上限約 1,000),示例也往這上面猛推:公式、幾何圖形、邏輯推導、多面板資訊圖、UI 介面,甚至報紙般密集的版面和滿是數學符號的學術論文排版。
  • 照片級細節——皮膚、髮絲、紙張那套質感,接近相機而不是渲染。

而公告裡「沒有」的部分和「有」的一樣響亮:沒有參數量、沒有 license、沒有權重、沒有 API。官方管道就是 Qwen Chat 一處,至少今天如此。

Qwen Image 3.0 有 API 嗎?

先說結論:暫時沒有。沒有能呼叫的官方端點,也沒有可自建的開源權重。

這一點最容易把人繞暈,因為你在第三方站上見到的每一個「Qwen」按鈕背後確實有 API——只不過不是 3.0 的。那些跑的是更早的 Qwen 圖像模型(2.0 及更早),也就是透過阿里自家 DashScope、以及 OpenRouter 這類路由和 Puter 這類免費橋接早就在供的版本。今天誰要說自己在跑 3.0 的權重,說好聽點,是搶在了事實前面。等阿里真的放出 3.0 的 API,那天各家工具才能切過去。

所以「用它」分成兩條路:想要阿里原汁原味調好的官方 3.0,在 Qwen Chat 裡;想在瀏覽器裡用同樣文字優先的 Qwen 風格生成,就用已經有端點的那個 Qwen 圖像模型。第二條路正是我們的 Qwen Image 3.0 頁面在做的——一個獨立站點,與阿里巴巴沒有官方關聯,也如實說明線上跑的是當前可用的 Qwen 圖像模型,而不是尚未開放的 3.0 權重。

可用的 Qwen 圖像模型實際擅長什麼(我實測了)

動筆前我拿真實提示詞跑了一輪,文字渲染的名聲確實站得住——但有一條邊界值得記住。

短而大的文字,第一次就出得乾淨。我要了一張黃昏的麵包店門面,招牌上英文「SUNRISE BAKERY」配中文「日出麵包房」,兩種文字都清晰、拼寫正確,霓虹質感也在——這種雙語招牌,大多數模型都會渲成字母湯。

黃昏麵包店門面,霓虹招牌上英文 SUNRISE BAKERY 配中文「日出麵包房」,兩種文字都清晰可讀

海報也一樣。一句話的簡報——大標題加一行小字——回來的是「DESIGN WEEK 2026」和「Talks · Workshops · Exhibits」,排得乾淨到可以直接用。

活動海報,大標題 DESIGN WEEK 2026,副標題 Talks、Workshops、Exhibits,字跡清晰規整

邊界在這裡:當我把它往密集文字上推——一個帶六個小字段標籤的天氣儀表板——小號字就化成了亂碼,經典的 AI 文字翻車。所以我總結的規則很簡單:圖裡的字要少、要大。一個醒目標題加兩三個短標籤能出得很漂亮;一整牆小字說明就不行。一張有一個標題加幾個單詞標籤的資訊圖,正好落在最舒服的區間。

扁平風資訊圖,標題 RENEWABLE ENERGY,三個大圖標分別標註 SOLAR、WIND、HYDRO

這些都不需要提示詞技巧——只要文字短、用引號框住、排版清楚。要是你在別的模型上被糊字折磨過,光這一點就夠你轉投 Qwen 這條線了。

三步,今天就用上 Qwen Image 3.0

  1. **去 Qwen Chat 看上限。**在阿里託管的地方打開官方 3.0,跑你最難的文字提示詞——雙語海報、帶標註的圖表。那是 3.0 權重能力的參照。
  2. **在瀏覽器裡做出同款風格。**打開 Qwen Image 3.0 生成器,用 Google 登入,把註冊贈送的額度花掉——前兩張圖免費。圖裡的文字盡量短,把要出現的原文用引號標出來。它支援文生圖和圖像編輯,共五種比例。
  3. **先定畫幅再寫提示詞。**Qwen 給的是五種——1:1、3:4、4:3、9:16 和 16:9——和 Grok 的 3:2、2:3 是不一樣的一組,而且選擇器不收這五種以外的,所以先把畫幅定下來,能省一次重裁的額度。

它在你熟悉的那些模型裡排在哪兒

文字渲染不是 Qwen 獨有。GPT Image 2 是我另一個敢託付文字的模型,而且能到 4K 做印刷——草稿要交付時的收尾引擎。谷歌的 Nano Banana 系是又快又便宜的主力;Grok Imagine 是照片級速度派,我在 6 個 Grok Imagine 替代裡比過。Qwen 特有的優勢是雙語文字加一條長提示詞裡的知識密集排版——當畫面裡的字和畫面本身一樣重要時,選它。真想上手比而不是光看字,文生圖工作室把本站主力模型都放在一個下拉裡。

寫在最後

Qwen Image 3.0 對文字優先的生成是一次實打實的進步,而它眼下只有一道官方的門——Qwen Chat,無權重、無 API。等阿里放出權重或端點,這就會變;在那之前,想在瀏覽器裡用 Qwen 風格幹活,誠實的路子就是那個已經有端點可呼叫的模型,也就是我們這頁跑的東西——不假冒 3.0 權重,只是 Qwen 家族的文字渲染,外加你的前兩張圖免費。把字寫短,讓它去做那件它比幾乎所有模型都強的事:把字拼對。

延伸閱讀

Free to try

Generate your first image with GPT Image 2 — right now

Reliable non-Latin text rendering, directed editing, and 50+ ready-to-use prompts. No downloads — just open in your browser.