Qwen-Image-2.1

Qwen-Image-2.1 是通義 Qwen 團隊於 2026 年 9 月 20 日開源的圖像模型。它把生成與編輯放在同一個模型裡,原生輸出透明(RGBA)圖像,單次編輯最多接收 10 張參考圖,並以 7B 的生成 Transformer 支援 2K 解析度。GoEnhance 目前尚未上線 2.1,因此下方控制台開啟的是站上最新的 Qwen 模型 Qwen Image 3。
中英雙語海報排版
中英雙語海報排版
中英雙語海報排版
標籤清晰的產品圖
標籤清晰的產品圖
六格分鏡
六格分鏡
雜誌感人像
雜誌感人像
Qwen Image 3
提示詞
範例提示詞
將帶著該模型與提示詞開啟 GoEnhance 創作台。

在 GoEnhance 用 Qwen Image 能做什麼

文字不會糊掉的海報

把標題、日期與小字排進畫面,中英文都能立住。適合真的要放文案的活動海報、主視覺與社群封面。

文字不會糊掉的海報

標籤看得清的產品圖

把產品放在乾淨背景上,光線保持柔和,標籤文字依然清楚。可直接用於商品圖、商品頁與包裝草案。

標籤看得清的產品圖

多格圖板與網格

要六格圖板、九宮格科普圖或設計版面,每一格都是同一種畫風,小標題也能放在你指定的位置。

多格圖板與網格

膚質與光線自然的人像

生成膚質真實、眼神有高光、窗光柔和的雜誌感人像,之後只改服裝或取景,人臉不會跑掉。

膚質與光線自然的人像

Qwen-Image-2.1 有哪些新東西

原生透明,不是去背

模型內建 64 通道 RGBA 自編碼器,空間壓縮 16 倍,透明是模型本身的能力而非後製。可以直接依提示詞生成透明圖、編輯透明圖層,也能把主體從一般照片裡取出。

生成與編輯同一個模型

文生圖與圖像編輯走同一條流程。可以從提示詞開始,也可以丟一張圖進去改,或在同一次請求裡兩件事一起做,中途不必換模型。

最多 10 張參考圖

單次編輯最多可給十張參考圖:用多張單人照拼出合照,或把模特、衣服、鞋、包、帽子的分開拍攝組成一整套穿搭。

直接圈出要改的地方

局部修改可用圈選、手繪標註或單獨遮罩指定。人物與商品的特徵維持不變,只有標出的區域會改。

7B 的精簡結構

生成 Transformer 為 32 層單流 DiT、7B 參數,文字編碼器採用 Qwen3-VL 8B。混合粒度注意力加上前綴 KV 快取重用,提示詞與參考圖只編碼一次,後續每一步重複使用。

原生 2K,文字更俐落

建議尺寸從 1:1 的 2048×2048 到 16:9 的 2752×1536,預設 40 步。排版、人像光線與細節質感都優於上一代 Qwen-Image。

自己把 Qwen-Image-2.1 跑起來

01

取得權重

Qwen-Image-2.1 為開源權重。可從 Hugging Face(Qwen/Qwen-Image-2.1)或 ModelScope 下載,也可以直接使用 Comfy-Org/Qwen-Image-2.1 這份適配 ComfyUI 的版本。

02

選一個執行環境

Diffusers 首日即以 QwenImage21Pipeline 支援,ComfyUI 也內建生成與編輯工作流。量大時,vLLM-Omni、SGLang 與 LightX2V 提供前綴快取、量化與多卡推論;AMD ROCm 與 FlagOS 適配的晶片同樣可跑。

03

提示詞、尺寸與透明

先用官方的提示詞改寫模型(生成用 PE-T2I、編輯用 PE-I2I),尺寸與步數依建議的 2K 與 40 步。需要透明結果時,提示詞開頭依模型慣例寫明這是背景透明的 RGBA 圖像。

Qwen-Image-2.1 與 GoEnhance 上的 Qwen Image 比較

比較項目Qwen-Image-2.1(開源權重)Qwen Image 3(GoEnhance 站上)
在哪裡跑自己的 GPU,或自行架設的雲端環境瀏覽器裡直接用,不必安裝
透明 RGBA 輸出原生支援,也能編輯透明圖層不支援
參考圖單次編輯最多 10 張編輯器支援參考圖
解析度原生 2K,最高 2752×1536支援 1K 與 2K 輸出
文字渲染中英文排版優於上一代中英文字與密集版面都穩
上手方式下載權重、安裝環境、自行管理顯卡寫提示詞,按下生成

Qwen-Image-2.1 常見問題

Qwen-Image-2.1 是什麼?

它是通義 Qwen 團隊開源的圖像模型,把文生圖與圖像編輯做進同一個模型。生成 Transformer 為 32 層單流 DiT、7B 參數,原生輸出透明 RGBA 圖像。權重於 2026 年 9 月 20 日公開。

能在 GoEnhance 上用 Qwen-Image-2.1 嗎?

目前還不行。站上提供的是 Qwen Image 2、Qwen Image 2 Pro、Qwen Image 3 與 Qwen Image 3 Pro。本頁控制台開啟的是站上最新的 Qwen Image 3,不必自備顯卡就能試同系列的效果。

商用免費嗎?

儲存庫採用 Qwen Research License Agreement,與一般商用授權不同。把權重或生成結果用於商業專案前,請先閱讀 GitHub 上的授權原文。

透明圖是怎麼生成的?

透明能力做在自編碼器裡:64 通道 RGBA VAE,空間壓縮 16 倍。在提示詞裡寫明這是背景透明的 RGBA 圖像,拿到的就是帶真實 alpha 通道的圖,而不是去背遮罩。

需要什麼硬體?

生成部分 7B、文字編碼器 8B,實際上需要一張顯存足夠的較新顯卡。社群的執行環境也有幫助:vLLM-Omni 與 SGLang 支援 FP8 權重、CPU 卸載與多卡並行,LightX2V 則面向消費級顯卡。

最多能用幾張參考圖?

單次編輯最多十張。這讓多主體合成變得可用:一個畫面放多個人,或用分開拍的產品圖組成整套穿搭,而每個元素仍然認得出來。

在 GoEnhance 試試 Qwen Image 系列

Qwen-Image-2.1 是開源權重,需要自行準備機器來跑。如果你更想寫一句提示詞就拿到圖,就在 GoEnhance 開啟 Qwen Image 3,從上面任一示例開始。

從 Qwen Image 3 開始