使用清晰的參考圖
模糊或被遮住一部分的臉,會讓模型無從著手。請選擇光線均勻、主體在畫面中占有相當比例的圖片。
BestAIVideo
Qwen Image 2.1 是阿里巴巴的整合型模型,既能生成圖片,也能編輯你手上現有的圖片。你可以用文字描述畫面,或上傳最多 10 張參考圖片並告訴它要改什麼,再選擇 1K 或 2K,提交之前先看到積分花費。
Qwen 形容這個模型小巧卻能幹,字體排印有所改進,編輯時對身分的保留也更強。以下是生成器開放給你的功能。
要生成新圖片就用文字模式;要修改手邊現有的圖片,就用圖片編輯模式,搭配一到十張參考圖。
Qwen 表示,人物和商品在編輯後仍然認得出來。請選擇清晰、正面的參考圖,才最有機會對得上。
可選 1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:9 或 9:21。編輯模式還多了一個自動選項,會依照你參考圖的形狀。
1K 是 4 積分,2K 是 7 積分,文字生成與編輯皆然。參考圖片的數量從不會改變價格。
Qwen 的範例用的是簡短、平實的指令,凡是要出現在圖片裡的文字,都放進引號。依這個模式來寫,只在有幫助的地方再補充細節。
點出主體、場景和氣氛,例如下雨夜裡霓虹商店招牌與濕漉漉的人行道。看到第一個結果之後,再補充細節。
Qwen 強調它的字體排印會考量字型樣式與版面。請把確切的文字放進引號,並描述字體的風格,而不只是寫出字詞。
編輯時,直接寫出你想改的地方,例如把背景改成夕陽海灘,並說明哪些部分必須維持不變。
有多張圖片時,要說明哪一張提供角色、哪一張提供背景、哪一張提供風格,才不用讓模型自己猜。
圖表區塊、長條圖、一張表格和一段圖說,擠在同一個密集的頁面上。這是對小字標籤和版面的壓力測試,也是生成之後逐字檢查的好地方。
一條穿紅衣的卡通龍騎著喜慶的獅子,周圍有燈籠和彩帶,背景是乾淨的白色。貼圖類的提示詞,最好要求粗線條輪廓和純色背景。
一個手機畫面包含問候語、聖托里尼的主視覺卡片、四個規劃圖示和行程清單,全都排在同一張直式圖片裡。它顯示介面樣稿可以只用一則提示詞就打出草稿。
模糊或被遮住一部分的臉,會讓模型無從著手。請選擇光線均勻、主體在畫面中占有相當比例的圖片。
限時動態這類高窄的格式用 9:21,電影感的頁首圖用 21:9。在編輯模式中,自動會沿用第一張參考圖的形狀。
密集的圖表和小字說明,是生成文字最常出錯的地方。把圖片放進文件之前,先放大到原始尺寸檢查。
上傳同一件商品的多張照片,把它放進新的場景,形狀和顏色仍然認得出來。
先生成標題放在引號裡的海報,再切換成 9:21 或 21:9,做出直式或全景的版本。
為聊天貼圖、包裝和活動物料,製作背景乾淨的角色圖。
在設計團隊動手製作之前,先勾勒出 App 畫面和落地頁的草圖。
用輕微的調整來編輯臉部照片,並以原圖當參考,來保留身分特徵。
把最多十張上傳圖片中的元素組合成一個構圖,並說明每個檔案提供哪一個元素。
它是阿里巴巴 Qwen 團隊於 2026 年 9 月發布的模型,把文生圖與圖片編輯整合在同一個模型裡。
編輯模式最多 10 張,且至少需要一張。文字模式則不需要。
尺寸有 1K 和 2K。文字模式提供 1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:9 和 9:21,編輯模式則多了自動,並以它為預設值。
1K 圖片是 4 積分,2K 圖片是 7 積分。文字模式與編輯模式的價格相同,生成器會在你提交之前顯示金額。
提示詞最多可達 5,000 個字元,足夠寫下詳細的場景,再加上幾行放在引號裡的文字。
用平實的指令,例如把背景改成夕陽海灘,再補上哪些部分要維持不變。可以的話,每次請求只改一件事。
Qwen 強調它改進了字體排印,會考量字型樣式與版面。請把確切的文字放進引號,描述字體,並校對小字。
Qwen 說明這個模型有原生的透明輸出,但這個生成器並沒有透明度的控制項,所以請要求純色背景,再自行去背。
它是獨立、較新的模型,有自己的價格和 1K、2K 尺寸。較早的 Qwen 項目維持各自的設定與價格。
它的 4 和 7 積分,介於 3 積分的 Seedream 5.0 Flash,與 5、8、13 積分的 GPT Image 2.5 之間。