使用清晰的参考图
模糊或被部分遮挡的人脸,给模型留下的可抓取信息很少。请选择光线均匀、主体占画面较大比例的图片。
BestAIVideo
Qwen Image 2.1 是阿里推出的统一模型,既能生成图片,也能编辑你已有的图片。你可以用文字描述一幅画面,也可以上传最多 10 张参考图并告诉它要改什么,再选择 1K 或 2K,提交之前先看到积分消耗。
Qwen 把这个模型描述为小巧但能力出众,文字排版有改进,编辑时的人物与产品一致性更强。下面是生成器提供的功能。
文字模式用来生成新图,编辑模式配合一到十张参考图,用来修改你已有的图片。
Qwen 表示,人物和产品在编辑之后仍然可以辨认。请选择清晰、正面的参考图,匹配的机会最大。
可选 1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:9 或 9:21。编辑模式还多一个自动选项,会跟随你的参考图的形状。
1K 是 4 积分,2K 是 7 积分,文字生成和编辑都一样。参考图的数量不会改变价格。
Qwen 的示例都使用简短、平实的指令,图片里必须出现的文字则放进引号。就从这个模式出发,只在有帮助的地方再加细节。
写明主体、场景和氛围,比如一个雨夜里带霓虹招牌的小店,路面湿漉漉的。看到第一版结果之后,再补充细节。
Qwen 强调它的排版会考虑字体样式和版面。把确切的文字放进引号,并描述字体的风格,而不只是写出文字本身。
编辑时,写明你想改什么,比如把背景改成日落时的海滩,并说明哪些必须保持不变。
有多张图片时,说明哪一张提供角色、哪一张提供背景、哪一张提供风格,这样模型不用去猜。
框图模块、柱状图、一张表格和图注,都挤在同一页密集的版面上。这是对小标签和版面的压力测试,也是生成之后逐字检查的最佳场合。
一条穿红衣的卡通龙骑着一头喜庆的狮子,周围有灯笼和彩纸屑,背景是干净的白色。贴纸类的提示词,最好要求粗轮廓线和素色背景。
一块手机屏幕,包含问候语、一张圣托里尼的主推卡片、四个规划图标和行程列表,全部构成在一张竖版图片里。它说明界面样稿可以用一条提示词起草出来。
模糊或被部分遮挡的人脸,给模型留下的可抓取信息很少。请选择光线均匀、主体占画面较大比例的图片。
竖屏故事类格式用 9:21,电影感的头图用 21:9。在编辑模式下,自动会保持第一张参考图的形状。
密集的图表和小号图注,是生成的文字最容易出错的地方。把图片放进文档之前,先放大到原始尺寸检查。
上传同一件商品的多张照片,把它放进新的场景里,同时让它的形状和颜色保持可辨认。
先生成一张带引号标题的海报,再切换到 9:21 或 21:9,得到竖幅或全景的版本。
为聊天贴纸、包装和活动物料制作背景干净的角色图。
在设计团队动手制作之前,先勾勒出应用界面和落地页。
对人脸照片做轻度编辑,用原图作为参考来保持人物特征。
把最多十张上传图片里的素材合成一个画面,并说明每个文件提供哪个元素。
这是阿里 Qwen 团队于 2026 年 9 月发布的模型。它把文生图和图片编辑合在了一个模型里。
编辑模式下最多 10 张,至少需要一张。文字模式不需要。
尺寸有 1K 和 2K。文字模式提供 1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:9 和 9:21,编辑模式多出自动,并以它为默认值。
1K 图片 4 积分,2K 图片 7 积分。文字模式和编辑模式价格相同,生成器会在提交之前显示金额。
提示词最长可达 5,000 个字符,足够写一个详细的场景,再加上好几行带引号的文字。
用一句平实的指令,比如把背景改成日落时的海滩,再补充哪些要保持不变。可以的话,每次请求只改一处。
Qwen 强调它改进了文字排版,会考虑字体样式和版面。请把确切的文字放进引号,描述字体样式,并校对小字。
Qwen 介绍该模型原生支持透明输出,但这个生成器没有透明度选项,所以请要求素色背景,再自己抠图。
它是一个独立的、更新的模型,有自己的价格和 1K、2K 两种尺寸。较早的 Qwen 条目保留各自的设置和价格。
它是 4 积分和 7 积分,介于 3 积分的 Seedream 5.0 Flash 和 5、8、13 积分的 GPT Image 2.5 之间。