自动画幅只是起点
自动让模型来选形状,探索阶段没问题。一旦版面需要适配特定的位置,就要设置明确的画幅比例。
BestAIVideo
GPT Image 2.5 是 OpenAI 的图片模型,适合日常生成和精细编辑。你可以写一份最长 5,000 个字符的详细需求,也可以上传最多 16 张参考图并说明哪些部分要保留,再选择 1K、2K 或 4K,提交之前先查看积分消耗。
OpenAI 在 2026 年 9 月发布了 2.5 这一代,生成更快,编辑更稳。下面是这个页面上的生成器让你用到的功能。
提示词输入框最多接受 5,000 个字符,所以版面、材质、光线和每一行文字都可以在一次请求里写清楚,不用拆开。
切换到编辑模式,最多可以上传 16 张图片。OpenAI 指出,对参考照片里主体的保留比上一代更好。
可选 1K、2K 或 4K,画幅可从自动、1:1、3:2、2:3、4:3、3:4、16:9、9:16 和 21:9 中选择。价格分别是 5、8 和 13 积分。
OpenAI 表示,生成延迟比上一版最多降低一半,结果的光线更自然,质感更丰富。
OpenAI 自己的建议是先定义结果,再描述看得见的细节。下面的习惯遵循这个顺序,对编辑同样适用。
先说图片的用途,比如产品主图、海报或图示,再给出主体、构图,以及要为文案留空的位置。
把确切的字放进引号,说明它出现几次,并描述位置和字体。要求不要出现多余的文字,避免冒出莫名其妙的字。
先写“只改背景”,再列出必须保留的东西:人物特征、几何形状、版面、光线和标签。每一轮编辑都要重申不能动的部分。
生僻词或品牌名,要一个字母一个字母地拼出来。OpenAI 指出,精确的文字位置仍然可能有难度,所以要仔细检查密集或很小的字。
抛光的钢制夹板、金色齿轮和红宝石轴承,以浅景深特写的方式放在黑色丝绒上。这类图片背后的提示词会写明镜头距离、金属材质和一盏硬质主光。
等高线、标有海拔的山峰、罗盘、比例尺和图例,共处在同一张泛黄的纸面上。这是对文字和版面的一次严苛测试,也提醒你要校对每一个标签。
一艘放下舷梯的白色穿梭机停在湿漉漉的甲板上,地面上有电缆,空气中有蒸汽,远处有小小的机组人员。纵深感和倒影,来自对空间、室内天气和光源的描述。
自动让模型来选形状,探索阶段没问题。一旦版面需要适配特定的位置,就要设置明确的画幅比例。
如果横幅之后要放标题,就说明哪一侧保持空白。除非你要求不要,否则模型会把空间填满。
把任何有效的提示词全文,连同它的分辨率和画幅一起保存,这样客户提出修改时,就能从一份已知可行的需求出发。
上传产品展示图,把它们放进新的场景里,同时让标签、形状和颜色保持不变。
在一份需求里写明主标题、副标题和日期,并根据渠道需要选用 21:9 或 9:16 的格式。
要求生成带图例和比例尺的标注图,再用针对性的编辑修正个别标签。
为提案制作 16:9 的画面,每一帧都重新描述同一个地点,以保持一致。
先用 1K 探索,每张 5 积分,只有要上线的图片才花 8 或 13 积分。
最多可以组合 16 张图片,比如一位模特、一件服装和一个背景,并说明每个元素来自哪个文件。
这是 OpenAI 的图片生成和编辑模型,于 2026 年 9 月随 ChatGPT 里的 Images 2.5 一同发布。本页使用的是它快速的日常档。
最多 16 张。编辑模式至少需要一张图片,而文生图不需要。
1K、2K 和 4K,默认选中 1K。画幅比例有自动、1:1、3:2、2:3、4:3、3:4、16:9、9:16 和 21:9。
1K 图片 5 积分,2K 是 8 积分,4K 是 13 积分。文字生成和编辑价格相同,参考图的数量也不会改变价格。
最多 5,000 个字符。这足够写一份完整的版面需求,包含多行文字,以及对材质和光线的详细说明。
OpenAI 表示,与 Images 2.0 相比,生成延迟最多降低 50%。实际耗时取决于分辨率和提示词的复杂程度。
把字放进引号,写明位置和样式,并要求不要出现额外的文字。OpenAI 称文字有改进,但位置仍可能出问题,所以要放大检查并校对。
以“只改”加上你想改的东西开头,再列出必须保留的元素。反复编辑可能会跑偏,所以每次都要重申重要的限制。
OpenAI 把在多次独立生成之间保持重复出现的角色和品牌元素列为局限之一。在编辑模式下使用相同的参考图,可以让它们更接近。
不可以。这个生成器运行的是快速档,没有质量或格式选项,你只需要选择分辨率和画幅比例。
它在 1K、2K 和 4K 下是 5、8 和 13 积分,Nano Banana 2 则是 7、10 和 15。两个模型擅长的方向也不一样,所以请用同一份需求在两边都试一试。