ChatGPT Images 2.5 怎么用?图片编辑、Sketch 与 API 价格
SandBase 解析 ChatGPT Images 2.5 图片编辑、Sketch 与 OpenAI API 价格,区分官方演示和后台版本未确认的两轮 ChatGPT 网页改价测试。
一张咖啡海报已经做好,价格却临时从 12 美元改成 9 美元。设计师要的不是“再画一张差不多的”,而是换掉价格,杯子别动、营业时间别变,已经确认的颜色也别重来。
OpenAI 在 2026 年 9 月 8 日发布的 ChatGPT Images 2.5,重点正是这类修改。它根据文字和参考图片生成、编辑图像,面向需要反复改稿的设计师,也面向把生图功能接入自己应用的开发者。这次更新是否实用,不能只看第一张图好不好看,还要看第二次修改留下了多少原来的细节。
这篇 SandBase 博客负责说明功能、用法和官方价格,并把官网演示与咖啡海报测试分开。如果你更关心连续改稿后的商品细节,可以直接看另一篇 ChatGPT Images 2.5 五轮编辑实测:同一只蓝色水瓶依次改价格、换瓶盖、增删角标。两篇的网页输出都没有确认到具体 API 后台型号。
OpenAI 官方 X 发布帖的中文译文截图,并非另行发布的中文公告。点击查看 1182 × 1002 PNG 原图。
先说结论
- OpenAI 称,相比 Images 2.0,图片生成延迟最多降低 50%,参考图还原和多轮编辑一致性也有改善。
- 新增 Sketch、图片评论、模板和提示词分享,分别解决画布局、指位置、起草和复用的问题。
- API 中的 Flare 偏重速度,Sunburst 偏重精细创作,但生成时间更长。
- 下文区分官网演示与两轮网页版实测。实测保住了主要构图,却改动了细节;当前账号未显示明确后台版本,不能当作已确认的 2.5 跑分。
ChatGPT Images 2.5 和 GPT Image 2.5,应该找哪个?
在 ChatGPT 里改图片,找的是 ChatGPT Images 2.5 的产品功能;从程序调用,OpenAI 文档给出的型号是 gpt-image-2.5-flare 和 gpt-image-2.5-sunburst。ChatGPT 发布了功能,不代表每家中转平台都已支持对应型号。
| 你现在要做什么 | 对应内容 | 容易忽略的区别 |
|---|---|---|
| 在 ChatGPT 中改一张海报 | Sketch、评论与模板 | 下载后也要检查没有要求改动的区域 |
| 估算接入程序后的费用 | Flare 和 Sunburst 价格 | 表中是 OpenAI 的 token 价格,不是 SandBase 报价,也不是固定每张费用 |
| 判断多轮改稿会不会改变商品 | SandBase 的五轮水瓶测试 | 提供原始 PNG、纹理对照和背景取样,只有一条网页测试链,不是 API 对比 |
ChatGPT Images 2.5 更新了什么?
官方发布文章主要强调三件事:参考图中的人物更容易保持辨识度;局部修改更贴近要求;连续编辑时,前几轮的结果更不容易丢失。
“快一半”也有范围:官方说的是相对 Images 2.0,生成延迟最多降低 50%,不是每张图都保证省一半时间。另一个数字是每周超过 30 亿张图片,统计范围包含 ChatGPT Images 和 GPT-Image API,不是 2.5 单独的生成量。
OpenAI 宣布向 ChatGPT、ChatGPT Work 和 Codex 的所有档位逐步开放,覆盖网页、桌面和移动端。“所有档位”不等于免费无限用,也不代表某个账号的一次生成已经能确认后台型号。
OpenAI 官方发布主片,约 58 秒,并非本站实测。播放器提供 1080p 源,实际播放清晰度取决于播放器与网络。直接观看官方视频,或阅读发布说明。
换衣服,首先得留下原来的人
官网展示了一张翻拍的儿童纸质照片:红色上衣、蓝色背景,拿着照片的手和周围环境也在画面里。
官网演示输入:原始纸质照片翻拍。来源:OpenAI。
输出把衣服改成象牙白礼服、黑色翻领和领结,画面仍保留“有人拿着一张照片”的呈现方式。
官网演示输出:服装改变,人物大致姿态、蓝色背景和纸质照片的呈现方式仍可辨认;并非本站实测。
判断这类结果,不能只看衣服漂亮不漂亮。还应对照脸部、头部角度、手的位置和照片轮廓。一个展示案例能说明模型做得到某种效果,却不能证明每次换装都不会改变人物。
官网另有把翻拍照片整理成清晰头像的案例。不过,生成式修复可能补出原图里看不清的细节,不等于找回经过验证的历史原貌。重要老照片仍应保留原件。
整理床铺,不是重新装修卧室
另一个案例更接近日常图片修改:床单和枕头凌乱,但房间本身不需要重做。
官网演示输入:从床尾拍摄的未整理床铺。来源:OpenAI。
输出将被子铺平、枕头摆好,房门、窗户、两侧台灯和拍摄视角仍然可以对应。
官网演示输出:整理后的床铺。官方源文件为 1448 × 1086 像素,本图没有再次缩放或压缩。
对于制作房间展示图的人,难点不是“生成漂亮卧室”,而是改完后仍是要展示的那个房间。发布前仍需检查窗户、家具、灯具和材质有没有被改掉,并按使用场景披露图片修改。
这里要分清:场景相似,不等于周围像素完全不变。 前者适合创意改稿,后者可能需要传统修图工具。官方承诺的是精度改善,不是未指定区域逐像素锁定。
两轮实测:把 12 美元改成 9 美元
9 月 9 日,SandBase 博客为本文记录了一次生成和一次跟进编辑,没有重试挑图。实际操作在 ChatGPT 网页版完成,不是通过 SandBase API 调用。
测试使用免费账号,“思考”开关关闭。入口页面标题仍显示“ChatGPT Images 2.0”,会话没有提供确切的图像模型编号。因此,这组结果只代表当时可用的 ChatGPT 网页编辑流程,不是已确认的 GPT-Image-2.5 实测;也没有对照模型和受控计时。
第一轮要求生成正方形咖啡海报:奶油色背景、青绿色陶瓷杯、浅色木桌、左侧光线,右下角恰好三颗咖啡豆。文字限定为:
WEEKEND COFFEE
周末咖啡
SAT–SUN 09:00–17:00
$12
实测第一轮:直接下载的 1254 × 1254 PNG 原图;后台图像模型版本未独立确认。
四行文字都能辨认,右下角也出现了三颗咖啡豆。但四个中文字正确,不足以证明长段中文、小字说明或生僻字都能正确生成。
第二轮通过图片编辑入口提交要求,核心是:
只把价格从“$12”改为“$9”。其余文字、青绿色杯子、拉花、杯碟、三颗咖啡豆、光影、木纹、奶油色背景,以及各元素的位置和大小都保持不变。不要重新设计或构图。
实际提交的是上述要求的英文版,明确列出了要保留的元素。
实测第二轮:直接下载的 1254 × 1254 PNG 原图。价格修改成功,但主要构图相似不代表细节完全一致。
结果是:价格变成了 9 美元,其他文字仍可读,杯子大致位置和三颗咖啡豆也保留了。但放大后能看到杯身反光、拉花等细节变化;对杯子与桌面区域做像素比较,也能确认价格之外的区域发生了修改。
所以,这次结果适合表述为“主要设计保持较好”,不能写成“只改价格,其他地方完全没动”。如果是一张促销概念稿,这可能已经够用;如果商品材质不能改变,用传统编辑器单独替换文字更稳妥。
官方图像生成指南也仍列出文字准确性、角色一致性和精确构图方面的限制。“中文乱码已经消失”不是现有证据能支持的结论。
ChatGPT Images 2.5 怎么用:Sketch、评论与模板
修改已有图片,可以先做三步:上传原图;说明只改哪里,并列出必须保留的文字和物体;下载结果,与原图对照后再继续下一轮。前面的咖啡测试说明,即使价格改对了,也不能省掉最后的检查。
只说“把布局调平衡一点”,模型有很多理解方式。Sketch 让用户先画出位置关系,例如主图放左侧、价格放右下角,再用文字说明材质和风格。
官方给出的入口是在 ChatGPT 输入 @Sketch。下面是官方流程演示,不属于前面的咖啡实测。
OpenAI 官方 Sketch 视频,播放器提供 1080p 源;实际播放清晰度取决于播放器与网络。直接观看官方视频,或阅读发布说明。
图片评论更适合已有画面的定点修改。例如指着价格标签提出新金额,比“修改下面那行字”更明确。不过,标注位置仍然是给生成模型的指令,并不等于设置了绝对不可修改的区域。
模板解决从空白开始的问题。官网举了 Poster 和 Merch,即海报与周边商品等格式。使用时仍需填清楚具体文案、用途和风格,不能把模板当成自动补齐业务信息的工具。
OpenAI 官方模板演示,约 28 秒,与前面的咖啡实测分开。播放器提供 1080p 源,实际播放清晰度取决于播放器与网络。直接观看官方视频。
提示词分享则方便复用:分享图片时可以附带提示词,别人换上自己的照片和细节,再做一个版本。官方 80 年代肖像示例展示了这种用法。
官方提示词分享示例,保留 1254 × 1254 PNG 原文件;不是本站生成的人像。
复用提示词不代表可以随意使用他人的照片。上传和分享前,应确认自己有相应使用权限。
GPT-Image-2.5 API 价格:Flare 和 Sunburst 怎么选?
两款模型的具体区别,可以继续看 GPT Image 2.5 Flare vs Sunburst:有什么区别,怎么选?。文中还用一个耳机改色案例,说明局部编辑之后哪些细节值得放大检查。
API 就是从自己的程序调用模型。开发者这次可以选择两个明确型号:
| 型号 | 官方定位 | 建议先验证的任务 |
|---|---|---|
gpt-image-2.5-flare | 多数应用的默认选择,强调速度与编辑质量 | 社交素材、草稿变体、频繁修改的产品概念图 |
gpt-image-2.5-sunburst | 更精细的创意和编辑,生成时间较长 | 正式活动素材、细节要求较高的产品图 |
这些是官方定位对应的试用建议,不是本站对两款 API 的性能排名。应使用同一参考图和修改要求,对比改对了什么、误改了什么、等待时间和实际费用。
截至 9 月 9 日,官方 Standard 价格表给两款型号列出的 token 单价相同:每百万图像输入 token 为 8 美元、缓存输入 2 美元、输出 30 美元;文字输入 5 美元、缓存输入 1.25 美元。Token 是计费用量单位,单价一样不代表每张图一样贵,实际消耗会受模型和质量设置影响。
发布文章还引用 Manus 的 Lucky Liao,称在其评估中 Flare 的速度为 GPT-Image-2 的 2 至 4 倍;Adobe 则确认在 Firefly 中加入新模型。前者属于客户评估,不能替换成本站测得的速度。
如果想用同一张图比较其他模型,可以继续看 SandBase 博客的图片编辑 API 对比。准备接入程序时,先在 SandBase 图像模型 API 目录查看所选模型的输入要求,再按 SandBase 图片与视频 API 接入文档提交任务、查询结果。型号和必填参数以对应模型文档为准;本文尚未确认 SandBase 提供 GPT-Image-2.5 Flare 或 Sunburst,不能把这些链接当作 2.5 已上线的承诺。
FAQ
免费用户能用吗?
OpenAI 宣布向所有档位逐步开放,但免费使用仍可能受额度限制。具体以账号页面为准,不能仅凭发布公告确认某次生成的后台型号。
能不能保证只改一个地方?
官方说局部编辑更准确,不是保证其他像素完全不变。前面的网页版实测改对了价格,也保留了主要构图,但杯身和拉花细节仍有变化。
哪些是官网演示,哪些是真实测试?
换装、床铺、80 年代肖像,以及发布主片、Sketch 和模板这三段视频均来自 OpenAI。两张咖啡海报来自本次两轮 ChatGPT 网页操作,且没有独立确认后台版本。
下载图片时,怎样保留清晰度?
使用 ChatGPT 的下载按钮保存图片,不要截取聊天里的缩略图。发布前按原始尺寸检查文字,不要反复另存成有损格式。把小图放大也不能补回缺失细节。OpenAI 还使用来源元数据和不可见水印,应保留这些来源标识。
真正值得看的是第二次修改
这次更新最有用的方向,不是再生成一张漂亮图片,而是让已经认可的版本少被推翻。
拿一个真实改稿要求测试:换价格、改衣服,或者整理床铺。保留原图,写清哪些部分不能动,再同时检查“改对的地方”和“不该变却变了的地方”。能减少多少次返工,比一张发布会演示图更能说明它是否适合日常工作。


