实用指南 · 2026 年 9 月 11 日更新
GPT Image 2.5 提示词指南:15 个实用模板
一条好用的 GPT Image 2.5 提示词,应写清图片用途、画面细节和限制条件。编辑图片时,还要分开说明需要修改和必须保留的内容。下面的 15 个模板覆盖产品图、人像、海报、参考图编辑和设计任务。
由 GPTImage2-5.art 编辑团队撰写
本文于 2026 年 9 月 11 日依据 OpenAI 官方文档完成复核。编辑团队在 GPTImage 2.5 工作区分别测试了五种常见用法,每种生成一次;重复生成的结果可能有所不同。
核心要点
写提示词时,先说明最终要生成什么,再补充主体与动作、构图、画面风格、光线、指定文案和限制条件。编辑图片则要分别写明修改项和保留项。
- 生成新图:说明图片用途、主体、构图、光线、材质,以及不希望出现的内容。
- 编辑图片:先写明要改什么,再列出人物、结构、版式、光线和文字中必须保留的部分。
- 使用参考图:给每张输入图编号,分别说明需要参考哪些特征、哪些内容不要沿用。
- 检查结果:核对指定文案、人物长相或产品外形,确认没有意外改动,再一次只调整一个问题。
模型、宽高比、分辨率、质量和透明背景均在生成器中设置。日常快速生成可先用 Flare;更重视成图质量或编辑精度时使用 Sunburst。
提示词写法参考 OpenAI 当前图片提示词指南。编辑团队于 2026 年 9 月 11 日对五种流程各测试一次,测试结果不代表每次生成都能得到相同图片。
快速开始
按任务选择提示词
先确定需要哪类图片。每张卡片都会跳到最接近的模板;其中的模型和参考图建议可作为起点,再根据实际结果调整。
官方信息
先分清官方说明与实用建议
OpenAI 于 2026 年 9 月 8 日发布 ChatGPT Images 2.5。API 提供两个模型:GPT Image 2.5 Flare 更轻量、速度更快,适合多数应用;GPT Image 2.5 Sunburst 面向质量要求更高的任务。OpenAI 表示,新版本比 Images 2.0 更能保留参考图主体,多轮编辑也更稳定。这些是 OpenAI 对模型能力的描述,实际效果仍取决于任务和输入内容。
官方指南的核心规则很简单:先说明要生成什么,再描述主体、构图、风格和限制。编辑时分开写修改项和保留项,每轮只细化一个问题。参见 OpenAI 图片提示词指南和发布说明。
提示词
主体、场景、构图、画面细节、指定文案和限制条件。
生成设置
模型、质量、尺寸、输出格式和背景模式。
人工检查
拼写、人物长相、产品外形、边缘、事实准确性,以及版权和授权风险。
60 秒写法
一套够用的 GPT Image 2.5 提示词结构
提示词没有固定语法,用短句或分项描述都可以。下面六项足以覆盖大多数任务:
为[用途]制作一张[图片类型]。
主体:[人物或物体 + 可见细节]。
构图:[取景、角度、位置、留白]。
画面风格:[光线、颜色、材质、表现形式]。
文字:在[位置]原样显示“[指定文字]”。
限制:保留[不可变内容];不要[排除项]。编辑时,把修改要求写在最前面,再逐项说明哪些内容必须保留。使用多张图片时,写“参考图 1”“参考图 2”,并说明每张图分别用来参考什么。
提示词库
15 个可复制的 GPT Image 2.5 中文提示词
替换方括号中的变量,并删除不适用的内容。建议设置可作为起点,再根据成图调整。“参考图 1”指本次生成时上传的第一张图片。“试用这个提示词”会把提示词和初始设置预填到工作区,确认提交后才会生成图片。

产品与营销图片提示词
适用于电商主图、广告素材、活动海报和多语言营销图片。
模型建议:普通生成任务先用 Flare;更看重成图质量、复杂版式或编辑精度时,再测试 Sunburst。
简洁的电商产品主图
生成外形准确、材质自然,并在四周留出足够空间的商品展示图。
可直接复制
为[产品]制作一张写实的电商产品照片。
构图:只出现一个产品,居中摆放,采用略微偏侧的 3/4 视角;产品必须完整可见,四周各留出 12% 的空白。将产品放在[背景颜色]的无缝摄影棚台面上。
光线:大型柔光箱从左上方打光,右侧使用柔和补光,产品底部保留短而自然的阴影。
材质:准确还原包装外形,通过自然的纹理和反光表现[材质]。标签平整,文字清晰可读。
限制:不要出现手、道具、多余产品、新增文字、水印、变形包装或被裁切的边缘。替换变量
[产品][背景颜色][材质]建议参数
可先选择方形画幅和中等质量。需要准确还原产品外形和标签时,请上传产品参考图。
原理与检查
为什么这样写
先固定视角、边距、光线和材质,再谈风格;排除项则保护了电商主图需要的干净版式。
检查成图
- 包装外形
- 标签拼写
- 材质纹理
- 边缘干净
- 接触阴影
预留文案区的生活方式广告
生成带有可用留白、方便后期添加标题和 Logo 的广告画面。
可直接复制
为[产品]制作一张写实的生活方式广告图。
场景:[环境],时间为[时段]。产品位于右下三分之一处,在手机屏幕上也要足够醒目。左上方 40% 区域保持简洁,不放置干扰元素,用于后期添加标题和 Logo。
光线与配色:[光线],用少量[品牌色]点缀画面。产品的阴影和反光必须与场景一致。
根据参考图 1 保持产品的比例、瓶盖、标签版式和品牌颜色。
不要添加标题、Logo、徽章、人物、重复产品或装饰文字。替换变量
[产品][环境][时段][光线][品牌色]建议参数
网页广告可选横向画幅,社交平台故事可选竖向画幅;将产品照片作为参考图 1。
原理与检查
为什么这样写
提示词提前为文案留出位置,同时写明了必须保持不变的产品细节。
检查成图
- 文案区可用
- 产品一致
- 阴影匹配
- 手机端可读
- 没有意外文字
文字准确的活动海报
生成一张简洁的活动海报,并把短标题直接呈现在画面中。
可直接复制
为[活动类型]制作一张竖版活动海报。
以下文字必须逐字呈现,不要添加其他内容:
标题:“[指定标题]”
详情:“[日期 · 时间 · 地点]”
版式:标题位于上方三分之一,详情位于底部,中间只放一个清晰的主体图形。使用[字体风格],字距整齐、对比鲜明;缩小到手机屏幕尺寸后,文字层级仍要清楚。
画面风格:[配色],[画面概念]。
不要重复、翻译、改写、拼错或新增文字。不要 Logo 和水印。替换变量
[活动类型][指定标题][日期 · 时间 · 地点][字体风格][配色][画面概念]建议参数
使用竖向画幅,可先选择中等质量。文字尽量简短;免责声明、法律条款和精细排版应在设计工具中完成。
GPT Image 2.5 Flare 与 Sunburst · 1K · 3:4 · 不透明背景 · 两个模型各生成一次 · 2026 年 9 月 11 日
同一提示词下的 Flare 与 Sunburst
两张首轮图片都只出现了一次“MAKE SPACE”和“OCT 18 · 7 PM · HARBOR HALL”,且没有额外文案。
输出


观察结果
- 本次测试中,两张图片的文字都与指定内容一致,也没有重复。
- Flare 使用分散的折纸形状;Sunburst 则把画面组织成更紧凑的圆形构图。
- 这只是两张图片的对照,不能证明任一模型每次都能正确生成文字。
原理、检查与修复
为什么这样写
引号、明确的位置和简单的文字层级可以减少歧义;限制条件也明确禁止模型改写、重复或增加文字。
检查成图
- 逐字核对
- 文字只出现一次
- 阅读顺序
- 对比度
- 安全边距
修复提示词
只修改海报文字。将标题替换为“[正确标题]”,将详情替换为“[正确详情]”。插画、颜色、间距、字体风格及其他版式元素全部保持不变。每行只出现一次,不要添加其他文字。
保留版式,只替换海报语言
替换海报语言,同时尽量保留已经确认的版式和画面布局。
可直接复制
编辑参考图 1。只把海报中的文字从[源语言]翻译为[目标语言]。
严格使用以下已审核译文:
标题:“[译后标题]”
详情:“[译后详情]”
插画、人物、产品、颜色、光线、边框、Logo 位置和整体布局保持不变。保留现有视觉层级;仅在译文无法放入原文字区域时调整换行和字号。
不要翻译品牌名。不要新增、删除或移动视觉元素。替换变量
[源语言][目标语言][译后标题][译后详情]建议参数
把已审核海报作为参考图 1,保持原始宽高比;小字号内容可对比中等和高质量。
原理与检查
为什么这样写
直接提供定稿译文,可以避免模型自行翻译;同时写明必须保留的内容,能减少版式和视觉元素被意外修改。
检查成图
- 翻译准确
- 品牌名未变
- 换行合理
- 布局未变
- 无残留原文

人像与局部编辑提示词
这些模板把需要修改的内容与必须保持不变的细节分开书写。
模型建议:需要保持人物长相时,优先测试 Sunburst;尽量沿用原图宽高比,每轮只改一项主要内容。
自然的杂志风人像
生成人像质感精致,同时保留自然的皮肤和发丝细节。
可直接复制
为[用途]制作一张[人物描述]的写实编辑人像。
取景:[头像 / 半身 / 全身],镜头与人物眼睛同高,人物看向[视线方向],姿势为[姿势]。
光线:画面左侧有柔和窗光,亮度自然衰减。背景:[背景],略微虚化但仍可辨认。
皮肤与面料:保留自然毛孔、细微的肤色变化和发丝细节,并清楚呈现[服装材质]的纹理。使用中性色彩,避免对比度过高。
不要磨皮,不要添加美颜滤镜、蜡像感、过度锐化、变形的手、多余手指、与设定不符的首饰、文字或水印。替换变量
[人物描述][用途][头像 / 半身 / 全身][视线方向][姿势][背景][服装材质]建议参数
使用竖向画幅,可先选择中等质量。如果发丝或面料细节仍不理想,再提高质量设置。
原理与检查
为什么这样写
提示词直接描述皮肤、姿势和光线,比单独使用“高级”“电影感”等宽泛词语更容易检查结果。
检查成图
- 面部结构
- 皮肤质感
- 手部
- 发丝边缘
- 服装细节
替换背景并保持人物长相
把人物放入新环境,同时尽量保持原来的外貌与姿态。
可直接复制
编辑参考图 1。只把背景改为[新环境],时间或天气为[时间 / 天气]。
人物长相、面部结构、肤色、年龄、表情、视线、发型、体型、姿势、服装、配饰、取景范围和镜头角度全部保持不变。
让新背景的光线方向、环境光颜色、景深和人物脚下或身后的阴影与原图自然衔接,并保留自然的发丝边缘。
不要修饰面部、换装、移动人物、改变身体比例、增加人物或添加文字。替换变量
[新环境][时间 / 天气]建议参数
把原始人像作为参考图 1,保持原图宽高比,这一轮只修改背景。
GPT Image 2.5 Sunburst 图片编辑 · 1K · 9:16 · 生成一次 · 2026 年 9 月 11 日
替换背景时保持人物长相
结果加入了屋顶花园和蓝调时刻光线,同时面部、发型、花卉旗袍、姿势和高机位视角与参考图保持接近。
输入

输出

观察结果
- 画面包含指定环境和景深,环境光颜色及现场灯光也与新背景相符。
- 人物长相和服装仍与参考图接近,但没有做到像素级一致。
- 需要严格保持人物长相时,应比较面部关键点,并将结果与原图叠加检查后再确认。
原理、检查与修复
为什么这样写
仅写“保持人物不变”范围过于模糊。逐项列出面部、身体、服装和拍摄角度,更容易减少意外改动。
检查成图
- 人物长相
- 表情
- 姿势和取景范围
- 头发边缘
- 光线方向
修复提示词
保留当前背景,并根据参考图 1 恢复人物的面部、表情、肤色、发型、服装、姿势、取景范围和身体比例。其他内容不要修改。
参照图片更换服装
替换服装,同时保持人物长相、姿势和原场景不变。
可直接复制
编辑参考图 1。只修改服装。
参考图 2 用来确定[上装]的版型、颜色、缝线和面料;[下装]以参考图 3 为准;[鞋或配饰]以参考图 4 为准。
服装应自然贴合当前姿势。保留参考图 1 中人物的长相、面部、头发、体型、手、站姿、背景、镜头角度、光线和取景范围。
颈部、腰部、手腕、头发和手部周围的遮挡关系必须正确。不要混合不同服装,也不要增加配饰。替换变量
[上装][下装][鞋或配饰]建议参数
按照上传顺序给人物照片和服装参考图编号。需要准确还原服装时,每轮只替换一件。
原理、检查与修复
为什么这样写
每张参考图的用途都很明确,同时点出了颈部、腰部和手腕等容易出错的交界位置。
检查成图
- 人物长相
- 服装还原度
- 袖口和腰部
- 手部
- 自然褶皱
修复提示词
人物和当前场景保持不变。只修正[有问题的服装],在颜色、版型、面料、缝线和长度上更贴近参考图[编号]。修复[手腕 / 腰部 / 颈部 / 头发]处的边界。不要修改脸、姿势、身体、其他服装或背景。
移除或替换一个物体
完成局部场景编辑,同时保留构图和光线。
可直接复制
编辑参考图 1。移除[位置]处的[要移除的物体],并在同一物理位置放入[新物体]。
新物体的透视、比例、清晰度、光线方向、反光、遮挡关系,以及与周围表面的接触方式必须符合原场景。补全原物体遮住的背景。
画面中的人物、面部、手部、产品、家具、建筑线条、颜色、取景范围和镜头角度都保持不变。
不要移动附近物体、扩大画面、改变场景风格或添加文字。替换变量
[要移除的物体][位置][新物体]建议参数
把原图作为参考图 1。ChatGPT 中可以用选区提示范围,但仍要检查选区外是否发生变化。
原理与检查
为什么这样写
提示词既说明了替换动作,也给出了让新物体真正融入场景所需的物理线索。
检查成图
- 旧物完全移除
- 背景重建
- 比例
- 遮挡关系
- 未要求的变化

参考图与一致性提示词
需要在多张图片之间保持一致时,应为输入图编号,并反复写明不能改变的细节。
模型建议:每张参考图只承担一种用途。需要准确还原产品外形、人物长相或角色设定时,优先测试 Sunburst。
把草图变成完整成图
保留草图的大致构图,同时补充材质、空间深度和光线。
可直接复制
使用参考图 1 作为构图草图,为[主体 / 场景]制作完整的[图片类型]。
保留草图中的物体位置、相对比例、镜头角度、地平线、主要轮廓和留白。
将草图细化为完整画面,清楚表现以下材质:[材质]。场景位于[环境],采用[光线]和[配色]。补充自然的空间层次、物体接触关系和阴影。
不要增加新的焦点物体、改变视角、裁切构图、添加文字或复制草图中的签名。替换变量
[图片类型][主体 / 场景][材质][环境][光线][配色]建议参数
需要保留构图和透视时,请使用轮廓清楚的草图;更重视配色、纹理或氛围时,可以上传氛围参考图。布局不能改变时,应保持原图宽高比。
原理与检查
为什么这样写
提示词写明了草图中需要保留的部分,同时补充草图难以表达的材质和光线信息。
检查成图
- 构图匹配
- 镜头角度
- 物体数量
- 材质合理
- 无新增主体
组合三张参考图
把人物、产品和画面风格组合到同一个场景中。
可直接复制
使用三张参考图制作一张[图片类型]。
人物长相、面部、头发和身体比例以参考图 1 为准。
产品外形、标签版式、颜色和材质以参考图 2 为准。
参考图 3 只用于确定配色、光线和背景氛围,不要复制其中的人物或物体。
场景:[人物动作和产品位置]。构图:[取景范围和镜头角度]。
接触关系、视线、手部位置、阴影和反光必须符合物理规律。不要混合不同人物的面部特征,不要重新设计产品、复制参考图 3 的文字或增加物体。替换变量
[图片类型][人物动作和产品位置][取景范围和镜头角度]建议参数
按照提示词中的编号顺序上传参考图。如果最看重参考图还原度,可以先用 Sunburst。
GPT Image 2.5 Sunburst 图片编辑 · 1K · 3:4 · 三张参考图,随后修正一次 · 2026 年 9 月 11 日
参考图使用错误及针对性修正
首轮结果保留了人物并加入琥珀瓶,却遗漏了大部分林地配色和光线。第二轮只修正这两个问题,恢复林地色彩和斑驳光线,并基本保留原有人物和产品构图。
输入



输出


观察结果
- 即使分别说明每张参考图的用途,模型也可能忽略其中一部分要求。
- 第二轮恢复了绿色植物、空间层次、斑驳光线、环境色和琥珀色反光,人物和产品的位置基本未变。
- 瓶身仍然容易辨认,但外形和原图中的展示比例没有完全还原。
原理、检查与修复
为什么这样写
明确每张参考图的用途,可以减少模型误用风格图中的人物、物体或文字。
检查成图
- 人物长相
- 产品结构
- 参考图用途
- 手部和接触关系
- 没有误用参考内容
修复提示词
只修正参考图使用错误。参考图[编号]仅用于[用途]。删除从该图误复制的[人物 / 物体 / 文字 / 形状]。保留当前已经确认无误的人物、产品、构图、光线和背景。
一致的角色设定表
先定义可复用角色,再生成场景或故事画面。
可直接复制
为一个原创[角色身份]制作版面简洁的角色设定表。
不可变设计:[年龄范围]、[身体比例]、[脸型]、[发型]、[服装]、[标志性配饰]和[配色]。
版式:一排放置四个全身视图,依次为正面、左侧面、背面和右侧 3/4 视角;下方再放三张小幅表情特写。所有视图必须保持同一张脸、相同比例、服装结构、颜色和配饰。
使用纯净中性背景、均匀摄影棚光线和充足间距。不要夸张透视、裁切脚部、标签、Logo、替换服装、多余配饰或水印。替换变量
[角色身份][年龄范围][身体比例][脸型][发型][服装][标志性配饰][配色]建议参数
使用横向画幅和中等或高质量。确认设定表无误后,再用它生成其他场景。
GPT Image 2.5 Sunburst 文生图 · 1K · 16:9 · 生成一次 · 2026 年 9 月 11 日
角色设定表一致性检查
结果生成了四个全身视图和三张表情特写,发型、夹克、长裤、鞋、腰包和配色基本一致。
输出

观察结果
- 四个全身人物都没有被裁切,正面、侧面、背面和四分之三视角可以清楚区分。
- 橙色腰包和青绿色夹克保持一致,但背带位置在不同视角间有所变化。
- 这张图适合作为主参考,但后续场景中的一致性仍需单独测试。
原理与检查
为什么这样写
逐项写明不能改变的角色特征,便于在后续图片中重复使用同一设定。
检查成图
- 每个视图同一张脸
- 身体比例
- 服装结构
- 配饰
- 脚部完整
四格故事板或动画关键帧
生成动作明确、角色形象统一的一组连续画面。
可直接复制
为[场景]制作四格故事板。角色设计以已经确认的参考图 1 为准。
第 1 格:[开场动作]。
第 2 格:[第二个动作]。
第 3 格:[转折点]。
第 4 格:[最终动作]。
所有分格中的脸、头发、身体比例、服装、配饰和配色保持一致;环境和时间连续。只在明确要求时改变镜头距离。
使用清晰的分格线,人物动作和画面关系要一目了然。不要说明文字、对话气泡、多余角色、换装、重复肢体或水印。替换变量
[场景][开场动作][第二个动作][转折点][最终动作]建议参数
把已经确认无误的角色设定表作为参考图 1。可以一次生成整张宽图;更看重角色一致性时,可以逐格生成。
原理与检查
为什么这样写
逐格说明动作可以减少叙事歧义,反复写明角色特征则有助于保持前后连续。
检查成图
- 角色连续
- 动作顺序
- 环境连续
- 肢体
- 分格清楚

设计与创意提示词
适用于信息图、透明背景素材和按参考图迁移视觉风格。
模型建议:先明确最终需要哪类图片。文字和事实必须人工核对;透明素材要分别放在深色与浅色背景上检查。
易读的信息图或演示文稿页面
把给定事实整理成层次清楚、便于阅读的视觉内容。
可直接复制
制作一张 16:9 演示文稿页面,标题为“[指定标题]”,主题是[主题]。
只使用以下事实:
1. [事实一]
2. [事实二]
3. [事实三]
版式:顶部标题,中间一个大型主图表,三个简短辅助标签,底部留出来源说明区域。阅读顺序必须从左到右清楚可辨。使用[配色]、简单矢量形状、统一线宽和高对比度。
不要编造数据、增加统计数字、重复标签、使用段落或添加装饰文字。给定文字必须逐字拼写正确。替换变量
[指定标题][主题][事实一][事实二][事实三][配色]建议参数
使用横向画幅,并对比中等和高质量。逐项核对事实;密集排版应在演示文稿工具中完成。
原理与检查
为什么这样写
限定可用事实可以减少无依据的补充;提前写明版式,则有助于形成清楚的信息层级。
检查成图
- 事实准确
- 拼写
- 阅读顺序
- 对比度
- 来源区域
透明背景产品或图标素材
生成带有真实 Alpha 通道、可用于后期合成的独立素材。
可直接复制
在完全透明的背景上生成一个独立的[素材]。
视角:[角度],主体居中并留出充足空间,完整轮廓必须可见。以[材质 / 风格]清楚呈现细节,边缘要自然、干净。
细小部件、头发、玻璃、孔洞和柔和阴影周围的 Alpha 边缘必须干净。只允许出现[允许的阴影]。
不要实体背景、场景、地面、棋盘格、边框、文字、Logo、水印、裁切边缘、白边或黑色光晕。替换变量
[素材][角度][材质 / 风格][允许的阴影]建议参数
在 API 中把 background 设为 transparent,并使用 PNG 或 WebP。画进图片里的棋盘格不等于透明。
GPT Image 2.5 Sunburst 图片编辑 · 1K · 1:1 · 透明背景 · 生成一次 · 2026 年 9 月 11 日
透明产品提取与 Alpha 通道检查
生成的 PNG 包含 RGBA Alpha 通道。石块、橙色面板、地面和背景被移除,只保留完整瓶身和滴管。
输入

输出

观察结果
- 返回文件先以 RGBA 模式检查,再转换为保留 Alpha 通道的 WebP。
- 轮廓完整,透明玻璃在深色页面背景上仍可辨认。
- 瓶身部分边缘仍有轻微暖色毛边,正式合成前最好再手动清理一次。
原理、检查与修复
为什么这样写
提示词用于隔离主体,输出参数用于生成透明通道,两项都需要正确设置。
检查成图
- 真实 Alpha 通道
- 细小边缘
- 玻璃或头发
- 无光晕
- 轮廓完整
修复提示词
保持素材当前的外形、材质、颜色、角度和比例。移除可见背景和棋盘格,恢复真实透明的 Alpha 通道。清理[问题区域]的边缘,不要产生白边或黑色光晕,也不要改变素材风格。
按参考图迁移视觉风格
借鉴参考图的画面风格,同时避免复制其中的主体或构图。
可直接复制
制作一张[新场景]中的[新主体]图片。
参考图 1 只用于确定以下视觉特征:[配色]、[纹理或表现形式]、[线条或造型特点]和[光线]。不要复制其中的主体、角色、构图、文字、Logo 或容易辨认的物体。
构图:[取景和主体位置]。新主体必须原创,并与参考图内容明显不同。
不要水印、签名、复制字体、多余文字或可识别的受保护角色。替换变量
[新主体][新场景][配色][纹理或表现形式][线条或造型特点][光线][取景和主体位置]建议参数
把风格图片作为参考图 1。如果还需要指定人物或产品,请为相应图片另行编号,并单独说明用途。
原理与检查
为什么这样写
提示词直接描述配色、纹理、线条和光线,不需要引用创作者姓名,也不会要求复制原图。
检查成图
- 新主体原创
- 画面风格符合要求
- 未复制文字
- 未复制原构图
- 无签名
改写模板
提示词不必写长,先把这四件事说清楚
先说明要生成什么
明确写出“电商产品图”“竖版活动海报”“四格故事板”或“透明应用图标”,再补充具体版式。
把抽象形容词写成具体画面
例如,把“高级”具体写成深色石材台面、单侧柔光、不过强的反光、低饱和配色和大面积留白。
指定文案必须原样呈现
把定稿文案放进引号,并写清位置、信息层级和字体风格。禁止添加其他文字,成图后再逐字核对。
说明每张参考图的用途
分别说明人物长相、产品外形、服装、姿势、构图、配色或纹理以哪张图为准;风格参考图中若有人物或标题,还要明确禁止复制。
模型与参数
Flare、Sunburst 和输出参数怎么选
更看重速度时,可以先用 Flare;任务复杂且更看重质量时,可以先用 Sunburst。比较模型时,应固定提示词、参考图、尺寸、格式和质量设置,再按照同一套标准检查结果。
| 使用方式 | 可以设置 | 需要注意 |
|---|---|---|
| ChatGPT Images | 对话生成、图片上传、局部编辑、选区,以及界面提供的其他设置。 | 界面未必会显示底层 API 模型和全部 API 参数。 |
| OpenAI API | 模型 ID、质量、尺寸、背景、输出格式、提示词和输入图。 | 模型、尺寸等设置应写入请求参数,提示词无法代替这些参数。 |
| 第三方工具 | 以产品实际提供的模型和设置为准。 | 即使显示了模型名称,也不一定支持全部原生参数。 |
| 设置项 | 官方 API 选项 | 使用建议 |
|---|---|---|
| 模型别名 | gpt-image-2.5-flare gpt-image-2.5-sunburst | 不带日期的别名会指向 OpenAI 当前版本。别名更新后,应重新测试关键流程。 |
| 固定快照 | gpt-image-2.5-flare-2026-09-08 gpt-image-2.5-sunburst-2026-09-08 | 需要固定模型版本时,可使用带日期的快照。比较两个模型时,仍应采用同一套检查标准。 |
| 质量 | auto、low、medium、high、xhigh、max | 可先用 auto 或 medium 作为基准;提高质量设置不一定能改善每个任务。 |
| 尺寸 | 常用尺寸包括 1024×1024、1536×1024、1024×1536、2048×2048、2048×1152、3840×2160 和 2160×3840,也支持有效的自定义尺寸。 | 尺寸需要在工具或 API 中设置。截至 2026 年 9 月 11 日,超过 3,686,400 像素的输出仍属实验功能;在提示词中写“4K”不能代替尺寸参数。 |
| 背景 | auto、opaque、transparent | 透明图片应输出为 PNG 或 WebP,并确认文件包含有效的 Alpha 通道。 |
API 信息可能变化。生产上线前,请在 OpenAI 官方图片提示词文档确认当前参数。
截至 2026 年 9 月 11 日,两个模型采用相同的 API token 单价:每 100 万文本输入 token 为 5 美元,缓存输入为 1.25 美元;每 100 万图片输入 token 为 8 美元,缓存输入为 2 美元;每 100 万图片输出 token 为 30 美元。这些是 token 单价,单张图片的实际费用取决于输入和输出用量。详情请查看 Flare 模型页或 Sunburst 模型页。
失败修复
第一张图不理想,下一轮怎么改
先指出当前结果中的具体错误。构图仍可用时,无需重写整条提示词。把最近一张已经满意的图片作为下一轮输入,每次只改一个主要问题。
| 问题 | 下一轮指令 | 检查方法 |
|---|---|---|
| 人物长相发生变化 | 根据参考图 1 恢复面部、年龄、表情、肤色、发型和身体比例,保留当前背景。 | 并排比较眼睛、下颌、发际线和年龄特征。 |
| 文字拼错 | 只修改文字,引用正确文案,保持版式、插画和颜色不变。 | 在 100% 缩放下逐字阅读。 |
| 物体数量错误 | 保留当前场景,画面中只留下[数量]个[物体],彼此分开且完整可见,并删除多余物体。 | 清点时不要漏掉小物件,还要检查反射中是否多出了重复物体。 |
| 产品标签变形 | 根据参考图 1 恢复包装结构和标签版式,保留场景、镜头角度和光线。 | 检查包装边角、瓶盖、Logo 基线和小字。 |
| 假透明背景 | 要求隔离主体,并把 background 参数设为 transparent;保留 PNG 或 WebP Alpha。 | 分别放在深色与浅色背景上检查头发、玻璃和阴影。 |
| 编辑改动过多 | 回到最近一张已经确认无误的图片,重新写明必须保留的内容,并缩小本轮修改范围。 | 精度要求较高时,可叠加对比新旧图片。 |
有些问题不适合继续用提示词修正
OpenAI 提醒,多轮编辑可能改变原本需要保留的细节。如果 Logo、标签、面部区域或版式必须完全不变,应把已经确认无误的部分合成回原图。ChatGPT 编辑器中的选区只能引导修改范围,无法形成严格边界,选区外也可能发生变化。
批量制作
怎样连续生成一组风格统一的图片
- 1
确定主参考图
选择一张已经确认无误的产品图、角色设定表或版式。
- 2
列出必须保留的细节
记录不能改变的面部、比例、颜色、包装、服装和镜头风格。
- 3
每轮只改一个变量
后续请求只替换场景、姿势、尺寸、语言或天气中的一项。
- 4
重复关键限制
涉及人物长相或品牌识别的细节,要逐项重申,不能只写“与之前相同”。
- 5
统一检查标准
逐张检查文字、结构、人物长相、手部、边缘和系列一致性。
- 6
核算合格图片的成本
API 工作流应记录延迟、重试和失败次数,并计算每张合格图片的实际成本。
需要迁移旧版提示词?
先保存旧模型、生成设置、参考图和满意结果,作为后续比较依据。删除重复的形容词,把抽象意图改成具体画面;编辑任务要分开写明修改项和保留项,并说明每张参考图的用途。先用原提示词测试新模型,才能判断结果变化来自模型还是提示词改写。
常见问题
GPT Image 2.5 提示词常见问题
GPT Image 2.5 提示词一定要写得很长吗?+
不需要。简单任务用短提示词即可。需要细致控制构图、文字、参考图用途或保留内容时,再补充相关要求。提示词是否清楚比字数更重要。
应该使用 GPT Image 2.5 Flare 还是 Sunburst?+
OpenAI 将 Flare 定位为速度更快、适合多数应用的模型,Sunburst 则面向质量要求更高的任务。可以用相同的提示词、参考图、尺寸和质量设置测试两者。如果 Flare 的结果已经符合要求,就没有必要改用 Sunburst。
只在提示词中写透明背景就可以吗?+
提示词中要写明隔离主体,API 请求还需把 background 参数设为 transparent,并输出 PNG 或 WebP。下载后应确认文件确实包含 Alpha 通道;画面中的棋盘格图案并不代表背景透明。
在提示词中写 4K 就能生成 4K 图片吗?+
不能。输出尺寸属于产品或 API 设置。在 API 中应选择支持的尺寸或有效自定义分辨率。提示词负责描述图片内容,不能代替请求参数。
为什么编辑会改掉我要求保留的内容?+
模型每次编辑的结果都可能不同。应反复写明必须保留的内容,每轮只修改一项,并与最近一张已经确认无误的图片比较。某个区域必须完全不变时,应使用图像合成,不能只依赖提示词。
GPT Image 2.5 生成的图片可以商用吗?+
通过 GPTImage 2.5 创建的图片可用于个人或商业用途,但仍须遵守本站服务条款、适用法律,并尊重第三方权利。直接使用 ChatGPT 或 OpenAI API 时,应以适用的 OpenAI 消费者条款或商业条款为准。生成结果未必具有独创性,也不一定能获得版权保护;正式使用前仍需检查是否涉及第三方权利。
证据与来源
资料来源与测试说明
本文依据官方文档核对模型名称、提示词写法、API 参数、编辑限制和内容条款。编辑团队于 2026 年 9 月 11 日使用 GPT Image 2.5,以 1K 分辨率分别测试了五种常见用法,每种只生成一次。其中一个示例同时展示了首轮失败和第二轮修正的结果。原始 PNG 在不改变尺寸和画面内容的前提下转为 WebP。这些图片只反映本次测试情况,不代表重复生成一定会得到相同结果。
- OpenAI 图片提示词指南
- ChatGPT Images 2.5 发布说明
- ChatGPT 图片帮助文档
- OpenAI 非欧洲地区个人用户条款
- OpenAI 欧洲地区用户条款
- OpenAI API 与企业服务协议
- GPTImage 2.5 服务条款
GPTImage 2.5 是独立产品,与 OpenAI 不存在隶属、背书或赞助关系。OpenAI 与 GPT 是其各自权利人的标识。