← 返回全部文章

OpenAI 官方:GPT Image 2.5 使用教程

OpenAI 官方提示词指南,介绍 GPT Image 2.5 的 Flare 与 Sunburst、参数选择、图片生成、局部编辑、多轮修改和透明背景处理。

如果你只是偶尔让 AI 生成一张图,提示词写得长一点、短一点,差别可能不大。但做商品图、海报、界面预览、信息图,或者要连续修改同一张图时,模型能不能保留主体、文字和构图,就会直接影响返工次数。

OpenAI 最近在开发者文档中发布了 GPT Image 2.5 的提示词指南。指南覆盖两种模型、参数选择、图片生成、参考图编辑、透明背景、多轮修改和结果检查。下面按官方文档的顺序,整理成一份可以直接使用的教程。

先选对模型:Flare 还是 Sunburst

GPT Image 2.5 提供两个模型选择:

  • GPT Image 2.5 Flare:小模型,优先考虑速度,图片质量可与 GPT Image 2 相比。
  • GPT Image 2.5 Sunburst:基础模型,优先考虑质量,适合对编辑精度和细节要求更高的任务。

官方建议,新工作流先根据需求选择:速度更重要,就从 Flare 开始;质量要求更高,就先测试 Sunburst 。

如果你正在迁移 GPT Image 2 工作流,可以这样判断:原来的 GPT Image 2 已经达到质量要求,先测试 Flare,看看能不能在保持质量的同时缩短响应时间;如果 GPT Image 2 在复杂任务上还达不到要求,先测试 Sunburst,确认质量过关后,再用相同提示词、参考图和尺寸测试 Flare 。

不要只看模型名称判断快慢或价格。 OpenAI 明确建议在自己的工作负载上测响应时间和质量,因为结果会受到提示词、参考图、输出尺寸和质量设置影响。

API 参数单独设置

参数不要全部塞进提示词里。 GPT Image 2.5 的主要设置如下:

参数可选值
modelgpt-image-2.5-flaregpt-image-2.5-sunburst
qualityautolowmediumhighxhighmax
sizeauto 或自定义分辨率
backgroundautoopaquetransparent

常见尺寸包括:1024x1024 正方形、1536x1024 横图、1024x1536 竖图,以及 2K 、 4K 尺寸。

如果使用自定义尺寸,需要同时满足四个条件:每条边不超过 3840 像素;宽高都是 16 的倍数;长边与短边的比例不超过 3:1;总像素数在 655360 到 8294400 之间。

超过 3686400 像素,也就是 2560x1440,属于实验性输出。不要因为尺寸更大,就默认结果一定更好。

质量设置建议先固定。完成模型对比后,再逐步测试 highmedium 或更低设置。xhighmax 只应该用于确实存在质量缺口、并且延迟预算允许的场景。

如果要生成透明素材,需要同时做到三件事:在 API 中设置 background="transparent";使用 PNG 或 WebP;检查返回文件是否真的包含 alpha 通道。头发、玻璃、阴影和物体边缘都要检查。棋盘格背景只是画出来的图案,不代表真正透明。output_compression 只用于 JPEG 或 WebP,不要用于 PNG 。

提示词的七个组成部分

1. 先说清楚要得到什么

先说明主体和用途,例如商品照片、广告、流程图或界面预览,再补充构图、比例和位置要求。复杂任务可以按“场景、主体、细节、限制”组织,但不需要依赖某种特殊语法。

2. 写看得见的细节

把材质、光线、颜色、画面媒介和镜头范围写出来。如果目标是真实照片,直接写 photorealistic 或“真实摄影”。相机参数只能作为外观提示,不能保证完全模拟真实相机。

“电影感”“高级感”这类词太宽泛。宽画幅、雨夜、霓虹或低光场景,最好补充画面尺度、空气感、颜色和光源位置。

3. 具体描述人物和动作

说明人物的身体范围、相对大小、视线和与物体的互动。例如“全身入镜,脚部完整可见”“低头看打开的书”“双手自然握住车把”,比只写“一个人在骑车”更容易得到稳定动作。

4. 需要准确显示的文字要加引号

把品牌名、标题或广告语放在引号里,并写清楚出现位置、字体和出现次数。可以补充“不要添加其他文字”,生成后仍然要检查拼写和可读性。

如果画面里有小字、多个字体或密集信息,官方建议比较 mediumhigh 两种质量设置。

5. 把修改项和保留项分开写

编辑图片时,明确写“只修改 X”,然后列出必须保持不变的内容,例如人物身份、产品形状、构图、光线、标签和相机角度。还可以写明不要出现的文字、标志和水印。

6. 给参考图分配角色

有多张输入图时,按编号说明每张图的用途:主体、风格、服装或背景。再说清楚它们应该如何组合,以及哪个元素需要移动到哪里。

7. 一次只改一个问题

把上一次输出作为下一次编辑的输入,每轮只提出一个主要变化。这样更容易判断是哪条指令起了作用,也能减少“改了背景,人物脸也变了”的情况。

三个可以直接套用的提示词

生成真实照片

Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat.
He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms.
He is calmly adjusting a net while his dog sits nearby on the deck.
Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens.
Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance.
The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail.
No glamorization, no heavy retouching.

生成结果:老水手在渔船上修网

这里的写法有几个值得保留的细节:主体、皮肤和材质、动作、镜头范围、光线、质感,以及明确排除过度美化。

生成流程图或教学图

Create a simple biology diagram titled "Cellular Respiration at a Glance" for high school students.

Show how glucose turns into energy inside a cell.
Include glycolysis, the Krebs cycle, and the electron transport chain.
Use arrows to connect the steps, and label the main molecules:
glucose, pyruvate, ATP, NADH, FADH2, CO2, O2, and H2O.
Make it look like a clean classroom handout or slide,
with a white background, simple icons, clear labels, and easy-to-read text.

Avoid tiny text, extra decoration, or anything that makes the diagram hard to understand.

生成结果:细胞呼吸流程图

教学图不能只描述“画得漂亮”。要写清楚受众、要解释的过程、必需的标签、箭头关系和不能出现的装饰。官方示例使用横向尺寸,并把质量设为 high

做局部编辑

In this room photo, replace ONLY the white chairs with chairs made of wood.
Preserve camera angle, room lighting, floor shadows, and surrounding objects.
Keep all other aspects of the image unchanged.
Photorealistic contact shadows and fabric texture.

生成结果:替换木椅后的明亮厨房

这里的重点是 ONLY 和后面的保留条件。对于换家具、删物体、改背景、换衣服等任务,范围写得越清楚,越不容易把整张图重新设计一遍。

官方示例:同一张图片可以围绕局部修改和多轮编辑不断调整

透明产品图怎么做

如果想从商品照片中抠出产品,提示词和参数要一起设置:

Extract the product from the input image and isolate it on a fully transparent background.
Output: centered product, crisp silhouette, no halos/fringing.
Preserve product geometry and label legibility exactly.
Add only light polishing. Do not add a solid backdrop, checkerboard, scenery, or shadow.
Do not restyle the product; remove the background and preserve clean alpha transparency.

生成结果:透明背景的洗发水产品图

API 参数使用:

size="1024x1536"
quality="medium"
background="transparent"
output_format="png"

后续继续编辑时,要再次写明保留透明背景。返回图片后检查 alpha 通道,不要只看预览图中的灰白棋盘格。

多轮编辑的正确方式

官方推荐的流程是:先生成一张起始图,检查结果,再把它作为下一次编辑的输入,每轮只改一个条件。

例如第一轮生成一张产品广告牌:

Create a realistic billboard mockup of the shampoo on a highway scene during sunset.
Billboard text (EXACT, verbatim, no extra characters):
"Fresh and clean"
Typography: bold sans-serif, high contrast, centered, clean kerning.
Ensure text appears once and is perfectly legible.
No watermarks, no logos.

生成结果:日落高速公路上的产品广告牌

第二轮只改变天气:

Make it look like a winter evening with snowfall.

生成结果:改成冬夜降雪后的广告牌

每轮都要检查:文字是否准确,产品形状有没有变化,人物或主体是否保持一致,修改范围外的背景和光线有没有被意外改动。

如果某个区域必须做到像素级不变,不要只依赖提示词。官方建议把已经确认的编辑结果与原图做合成,才能更可靠地保留指定区域。

从旧模型迁移时怎么测

不要直接把旧模型的参数原样复制到 GPT Image 2.5 。建议保留一组具有代表性的生产提示词和参考图,至少包含:复杂编辑、准确文字、人物、人脸、产品结构和透明素材。

迁移时依次比较:

  1. 指令是否被正确执行。
  2. 人物身份、产品形状和标签是否保持。
  3. 文字是否准确、清晰。
  4. 有没有出现没有要求的变化。
  5. 重复请求时结果是否稳定。
  6. 多轮编辑的完整流程是否能持续保留细节。
  7. 质量通过后,响应时间、失败率、重试次数和单张可接受图片成本如何。

确认新模型在小流量工作负载中通过验收后,再逐步扩大使用范围,同时保留旧模型作为回退选项。成本不要凭“更快”推断,当前价格应以官方定价页为准。

生成后一定要检查

一张图能不能用,不能只看“像不像”。至少检查四项:

  • 需要显示的文字是否准确、清楚,流程图标签和关系是否正确。
  • 人物身份、产品形状、标签和参考图细节是否保留。
  • 编辑是否只改变了指定内容。
  • 透明素材是否真的有 alpha 通道,而不是画了一层棋盘格。

GPT Image 2.5 的提示词写法可以很自由,短句、描述段落、 JSON 风格结构、指令和标签都可以。真正影响结果的,是你有没有把主体、动作、构图、变化范围和保留条件说清楚。

如果你的工作流依赖连续修改,建议先用同一组提示词和参考图分别测试 Flare 、 Sunburst,再根据质量、速度和成本做选择。

OpenAI 开发者文档