两个模型都接受文本和图片输入并输出图片。使用
POST /v1/images/generations 根据文本生成图片,或使用 POST /v1/images/edits 编辑一张或多张上传图片。
GPT Image 2.5 的主要提升
- 更高的参考图保真度 — 转换后更容易保留主体、显著特征、光照和纹理。
- 更精确的编辑 — 更擅长只修改指定元素,同时保留周围主体、构图和视觉风格。
- 更稳定的连续修改 — 后续编辑不容易撤销之前的修改或降低图片质量。
- 更快的生成速度 — OpenAI 将 Flare 定位为多数应用的默认选择,并称其延迟相比 GPT Image 2 最多降低 50%。
- 更好的复杂版式处理 — 对复杂视觉指令、透明背景和版式敏感型创作的处理更可靠。
官方编辑示例
下面的 OpenAI 发布示例修改了人物服装,同时保留人物身份、姿势、纸质照片场景和蓝色背景。
输入 — OpenAI 官方示例

编辑结果 — OpenAI 官方示例
以上素材来自 OpenAI GPT Image 2.5 发布文章,用于展示上游模型能力,不代表通过 AnyFast 复现的验证结果。
核心能力
- 文生图 — 根据自然语言提示词生成图片
- 图片编辑 — 对上传图片进行整体或局部修改
- 灵活尺寸 — 使用推荐尺寸或符合规则的自定义
宽x高尺寸,最高支持 4K - 扩展质量等级 — 支持
low、medium、high、xhigh、max和auto - 透明背景 — 使用 PNG 或 WebP 输出透明背景图片
- 多图输出 — 通过
n在一次生成请求中返回多张图片
- 图片生成
- 图片编辑
向
POST /v1/images/generations 发送 JSON 请求。需要更快响应时选择 Flare,需要更高编辑和渲染精度时选择 Sunburst。cURL
输出控制
自定义尺寸规则
自定义尺寸必须同时满足以下要求:- 宽和高均为 16 像素的倍数。
- 宽高比在
1:3到3:1之间。 - 任一边均不超过 3,840 像素。
- 总像素数在 655,360 到 8,294,400 之间。
- 高于
2560x1440的分辨率属于实验能力。
图片编辑输入
- 使用
image上传一张源图片,或使用image[]上传最多 16 张源图片。 - 图片 API 编辑端点使用 multipart 文件上传,不传入公开图片 URL。
- 可选蒙版必须包含 Alpha 通道,并与第一张源图片的格式和尺寸一致。
- 源图片和蒙版文件均须小于 50 MB。
响应处理
GPT Image 模型通过data[].b64_json 返回图片数据。请解码 Base64 内容,并根据响应中的 output_format 使用对应扩展名保存。DALL·E 模型使用的 response_format 参数不适用于 GPT Image 2.5。
解码第一张结果
OpenAI 上游还允许受支持的主模型通过 Responses API 图片生成工具调用 GPT Image 2.5。本页仅说明 AnyFast 直接提供的图片 API 端点。
GPT Image 2.5 API 参考
查看图片生成和编辑的请求字段及响应结构。