Skip to main content
GPT Image 2.5 是 OpenAI 的图片生成与编辑模型系列。AnyFast 通过图片 API 提供以下两个模型: 两个模型都接受文本和图片输入并输出图片。使用 POST /v1/images/generations 根据文本生成图片,或使用 POST /v1/images/edits 编辑一张或多张上传图片。

GPT Image 2.5 的主要提升

  • 更高的参考图保真度 — 转换后更容易保留主体、显著特征、光照和纹理。
  • 更精确的编辑 — 更擅长只修改指定元素,同时保留周围主体、构图和视觉风格。
  • 更稳定的连续修改 — 后续编辑不容易撤销之前的修改或降低图片质量。
  • 更快的生成速度 — OpenAI 将 Flare 定位为多数应用的默认选择,并称其延迟相比 GPT Image 2 最多降低 50%。
  • 更好的复杂版式处理 — 对复杂视觉指令、透明背景和版式敏感型创作的处理更可靠。

官方编辑示例

下面的 OpenAI 发布示例修改了人物服装,同时保留人物身份、姿势、纸质照片场景和蓝色背景。
身穿红色上衣、蓝色背景的儿童纸质肖像输入照片

输入 — OpenAI 官方示例

将服装改为象牙白礼服并保留姿势和蓝色背景的儿童纸质肖像

编辑结果 — OpenAI 官方示例

以上素材来自 OpenAI GPT Image 2.5 发布文章,用于展示上游模型能力,不代表通过 AnyFast 复现的验证结果。

核心能力

  • 文生图 — 根据自然语言提示词生成图片
  • 图片编辑 — 对上传图片进行整体或局部修改
  • 灵活尺寸 — 使用推荐尺寸或符合规则的自定义 宽x高 尺寸,最高支持 4K
  • 扩展质量等级 — 支持 lowmediumhighxhighmaxauto
  • 透明背景 — 使用 PNG 或 WebP 输出透明背景图片
  • 多图输出 — 通过 n 在一次生成请求中返回多张图片
POST /v1/images/generations 发送 JSON 请求。需要更快响应时选择 Flare,需要更高编辑和渲染精度时选择 Sunburst。
cURL

输出控制

自定义尺寸规则

自定义尺寸必须同时满足以下要求:
  • 宽和高均为 16 像素的倍数。
  • 宽高比在 1:33:1 之间。
  • 任一边均不超过 3,840 像素。
  • 总像素数在 655,360 到 8,294,400 之间。
  • 高于 2560x1440 的分辨率属于实验能力。

图片编辑输入

  • 使用 image 上传一张源图片,或使用 image[] 上传最多 16 张源图片。
  • 图片 API 编辑端点使用 multipart 文件上传,不传入公开图片 URL。
  • 可选蒙版必须包含 Alpha 通道,并与第一张源图片的格式和尺寸一致。
  • 源图片和蒙版文件均须小于 50 MB。

响应处理

GPT Image 模型通过 data[].b64_json 返回图片数据。请解码 Base64 内容,并根据响应中的 output_format 使用对应扩展名保存。DALL·E 模型使用的 response_format 参数不适用于 GPT Image 2.5。
解码第一张结果
OpenAI 上游还允许受支持的主模型通过 Responses API 图片生成工具调用 GPT Image 2.5。本页仅说明 AnyFast 直接提供的图片 API 端点。
上游模型规格请参阅 OpenAI 图片生成指南创建图片 API创建图片编辑 APISunburst 模型页面Flare 模型页面

GPT Image 2.5 API 参考

查看图片生成和编辑的请求字段及响应结构。