核心能力
- 文生图 — 根据自然语言描述生成图像
- 图片编辑 — 通过
/v1/images/edits接口对已有图片进行文本提示编辑 - 灵活分辨率 — 支持任意自定义尺寸,最高 4K(3840px),边长须为 16 的倍数
- 精准文字渲染 — 12+ 种语言约 99% 字符级准确率
- 多物体构图 — 复杂场景无遮挡或错位问题
- 多风格 — 写实、插画、动漫、矢量、3D、数据可视化
无论是/v1/images/generations还是/v1/images/edits,n支持 1–10,默认 1。需在控制台选择 Direct 分组。
输出规格
快速示例
参数说明
图片编辑
通过POST /v1/images/edits 对已有图片进行编辑。请求体使用 multipart/form-data,将图片以文件形式上传。
每次请求最多支持 16 张输入图片(image[])。
输入图片格式
支持格式:PNG、JPEG。图片必须通过 multipart/form-data 文件上传 方式传入。需要价格更低、支持
response_format(不支持 n 参数)的版本?请参见 gpt-image-2-c。编辑接口参数
image和image[]二选一,不可同时使用。
遮罩编辑
提供含 Alpha 通道的蒙版图片,控制源图片中需要编辑的区域。Alpha 为白色(不透明)的像素被保留;Alpha 为黑色(透明)的像素将被编辑。 要求:- 蒙版必须包含 Alpha 通道
- 必须与源图片格式和尺寸完全一致
- 文件大小限制:< 50MB
遮罩编辑与 n 参数均需在控制台选择 Direct 分组。
cURL
Python
生成接口 API 参考
POST /v1/images/generations 交互式 Playground。编辑接口 API 参考
POST /v1/images/edits 交互式 Playground。