Skip to main content
POST
图片编辑:根据指令编辑或融合参考图,可锁定输出尺寸
右侧的交互式 Playground 支持直接上传本地图片。请在 Authorization 中填入你的 API Key(格式:Bearer sk-xxx),选择图片与填入 promptmodelsize 后一键发送即可。
场景说明:本页用于「基于一张或多张参考图改图 / 融合生成」。请求为 multipart/form-data 格式。如需纯文本生成图片,请使用 文生图接口gpt-image-2-all 的区别:调用结构完全一致,只多一个 size 字段;不需要锁尺寸、追求出图速度时改用 gpt-image-2-all
🖥️ 浏览器 Playground 限制本端点默认返回 base64 字符串(b64_json,体积可达数 MB,浏览器 Playground 可能弹出 请求时发生错误: unable to complete request ——实际请求已经成功,只是浏览器无法显示这么长的 base64。推荐做法:想要 base64 或要传超大参考图时,复制下方”代码示例”到本地运行,代码会自动处理上传与解码。
📎 多图融合顺序有意义image 字段可重复传入多张参考图,顺序将作为 prompt 中「图1/图2/图3」的引用依据。建议在 prompt 中显式指代,例如:
把图1的人物放进图2的场景,参考图3的画风
推荐单张 ≤ 10MB,格式 png / jpg / webp,过大的图可能触发网关限制。
🎯 保形改图小技巧:传 size=auto(或不传 size)时,输出会跟随 prompt 里点名要修改的那张图的尺寸比例——多图场景下不一定是第一张例如 prompt 写”修改图2,把图2 的衣服和帽子改成图1 里的样子”,那图2 是 1:1,则输出也是 1:1(即便图1 是横版 16:9)。对换装、加帽子、修图等保形场景特别好用。如果 prompt 没明确指代要改哪张,模型会自行判断;需要切换到 30 档锁定尺寸时再显式传 size
⚠️ 关键参数说明
  • size改图建议传 auto(或不传)——模型会根据 prompt 里点名要修改的那张图的尺寸比例输出,多图场景下不一定是第一张。例如 prompt 写”修改图2,把图2 的衣服换成图1 的样子”,输出比例就跟图2 一致;prompt 没明确指代时由模型自行判断。需要强制改变尺寸时,从 30 档常见尺寸里选;写法用半角小写 x,如 2048x13603840x2160。完整表见 概览页
  • quality:❌ 不接受,不要传
  • n:❌ 不接受,单次仅返回 1 张图。
  • response_format:不传默认返回 base64(纯 base64 无前缀,2026-07 实测);传 "url" 可返回图片 URL。强依赖 URL 输出的业务建议把令牌分组切到 image2_OSS,稳定输出 URL、不降级为 base64。

代码示例

Python

单图编辑
多图融合

cURL

单图编辑
多图融合

Node.js(原生 fetch + FormData)

浏览器 JavaScript(File 对象)

参数说明速查

多轮迭代:把上一次的输出图片作为下一次的 image 输入,配合新的编辑指令,可逐步精调画面效果。每一轮都可以独立指定 size

响应格式

与文生图接口一致:默认返回 base64data[0].b64_json,纯 base64 无前缀,2026-07 实测)。如需 图片 URL:显式传 response_format: "url" 即可;强依赖 URL 输出的业务建议把令牌分组切到 image2_OSS,稳定输出 URL、不降级为 base64。data[0] 中只会出现 urlb64_json 之一,不会两者都返回。 b64_json 模式(默认):
url 模式(显式传 response_format: "url";强依赖 URL 建议用 image2_OSS 分组):
2026-07 实测 b64_json 字段为纯 base64(不含 data: 前缀),需解码或自行拼接前缀后使用;历史版本曾直接带前缀。请先做 startsWith('data:') 检测再处理,兼容两种形态。

相关资源

模型概览(含完整 size 表)

30 档 size 完整对照表、定价、技术规格

文生图 API

/v1/images/generations 兼容端点

姐妹模型 gpt-image-2-all

不需要锁尺寸时调用方式一致,出图更快

授权

Authorization
string
header
必填

在 API易控制台获取的 API Key

请求体

multipart/form-data
model
enum<string>
默认值:gpt-image-2-vip
必填

模型名称,固定为 gpt-image-2-vip

可用选项:
gpt-image-2-vip
prompt
string
必填

编辑/融合指令。多图场景可用「图1/图2/图3」指代 image 字段的上传顺序

示例:

"把图1的人物放进图2的场景,参考图3的画风"

image
file[]
必填

参考图。单图直接传一次,多图重复传同名 image 字段(例如 -F image=@a.png -F image=@b.png),按上传顺序对应 prompt 中的「图1/图2/...」。推荐单张 ≤ 10MB,格式 png/jpg/webp。

size
enum<string>

输出尺寸。改图场景推荐传 auto(或不传)——模型会根据 prompt 里点名要修改的那张图的尺寸比例输出(多图场景下不一定是第一张)。例如 prompt 写"修改图2,把图2 的衣服换成图1 的样子",则输出比例跟图2 一致。如果 prompt 没明确指代,模型会自行判断。如需强制改变尺寸,从 30 档常见尺寸里选;写法:宽x高(半角小写 x),如 2048x13603840x2160。所有档位统一价 $0.03/张。

可用选项:
auto,
1280x1280,
848x1280,
1280x848,
960x1280,
1280x960,
1024x1280,
1280x1024,
720x1280,
1280x720,
1280x544,
2048x2048,
1360x2048,
2048x1360,
1536x2048,
2048x1536,
1632x2048,
2048x1632,
1152x2048,
2048x1152,
2048x864,
2880x2880,
2336x3520,
3520x2336,
2480x3312,
3312x2480,
2560x3216,
3216x2560,
2160x3840,
3840x2160,
3840x1632
示例:

"2048x1360"

响应

成功生成图片。响应默认返回 base64(data[0].b64_json),不会同时返回 url

图片编辑响应。默认返回 base64data[0].b64_json);如需 url,请改用 image2_OSS 分组并传 response_format=urldata[0]只会出现 urlb64_json 之一,不会两者都返回。

data
object[]

生成结果数组(本模型单次返回 1 张)

created
integer

创建时间戳(Unix 秒)

usage
object

Token 用量统计