概述
gpt-image-2-vip 是 API易 平台上线的 GPT 图像生成 Codex 官逆模型。与gpt-image-2-all 同价 $0.03/张,调用方式完全一致,最大区别是 支持 size 参数——覆盖 10 比例 × 3 分辨率档(1K Fast / 2K Recommended / 4K Detail)共 30 档常见尺寸,含 4K。
gpt-image-2-vip。请求体里只需把 model 改成 gpt-image-2-vip、加一个 size 字段,其它代码与 gpt-image-2-all 完全相同。文生图 API
/v1/images/generations,输入文本提示词 + size 生成指定尺寸图片。图片编辑 API
/v1/images/edits,multipart 上传参考图 + 编辑/融合指令。与 gpt-image-2-all 的关键差异
gpt-image-2-vip 与 gpt-image-2-all 同属逆向通道、同价、同套调用代码。互相映射——把同一段请求里的 model 字段从一个换成另一个,行为整体一致,差异如下:
核心特性
稳定锁定输出尺寸
size 字段直接接受 30 档常见尺寸,电商主图、海报模板、4K 壁纸都能严格输出4K 高分辨率
所有 size 统一价
调用方式同 -all
gpt-image-2-all 完全一致,可秒级切换模型名文字还原度高
中文提示词友好
自然语言改图
标准端点兼容
/images/generations、/images/edits模型定价
- 所有 30 档 size 统一定价 $0.03/张——4K Detail 不加价
- 失败请求不计费(如鉴权失败、参数校验失败)
- 如需生成 N 张,客户端并行调用 N 次
分组介绍
gpt-image-2-vip 放在 Default 默认分组 即可,不需要额外切分组。逆向通道目前供给稳定,不存在像官转那样需要”企业分组”过渡的场景。
需要确定性 URL 输出 → 切到 image2_OSS 分组
gpt-image-2-vip(及 gpt-image-2-all)在默认分组下实测(2026-07)不传 response_format 时返回 b64_json;显式传 response_format: "url" 可拿到图片 URL。但默认分组的输出格式不做承诺——历史上曾默认返回 url、资源紧张时降级为 b64_json,行为随负载与渠道版本变化过。
如果你的业务强依赖 URL 输出(直接把 URL 落库、前端按 URL 渲染、不接受 base64),请把令牌分组切到 image2_OSS——这是专为 URL 输出确定性设计的分组,1x 倍率(不加价),对 gpt-image-2-vip 和 gpt-image-2-all 两个官逆模型都生效,保证响应稳定输出图片 URL,不会降级为 base64。

令牌创建:计费模式选「按量优先」,分组选 image2_OSS(1x)——需要确定性 URL 输出时使用
image2Enterprise 企业分组:/live/2026-04/image2-enterprise
技术规格
端点一览
gpt-image-2-vip 与 gpt-image-2-all 兼容完全相同的两个端点。把 model 字段换掉、按需加上 size 即可:
支持的 size(30 档完整对照表)
gpt-image-2-vip 支持 10 个比例 × 3 个分辨率档 = 30 档 常见尺寸。请求体直接传 size: "宽x高"(半角小写 x)。
1K Fast — 草稿与低成本试稿
2K Recommended — 默认推荐档(多数终稿)
4K Detail — 大尺寸交付物
size,不要传 quality):
最佳实践
输入图先压到 1.5MB 以内(图生图 / 多图融合)
shell_api_error / Unknown error 大多就是图片体积过大触发的,压一下请求成功率和出图速度都会明显改善。输出分辨率由 size 字段决定,与输入图体积无关——压小输入只会提速、不会损画质。提示词里光写 4K / 8K 这类词也不会真给你 4K,画质看 size,不看 prompt 修饰词。按交付物档位选 size
size 用半角小写 x
"size": "1536x1024",不是 1536×1024、不是大写 X。不要传 quality 与 n
quality 不接受;n 单次仅返回 1 张图,多张请客户端并行调用。超时设到 300 秒
响应格式按需选择
b64_json,服务端中转存储用 url。代码可与 -all 共用
model 在 gpt-image-2-all ↔ gpt-image-2-vip 之间切换即可。需要锁尺寸时切到 -vip,需要更快出图时切回 -all。错误码与重试
- 请求超时 300 秒 起步(保守值;典型 90–150s,但 4K Detail + 高峰长尾会更长)
- 对 5xx 与超时做 指数退避重试(建议 2–3 次)
- 记录响应头
request-id方便排查
常见问题
vip 和 -all 调用代码可以共用吗?
vip 和 -all 调用代码可以共用吗?
/v1/images/generations、/v1/images/edits)的请求字段、响应字段、b64_json 前缀行为都一致。差异只有两处:model字段:gpt-image-2-vip↔gpt-image-2-allsize字段:vip 接受 30 档常见尺寸;-all 不接受size,尺寸要写进 prompt
if model == 'vip': payload['size'] = ... 的开关即可。vip 出图为什么这么慢?
vip 出图为什么这么慢?
gpt-image-2-vip 走的是 Codex 逆向通道,典型 90–150 秒,与官转 gpt-image-2(100–120 秒)持平,比 ChatGPT 网页线路的 gpt-image-2-all(约 30–60 秒)慢。如果对响应延迟敏感,建议优先用 gpt-image-2-all;只在必须锁尺寸或 4K 时切换到 vip。size 必须严格按表里写吗?传 1024x768 会怎么样?
size 必须严格按表里写吗?传 1024x768 会怎么样?
invalid_request_error,请按交付需求选最接近的档位。4K 调用为何频繁报 500?怎么稳定出 4K?
4K 调用为何频繁报 500?怎么稳定出 4K?
3840x2160 / 2880x2880)较容易触发 status_code: 500 错误,上游返回 invalid_request_error:- 优先改用 2K Recommended 档(如
2048x1360/2048x2048)—— 2K 成功率显著更高,价格同样 $0.03/张 - 图生图 / 多图融合少传输入图 —— Codex 官逆链路对多入图请求处理压力大,会进一步增加 4K 失败率;单张输入图先压到 1.5MB 以内也有帮助
- 如必须稳定出 4K —— 切换到官转模型
gpt-image-2+image2Enterprise企业分组。官转 4K 价格更高(约 $0.3+/张),但稳定性显著更好,适合对 4K 交付有硬要求的场景。
输入图要压缩吗?提示词里写 4K / 8K 有用吗?
输入图要压缩吗?提示词里写 4K / 8K 有用吗?
shell_api_error / Unknown error 大多就是图片体积过大触发的,压一下请求成功率和出图速度都会明显改善。注意 1.5MB 是推荐上限(追求稳定性与速度),上面 FAQ 写的 10MB 是网关硬上限。别担心压输入会损画质——本模型输出分辨率由 size 参数决定,跟你上传图的体积没关系。压小输入只会提速、不会损画质。提示词里光写 4K / 8K 这类词也不会真给你 4K。如果 prompt 写 8K 超清 但 size 选 1024x1024,最终拿到的就是 1K 水平。要 4K 请在 size 字段里指定——30 档里 1K / 2K / 4K 同价 $0.03/张,按需要直接选。📖 排错来源:/live/2026-05/gpt-image-2-vip-unknown-error4K 真的不加价吗?
4K 真的不加价吗?
3840x2160 / 2880x2880 等)与 1K / 2K 同价 $0.03/张。支持 n 参数吗?传 n=3 会怎样?
支持 n 参数吗?传 n=3 会怎样?
n=3,计费会按 0.03 × 3 = $0.09 扣费,但实际上仍然只返回 1 张图。请务必把 n 字段从请求里去掉,避免被多扣费。内容被拒/模型回复「我不能做到这个需求」,会计费吗?
内容被拒/模型回复「我不能做到这个需求」,会计费吗?
- ✅ 前置内容过滤 / 风险提示:在前端或接入层先做一道关键词与场景过滤(如真实姓名、版权角色、敏感题材),并在 UI 上提示”涉及名人/版权题材时上游限制较严,可能失败也会计费”,能显著降低误扣率。
- ✅ C 端产品月度补发:理解 C 端产品无法完全控制用户输入。如果你的月用量较大(月消费 $1000+ 起),可以按月汇总日志(短耗时调用通常对应软拒绝)联系客服一次性人工补发,无须逐条申诉。
b64_json 前缀要不要自己加 data:image/png;base64,?
b64_json 前缀要不要自己加 data:image/png;base64,?
b64_json 为纯 base64(不带前缀),需要解码写文件或自行拼接前缀后再渲染;但历史版本曾直接带前缀。请在代码里做 startsWith('data:') 检测:有前缀直接用作 img src,无前缀先解码,避免双重拼接或带前缀解码产出损坏的图片。参考图最大多大?格式要求?
参考图最大多大?格式要求?
png / jpg / webp。过大的图可能触发网关限制。多图融合时每张都需满足此限制。生成的图片 URL 有效期是多久?需要自己转存吗?
生成的图片 URL 有效期是多久?需要自己转存吗?
url 模式响应的 url 字段是 R2 CDN 加速链接,有效期约 1 天(24 小时),过期后会 404。强烈建议:生成后尽快把图片 转存到自己的对象存储(S3 / OSS / R2)、CDN 或数据库,不要长期直接引用本服务返回的 URL。能流式返回吗?
能流式返回吗?
能用 OpenAI 的官方 SDK 直连吗?
能用 OpenAI 的官方 SDK 直连吗?
base_url 指向 https://api.apiyi.com/v1,api_key 设为 API易 令牌即可。client.images.generate(model="gpt-image-2-vip", size="2048x1360", prompt=...) 直接可用。还能用 /v1/chat/completions 对话方式出图吗?
还能用 /v1/chat/completions 对话方式出图吗?
/v1/images/generations 与 /v1/images/edits(更稳定、与官转 gpt-image-2 同套代码)。对话方式仅适合两类场景:多轮迭代改图、需要直接传在线图片 URL。注意出图意图不够明确时可能返回纯文字而不是图片(可在提示词开头加「生成图片:」前缀强化)。详细参数见 对话式调用说明。什么时候应该改用官方版 gpt-image-2?
什么时候应该改用官方版 gpt-image-2?
quality(low/medium/high)档位、需要 mask 局部重绘、需要 OpenAI 官方完全一致的字段行为时,改用 gpt-image-2(官转)。详见 官转 vs 官逆 对比。相关文档
- GPT-Image-2-All 概览 - 同价位、出图更快的姐妹模型,适合不需要锁尺寸的场景
- ⚖️ 官转 vs 官逆 对比 - 与官方版
gpt-image-2(含-all/-vip)的选型对照表 - 文生图 Playground -
/v1/images/generations兼容端点,传size锁定尺寸 - 图片编辑 Playground -
/v1/images/edits多图融合与改图 - GPT-Image-2 官方版 - 需要
quality参数 / mask 局部重绘 / OpenAI 官方对齐字段时的选择 - GPT-Image 系列总览 - 官方 GPT-Image 系列对比
- API 使用手册 - 通用调用规范
gpt-image-2。