/v1/responses 是 OpenAI 当前的原生主力端点。官方原话:“While Chat Completions remains supported, Responses is recommended for all new projects.” API易 完整支持该端点,base_url 换成 https://api.apiyi.com/v1 即可。
本页基于 OpenAI 官方文档整理(developers.openai.com/api/docs,2026年6月数据),示例均可直接复制运行。
为什么用 Responses
相比 Chat Completions,官方给出的三个硬数字:- 推理更强:同一个推理模型走 Responses 端点,SWE-bench 成绩提升约 3%(推理状态跨轮保持)
- 缓存更省:缓存利用率比 Chat Completions 高 40%–80%(官方内部测试),输入账单直接受益
- 工具更多:
web_search、code_interpreter等内置工具只在 Responses 提供
/v1/chat/completions),或需要用同一套代码调 Claude、Gemini 等非 OpenAI 模型 —— 见 兼容模式调用。
被弃用的是 Assistants API(官方计划 2026年8月26日 关停),不是 Chat Completions。两个端点都会长期支持,只是新功能优先落在 Responses。
快速开始
请求参数速查表
响应结构
output 是一个 item 数组,常见三种类型:reasoning(推理摘要)、message(文本回复)、function_call(函数调用请求)。精简后的响应示例:
usage 里两个值得盯的字段:
input_tokens_details.cached_tokens:命中缓存的输入量(按 0.1× 计费)output_tokens_details.reasoning_tokens:推理消耗(按输出价计费,调低reasoning.effort可控)
多轮对话:自己维护历史
经 API易 调用 Responses API,多轮请把完整历史作为input 数组传入(每条带 role / content),与 Chat Completions 的做法一致:
推理与输出控制
reasoning.effort 档位选型
text.verbosity 输出长度
low / medium(默认)/ high 控制回答详略,仅 Responses 端点支持:
流式输出
Responses 的流式是语义化事件,不是 Chat Completions 那种choices[0].delta 通用块。核心事件:
内置工具一览
内置工具是 Responses 独有能力,在tools 数组里声明即可,无需自己实现执行逻辑:
web_search 最小示例:
内置工具依赖 OpenAI 服务端执行,API易 通道对各内置工具的透传支持情况以实测为准。函数调用(自定义工具)完整支持,见 FC函数调用。
Pro 模型与 background 模式
gpt-5.4-pro、gpt-5.5-pro 是面向专业场景的深度推理模型($30 / $180 每百万 tokens,仅 svip 分组可用),实务上仅通过 /v1/responses 调用。单次请求耗时可达分钟级,建议配合 background: true 异步执行:
支持的模型与价格
日期固定版本(如
gpt-5.4-2026-03-05)同步在售,价格与主版本一致。完整列表见 模型与价格总览。
与 Chat Completions 对照
从/v1/chat/completions 迁移过来的字段映射:
客户端支持现状
为什么 Cline、Trae 等 VS Code 系 IDE / 插件大多只支持/v1/chat/completions,不支持本页的 Responses 端点?
- chat/completions 是事实上的行业通用协议:第三方网关、本地推理框架(Ollama / vLLM / LM Studio)、各家非 OpenAI 厂商全都实现它,客户端写一套处理逻辑就能接几百家供应商;而
/v1/responses目前基本是 OpenAI 专属方言 - Responses 不是「换个 URL」:语义化事件流(不是 delta 拼接)、item 化输出、推理状态传递都与 chat/completions 完全不同,客户端需要重写整个 agent 循环,维护成本高
- 鸡生蛋问题:客户端不做,是因为大多数自定义端点(网关)不支持 responses;网关反过来也不急着做。API易 已托管
/v1/responses(即本页),不存在网关侧障碍
需要 GPT-5.4+「推理 + 工具调用」的场景,首选 Codex CLI / opencode,Base URL 指向
https://api.apiyi.com/v1 即可;只用到 gpt-5.4、又想留在 VS Code 系 IDE(含 Trae)里的,可装 Roo Code 插件并选 OpenAI provider。