跳转到主要内容
POST
对话补全:Gemini 3.5 Flash-Lite(OpenAI 兼容)
右侧 Playground 可直接调试:在 AuthorizationBearer sk-your-api-key,点击发送即可看到响应——默认零思考,速度很快。
需要深度推理传 reasoning_effort: "high"(注意:本模型该端点不回显 reasoning_tokens,精确观测思考消耗请用 原生在线调试)。搜索 grounding、代码执行等原生工具本端点不支持。概览与实测数据见 Gemini 3.5 Flash-Lite 概览

参数说明速查

响应要点

  • 本模型 usage.completion_tokens_details.reasoning_tokens 不回显(3.6 Flash 正常回显)——思考消耗已计入 completion_tokens
  • 思考正文(reasoning_content)本端点不回显
  • 模型名注意核对 gemini-3.5-flash-lite(三段小写连字符)

授权

Authorization
string
header
必填

在请求头中添加 Authorization: Bearer YOUR_API_KEY

请求体

application/json
model
string
必填

固定 gemini-3.5-flash-lite

messages
object[]
必填

OpenAI 标准消息数组

max_tokens
integer

输出配额;开思考时建议 2000+(思考计入输出)

temperature
number
stream
boolean

SSE 流式输出

reasoning_effort
enum<string>

思考分档

可用选项:
low,
medium,
high
response_format
object

结构化输出,支持 json_schema

tools
object[]

Function Call 工具列表

响应

对话补全成功

id
string
model
string
choices
object[]
usage
object

用量统计