功能概述
文本生成(Chat Completions)是 API易平台最核心的能力之一,支持调用 400+ 热门 AI 大模型进行智能对话和文本生成。通过统一的 OpenAI 兼容接口,你可以轻松实现:- 智能对话:构建聊天机器人、虚拟助手
- 内容创作:文章写作、创意生成、文案润色
- 代码辅助:代码生成、调试、重构建议
- 知识问答:回答问题、知识检索、信息提取
- 角色扮演:定制化 AI 角色、场景模拟
支持 OpenAI GPT-4、Claude、Gemini、DeepSeek、Qwen 等 400+ 主流大模型,一个 API Key 调用所有模型。
快速开始
基础对话示例
使用 Chat Completions API 进行简单的单轮对话:多轮对话示例
通过messages 数组维护对话历史,实现上下文连贯的多轮对话:
核心参数详解
model(必填)
指定要使用的模型名称,详见 模型信息 页面。messages(必填)
对话消息数组,每条消息包含role 和 content 字段:
system
系统提示,定义 AI 的行为和角色
user
用户消息,代表用户的输入
assistant
助手消息,代表 AI 的回复
temperature(可选)
控制输出的随机性,范围0.0 ~ 2.0,默认 1.0:
- 0.0 ~ 0.3:输出更确定、一致,适合事实性任务(翻译、总结、代码生成)
- 0.7 ~ 1.0:平衡创造性和准确性,适合日常对话
- 1.0 ~ 2.0:输出更有创意、多样性,适合创意写作、头脑风暴
max_tokens(可选)
限制生成的最大 token 数量,用于控制成本和响应长度:top_p(可选)
核采样参数,范围0.0 ~ 1.0,控制输出的多样性:
- 较低的值(如
0.5):输出更聚焦、确定 - 较高的值(如
0.9):输出更多样、随机
通常建议只调整
temperature 或 top_p 其中之一,避免同时使用。stream(可选)
启用流式输出,逐 token 返回结果,提升用户体验:高级用法
系统提示(System Prompt)
通过system 角色定义 AI 的行为、角色、知识范围和回复风格:
角色扮演
创建具有特定性格和专业领域的 AI 助手:上下文管理
对于长对话,需要合理管理上下文长度,避免超过模型的 token 限制:JSON 模式输出
某些模型支持强制输出 JSON 格式:最佳实践
1. 选择合适的模型
根据任务需求选择性价比最优的模型:2. 优化提示词(Prompt)
好的提示词能显著提升输出质量:明确任务
清楚说明需要 AI 做什么,提供必要的上下文
指定格式
明确输出格式、长度、语气等要求
提供示例
给出输入输出示例,帮助 AI 理解期望
分步引导
复杂任务拆分成多个步骤,逐步完成
3. 控制成本
合理使用参数降低 API 调用成本:4. 错误处理
添加异常处理,提升应用稳定性:5. 使用流式输出
对于长文本生成,建议使用流式输出提升用户体验:常见问题
如何计算 token 数量?
不同模型的 tokenizer 不同,建议使用tiktoken 库估算:
为什么输出被截断了?
可能的原因:- 达到了
max_tokens限制 - 模型的上下文窗口不足
- 触发了内容安全策略
- 增加
max_tokens参数 - 选择支持更长上下文的模型
- 检查
finish_reason字段判断原因
如何实现对话记忆?
在应用层维护对话历史:相关文档
模型信息
查看支持的所有模型及定价
文本嵌入
将文本转换为向量表示
流式输出
实现打字机效果的流式响应
错误处理
处理 API 调用异常