跳转到主要内容

功能概述

文本审核(Moderation)API 基于先进的 AI 模型,能够自动检测和识别文本内容中的潜在风险,帮助你构建安全、合规的应用程序。
支持 OpenAI Moderation 模型及其他主流内容审核模型,准确率高,响应速度快。

主要能力

违规内容检测

识别暴力、色情、仇恨等违规内容

有害信息过滤

检测自残、骚扰、欺诈等有害信息

多语言支持

支持中文、英文等多语言内容审核

细粒度分类

提供详细的违规类别和置信度评分

快速开始

基础调用示例

使用 Moderation API 检测文本内容是否违规:

批量检测示例

一次性检测多段文本:

审核类别

OpenAI Moderation 支持的类别

不同模型支持的审核类别可能有所不同,请根据实际需求选择合适的模型。

返回结果详解

响应结构

字段说明

flagged

布尔值,是否检测到违规内容

categories

各类别的二元判断结果

category_scores

各类别的置信度评分(0-1)

集成示例

聊天内容审核

在聊天应用中集成内容审核:

UGC(用户生成内容)过滤

在论坛、评论区等场景过滤用户内容:

AI 生成内容审核

对 AI 生成的内容进行二次审核:

高级用法

自定义审核阈值

根据业务需求调整审核严格程度:

审核日志记录

记录审核历史,用于分析和改进:

多模型联合审核

结合多个审核模型提高准确性:

最佳实践

1. 双向审核

输入审核

审核用户输入,防止恶意请求

输出审核

审核 AI 生成内容,确保输出安全

2. 异步审核

对于非实时场景,使用异步审核提升性能:

3. 缓存审核结果

对于相同内容,缓存审核结果减少 API 调用:

4. 分级处理

根据违规程度采取不同措施:

常见问题

审核是否支持中文?

支持。OpenAI Moderation 和其他主流审核模型都支持中文内容审核,准确率与英文相当。

审核延迟是多少?

通常在 100-500ms 之间,具体取决于:
  • 文本长度
  • 模型选择
  • 网络状况

如何处理误判?

建议采取分级策略:
  1. 高置信度违规:直接拒绝
  2. 中等置信度:人工复审
  3. 低置信度:放行或提示

审核是否收费?

OpenAI Moderation API 目前免费,其他模型可能收费,详见 定价说明

可以审核图片和视频吗?

当前 Moderation API 主要针对文本内容。图片和视频审核需要使用专门的多模态审核模型。

相关文档

文本生成

Chat Completions API 文档

内容安全

平台内容安全政策

错误处理

API 错误处理最佳实践

定价说明

审核 API 定价详情