AI Text Moderation API
收藏资源简介:
AI-powered text moderation in 40+ languages: 10 violation categories including NSFW and spams — and get the text back with profanity auto-masked (`***`) in the same call.
AI Text Moderation API 数据集详情
核心功能:市场领先的AI文本审核API,支持40多种语言,可检测毒性、仇恨言论、成人内容、垃圾信息等10+违规类别,并能在同一调用中返回带自动掩码(***)的文本。
关键特性:
- 简单易用:单个端点,语义化类别名称,无需SDK。
- 可操作性强:三级审核结果(
clean/review/rejected)直接对应发布、人工审核、屏蔽操作。 - 透明可解释:明确显示触发的单词和类别。
- 快速可靠:全球部署,毫秒级检测,同步响应。
- 多语言支持:自动检测语言,并按地区调整审核策略。
- 抗规避:能捕获同音字、相似字符、拆分词等混淆变体。
- 自动掩码:在
masked_text中将违规词替换为*。
检测类别(共10类)
| 类别 | 说明 |
|---|---|
politics |
政治敏感内容 |
terrorism |
恐怖主义和暴力极端主义 |
prohibited |
非法或违禁物品(毒品、武器等) |
adult |
色情和成人内容 |
ads |
垃圾信息、广告、推广 |
abuse |
侮辱和言语攻击 |
hate_speech |
仇恨言论和歧视 |
minor_protection |
对未成年人有害的内容 |
sensitive_topics |
其他敏感话题 |
private_trading |
平台外/私下交易邀约 |
默认检查所有类别,可通过可选参数 categories 指定需要检查的类别。
API 请求
端点:POST /moderate
请求体(JSON):
| 字段 | 类型 | 必填 | 说明 |
|---|---|---|---|
text |
string | 是 | 要审核的文本,长度1–1024字符 |
categories |
string[] | 否 | 要检查的类别,默认为全部(上述10个类别名) |
超过1024字符的文本需分为多个请求。
API 响应
响应示例: json { "verdict": "rejected", "masked_text": "you are a ******* *****", "flagged_words": ["idiot", "fuck"], "flagged_categories": ["abuse"], "request_id": "8a1f3b2c4d5e6f70" }
审核结果解释:
clean:安全,可自动发布。review:边缘内容,需人工审核。rejected:应屏蔽,或发布masked_text替代原文。
flagged_words 和 flagged_categories 用于说明文本被标记的原因。部分检测(如垃圾信息)基于上下文,此时 flagged_words 可能为空,但 flagged_categories 仍会指示命中的类别。
错误处理
所有错误采用统一格式: json { "error": { "code": "invalid_text", "message": "text is required and must be 1-1024 characters." } }
| HTTP状态码 | 错误码 | 含义 |
|---|---|---|
| 400 | invalid_text |
text 缺失、为空或超过1024字符 |
| 400 | invalid_category |
categories 中包含未知值 |
| 400 | invalid_json |
请求体不是有效的JSON |
| 502 | service_error |
服务暂时不可用,可重试 |



