Content Moderation API
收藏官方服务:
资源简介:
Moderate text and usernames in 5 languages: profanity, toxicity and PII detection with spans and censored output.
创建时间:
2026-07-27
原始信息汇总
数据集概述
名称: Content Moderation API
提供者: Rhodium Tecnologia
类别: 文本分析
描述: 该API用于内容审核,能够快速检测并处理文本中的不当内容。它提供的不只是一个简单的“是/否”判定,而是包含详细的审核结果,包括严重程度、违规类别、置信度以及具体违规字符的位置。
核心功能
- 文本与用户名审核:提供专门的端点用于审核文本和用户名。
- 多维度检测:检测内容包括脏话、侮辱、毒性和个人身份信息 (PII)。
- 详细响应:每个响应都包含:
- 违规标记:明确是否违规 (flagged)。
- 严重程度:分为低 (low)、中 (medium)、高 (high)。
- 违规类别:如脏话、侮辱、毒性、PII。
- 置信度。
- 违规字符跨度:精确指出文本中哪些字符违规。
- 已过滤文本:直接提供一个“已打码”的文本版本,可以直接用于显示。
- 伪装检测:能够识别如
f@ck这样的规避尝试。 - 多语言支持:支持英语、葡萄牙语、西班牙语、法语和德语。
适用场景
- 评论、聊天室、论坛和产品评价的审查。
- 用户名、显示名称和个人简介的审核。
- 市场和分类广告列表审核。
- 儿童产品和有严格政策的社区。
- 在用户输入进入大型语言模型 (LLM) 前进行预过滤。
使用方式
该API通过HTTP POST请求调用,需要提供API密钥。以下是一个示例:
-
请求示例:向
https://content-moderation.p.rapidapi.com/moderate/text发送POST请求,请求体为JSON格式,包含待审核的文本。 -
响应示例:返回一个JSON对象,包含
flagged(标记),severity(严重程度),censored_text(已过滤文本) 和spans(违规片段详情) 等信息。
定价方案
提供多个订阅计划,包括 BASIC(免费)、PRO、ULTRA 和 MEGA。



