Profanity Filter and Moderation
收藏数据链接:
官方服务:
资源简介:
Detect and censor profanity, slurs, and toxic language across 13+ languages. Deterministic and obfuscation-aware, with severity, categories, and Unicode-safe offsets. No AI, no data stored.
创建时间:
2026-07-12
原始信息汇总
数据集概述:Profanity Filter and Moderation
API名称:Profanity Filter and Moderation
提供商:stay-e-live
类别:Text Analysis
定价:BASIC($5.00/月)、PRO($20.00/月)
流行度:8.2
服务等级:100%
延迟:353ms
核心功能
这是一个快速、确定性的文本审核引擎,基于规则运行,无需AI、无需数据库、不保留数据。其核心能力包括:
- 确定性 & 可审计:相同输入始终返回相同输出,无模型漂移或幻觉标记。
- 隐私优先:文本仅在内存中处理,不存储、不记录、不转发至第三方。
- 高速轻量:基于静态二进制文件和线性时间RE2匹配,毫秒级响应。
- 混淆检测:支持l33t语、插入空格/标点、符号替换、语音拼写(如
f*ck、sh1t、a$$)。 - Unicode精确偏移:返回基于零的代码点位置,兼容emoji和非拉丁字符。
检测内容
- 脏话
- 种族、民族、宗教、性取向、残疾相关的歧视性言论
- 露骨性语言
- 骚扰与直接威胁
- 整词边界匹配,避免误报(如 "assassin"、"class" 不会触发违规)
支持语言
英语、德语、西班牙语、法语、意大利语、葡萄牙语、荷兰语、波兰语、俄语、乌克兰语、土耳其语、阿拉伯语及常见印地语转写。
API端点
- POST /v1/moderate — 分析文本字符串,返回结构化决策结果,包括:
is_clean(是否干净)severity(整体严重程度)categories(匹配类别)detected_terms(检测到的具体违规词及其位置、类别、严重程度、是否混淆、语言)censored_text(审查后的文本)
- GET /health — 服务健康检查。
示例
请求:{"text": "What the f*ck?"}
响应:
json
{
"is_clean": false,
"severity": "moderate",
"categories": ["profanity"],
"detected_terms": [
{ "term": "f*ck", "start": 9, "end": 13, "category": "profanity", "severity": "moderate", "obfuscated": true, "language": "en" }
],
"censored_text": "What the ****?"
}
适用场景
- 用户生成内容过滤
- 聊天与评论审核
- 用户名和显示名称检查
- 表单验证
- 将文本发送至用户或LLM前的预筛查




