遇见数据集

Profanity Filter and Moderation

收藏
RapidAPI2026-07-12 更新2026-07-13 收录
官方服务:

资源简介:

Detect and censor profanity, slurs, and toxic language across 13+ languages. Deterministic and obfuscation-aware, with severity, categories, and Unicode-safe offsets. No AI, no data stored.

创建时间:
2026-07-12
原始信息汇总

数据集概述:Profanity Filter and Moderation

API名称:Profanity Filter and Moderation
提供商:stay-e-live
类别:Text Analysis
定价:BASIC($5.00/月)、PRO($20.00/月)
流行度:8.2
服务等级:100%
延迟:353ms

核心功能

这是一个快速、确定性的文本审核引擎,基于规则运行,无需AI、无需数据库、不保留数据。其核心能力包括:

  • 确定性 & 可审计:相同输入始终返回相同输出,无模型漂移或幻觉标记。
  • 隐私优先:文本仅在内存中处理,不存储、不记录、不转发至第三方。
  • 高速轻量:基于静态二进制文件和线性时间RE2匹配,毫秒级响应。
  • 混淆检测:支持l33t语、插入空格/标点、符号替换、语音拼写(如 f*cksh1ta$$)。
  • Unicode精确偏移:返回基于零的代码点位置,兼容emoji和非拉丁字符。

检测内容

  • 脏话
  • 种族、民族、宗教、性取向、残疾相关的歧视性言论
  • 露骨性语言
  • 骚扰与直接威胁
  • 整词边界匹配,避免误报(如 "assassin"、"class" 不会触发违规)

支持语言

英语、德语、西班牙语、法语、意大利语、葡萄牙语、荷兰语、波兰语、俄语、乌克兰语、土耳其语、阿拉伯语及常见印地语转写。

API端点

  1. POST /v1/moderate — 分析文本字符串,返回结构化决策结果,包括:
    • is_clean(是否干净)
    • severity(整体严重程度)
    • categories(匹配类别)
    • detected_terms(检测到的具体违规词及其位置、类别、严重程度、是否混淆、语言)
    • censored_text(审查后的文本)
  2. GET /health — 服务健康检查。

示例

请求{"text": "What the f*ck?"}
响应: json { "is_clean": false, "severity": "moderate", "categories": ["profanity"], "detected_terms": [ { "term": "f*ck", "start": 9, "end": 13, "category": "profanity", "severity": "moderate", "obfuscated": true, "language": "en" } ], "censored_text": "What the ****?" }

适用场景

  • 用户生成内容过滤
  • 聊天与评论审核
  • 用户名和显示名称检查
  • 表单验证
  • 将文本发送至用户或LLM前的预筛查
二维码
社区交流群
二维码
科研交流群
商业服务