遇见数据集

Language Detection API: 30 Languages, No AI Cost

收藏
RapidAPI2026-09-09 更新2026-09-10 收录
官方服务:

资源简介:

Detects the language of a text among 30 common languages using a script and stopword-frequency heuristic — zero AI/neuron usage, so it never hits an AI quota.

创建时间:
2026-09-09
原始信息汇总

数据集概述:语言检测API(30种语言,无AI成本)

该API由 AUtomator labs 开发,属于 文本分析 类别,提供无需AI模型调用的纯启发式语言检测服务。


核心功能

  • 支持30种常见语言:包括日语、中文、韩语、阿拉伯语、印地语、希腊语、希伯来语、泰语、俄语、乌克兰语、保加利亚语、英语、西班牙语、法语、德语、意大利语、葡萄牙语、荷兰语、瑞典语、挪威语、丹麦语、芬兰语、捷克语、罗马尼亚语、匈牙利语、波兰语、土耳其语、印尼语、越南语、斯瓦希里语。
  • 检测机制:基于Unicode文字系统识别(如中文、日文、韩文等)与常用词频匹配(对于共享拉丁或西里尔文字的语言),完全不调用AI或神经元,无AI配额限制和消耗
  • 输出结果:每个请求返回 language(语言)、confidence(0-1置信度)和 alternatives(最多3个备选语言及对应置信度)。

端点与用法

端点 方法 描述
/detect POST 接收JSON格式的 { text },返回语言检测结果
/detect?text= GET 通过查询参数直接检测文本,方便快速测试

示例(GET请求): /detect?text=All+human+beings+are+born+free+and+equal+in+dignity+and+rights.

返回: json {"language":"en","confidence":0.81,"alternatives":[{"language":"it","confidence":0.14}]}


使用场景

  • 按语言路由支持工单
  • 为多语言内容打标签
  • 在翻译前对文本进行预过滤
  • 多语言数据的分析

订阅计划

  • BASIC:$0.00/月(免费),包含300次/月的请求,并可使用 POST /detect 接口。
  • PRO:$15.00/月
  • ULTRA:$49.00/月
  • 注意:所有订阅计划(包括付费计划)在发布初期均设有 硬性请求限制,待生产环境中实际AI神经元消耗量确定后会放宽限制。

性能与范围说明

  • 该API是 脚本+停用词频率启发式方法,并非训练过的语言识别模型。
  • 对段落级连续文本的检测最可靠。
  • 8种语言(中文、日文、韩文、阿拉伯文、印地文、希腊文、希伯来文、泰文)仅靠独特的Unicode文字系统识别;其余22种(拉丁和西里尔文字语言)依靠常用功能词频率区分。
  • 对于极短片段、代码或非30种语言的文本,会返回低置信度结果,而非错误的确定性答案。
  • 无AI降级机制:低置信度即为最终结果,不会用其他信号重新检测。
  • 该端点本身不调用Workers AI,因此不会消耗共享AI预算,也不会触发 DAILY_AI_LIMIT

错误处理

API以JSON格式返回错误,包含 errormessage 字段,主要错误码如下:

错误代码 状态码 触发条件
MISSING_TEXT 400 text 字段缺失或为空
TEXT_TOO_LONG 413 文本超过5000字符
UNSUPPORTED_LANGUAGE 400 未知的源/目标语言代码
BATCH_TOO_LARGE 413 超过20个条目或组合字符超过20000
DAILY_AI_LIMIT 429 共享免费层AI每日预算耗尽(缓存结果仍会返回)
AI_RESPONSE_ERROR 502
INVALID_JSON / BODY_TOO_LARGE 400/413
METHOD_NOT_ALLOWED 405
QUERY_TOO_LONG 414

其他信息

  • API创建者:AUtomator labs
  • 订阅者数量:1
  • 资源:提供产品网站
  • 该API用于与翻译API配合使用:当翻译请求未指定 source 时,内部自动调用此检测器来确定源语言。
二维码
社区交流群
二维码
科研交流群
商业服务