Language Detection API: 30 Languages, No AI Cost
收藏数据链接:
官方服务:
资源简介:
Detects the language of a text among 30 common languages using a script and stopword-frequency heuristic — zero AI/neuron usage, so it never hits an AI quota.
创建时间:
2026-09-09
原始信息汇总
数据集概述:语言检测API(30种语言,无AI成本)
该API由 AUtomator labs 开发,属于 文本分析 类别,提供无需AI模型调用的纯启发式语言检测服务。
核心功能
- 支持30种常见语言:包括日语、中文、韩语、阿拉伯语、印地语、希腊语、希伯来语、泰语、俄语、乌克兰语、保加利亚语、英语、西班牙语、法语、德语、意大利语、葡萄牙语、荷兰语、瑞典语、挪威语、丹麦语、芬兰语、捷克语、罗马尼亚语、匈牙利语、波兰语、土耳其语、印尼语、越南语、斯瓦希里语。
- 检测机制:基于Unicode文字系统识别(如中文、日文、韩文等)与常用词频匹配(对于共享拉丁或西里尔文字的语言),完全不调用AI或神经元,无AI配额限制和消耗。
- 输出结果:每个请求返回
language(语言)、confidence(0-1置信度)和alternatives(最多3个备选语言及对应置信度)。
端点与用法
| 端点 | 方法 | 描述 |
|---|---|---|
/detect |
POST | 接收JSON格式的 { text },返回语言检测结果 |
/detect?text= |
GET | 通过查询参数直接检测文本,方便快速测试 |
示例(GET请求):
/detect?text=All+human+beings+are+born+free+and+equal+in+dignity+and+rights.
返回: json {"language":"en","confidence":0.81,"alternatives":[{"language":"it","confidence":0.14}]}
使用场景
- 按语言路由支持工单
- 为多语言内容打标签
- 在翻译前对文本进行预过滤
- 多语言数据的分析
订阅计划
- BASIC:$0.00/月(免费),包含300次/月的请求,并可使用
POST /detect接口。 - PRO:$15.00/月
- ULTRA:$49.00/月
- 注意:所有订阅计划(包括付费计划)在发布初期均设有 硬性请求限制,待生产环境中实际AI神经元消耗量确定后会放宽限制。
性能与范围说明
- 该API是 脚本+停用词频率启发式方法,并非训练过的语言识别模型。
- 对段落级连续文本的检测最可靠。
- 8种语言(中文、日文、韩文、阿拉伯文、印地文、希腊文、希伯来文、泰文)仅靠独特的Unicode文字系统识别;其余22种(拉丁和西里尔文字语言)依靠常用功能词频率区分。
- 对于极短片段、代码或非30种语言的文本,会返回低置信度结果,而非错误的确定性答案。
- 无AI降级机制:低置信度即为最终结果,不会用其他信号重新检测。
- 该端点本身不调用Workers AI,因此不会消耗共享AI预算,也不会触发
DAILY_AI_LIMIT。
错误处理
API以JSON格式返回错误,包含 error 和 message 字段,主要错误码如下:
| 错误代码 | 状态码 | 触发条件 |
|---|---|---|
MISSING_TEXT |
400 | text 字段缺失或为空 |
TEXT_TOO_LONG |
413 | 文本超过5000字符 |
UNSUPPORTED_LANGUAGE |
400 | 未知的源/目标语言代码 |
BATCH_TOO_LARGE |
413 | 超过20个条目或组合字符超过20000 |
DAILY_AI_LIMIT |
429 | 共享免费层AI每日预算耗尽(缓存结果仍会返回) |
AI_RESPONSE_ERROR |
502 | — |
INVALID_JSON / BODY_TOO_LARGE |
400/413 | — |
METHOD_NOT_ALLOWED |
405 | — |
QUERY_TOO_LONG |
414 | — |
其他信息
- API创建者:AUtomator labs
- 订阅者数量:1
- 资源:提供产品网站
- 该API用于与翻译API配合使用:当翻译请求未指定
source时,内部自动调用此检测器来确定源语言。



