遇见数据集

mikaberidze/lid200

收藏
Hugging Face2025-11-02 更新2025-10-25 收录
官方服务:

资源简介:

LID-200是一个包含200种以上语言的语言识别数据集,基于SIB-200构建,适用于训练和评估跨多种语言和脚本的语言识别系统。

LID-200 is a language identification dataset covering over 200 languages, built upon SIB-200, suitable for training and evaluating language identification systems across a variety of languages and scripts.

提供机构:
mikaberidze
二维码
社区交流群
二维码
科研交流群
商业服务