遇见数据集

fair-forward/evals-for-every-language-languages

收藏
Hugging Face2025-10-27 更新2025-11-01 收录
官方服务:

资源简介:

这是一个包含多种语言信息的数据集,其中包括语言代码、说话者数量、语言名称、语言自称、语系、文件路径、标签、Common Voice项目中的小时数、区域设置以及是否包含在基准测试中的信息。数据集分为训练集,可用于语言相关的机器学习任务。

This dataset contains various language information, including language code, number of speakers, language name, language self-identification, language family, file path, tags, hours in Common Voice project, locale settings, and whether it is included in the benchmark test. The dataset is split into a training set, which can be used for language-related machine learning tasks.

提供机构:
fair-forward
二维码
社区交流群
二维码
科研交流群
商业服务