遇见数据集

krishnAbadikelA/pair_tamil_malayalam_ipa_transcription

收藏
Hugging Face2025-10-16 更新2025-10-25 收录
官方服务:

资源简介:

该数据集包含了文本、语言和音素三种类型的数据,分为训练集和验证集两个部分。训练集包含约8846954个示例,大小为约106.46GB,而验证集包含4426个示例,大小为约52.80MB。

The dataset includes data of three types: text, language, and phonemes, split into two parts: training set and validation set. The training set contains approximately 8,846,954 examples, with a size of about 106.46GB, while the validation set contains 4,426 examples, with a size of about 52.80MB.

提供机构:
krishnAbadikelA
二维码
社区交流群
二维码
科研交流群
商业服务