Indic-total-New-TTS-Merge-dnsmos
收藏资源简介:
该数据集包含多种语言(阿萨姆语、孟加拉语、英语、古吉拉特语、印地语、卡纳达语、马拉雅拉姆语、马拉地语、尼泊尔语)的语音质量评估数据。每个语言配置包含训练集,数据特征包括行索引(row_idx)和三个DNSMOS评分(DNSMOS_OVRL、DNSMOS_SIG、DNSMOS_BAK),分别代表整体语音质量、信号质量和背景噪声质量。数据集规模从英语的22,367个样本到孟加拉语的80,358个样本不等,总数据量在438KB到2.5MB之间。适用于语音质量评估、语音增强算法开发等任务。
This dataset contains speech quality assessment data in multiple languages, namely Assamese, Bengali, English, Gujarati, Hindi, Kannada, Malayalam, Marathi, and Nepali. Each language subset includes a training set, with data features comprising the row index (row_idx) and three DNSMOS scores: DNSMOS_OVRL, DNSMOS_SIG, and DNSMOS_BAK, which respectively represent overall speech quality, signal quality, and background noise quality. The sample size of each language subset ranges from 22,367 for English to 80,358 for Bengali, and the total data volume of the entire dataset spans from 438 KB to 2.5 MB. It is applicable to tasks such as speech quality assessment and the development of speech enhancement algorithms.
数据集概述
基本信息
- 数据集名称: Indic-total-New-TTS-Merge-dnsmos
- 托管地址: https://huggingface.co/datasets/RidheshBhati/Indic-total-New-TTS-Merge-dnsmos
数据集结构
本数据集包含9个独立的配置,每个配置对应一种语言。所有配置均仅包含一个训练集分割。
配置详情
1. 阿萨姆语 (assamese)
- 样本数量: 48,298
- 数据集大小: 1,545,536 字节
- 下载大小: 1,702,417 字节
2. 孟加拉语 (bengali)
- 样本数量: 80,358
- 数据集大小: 2,571,456 字节
- 下载大小: 2,865,658 字节
3. 英语 (english)
- 样本数量: 22,367
- 数据集大小: 715,744 字节
- 下载大小: 794,959 字节
4. 古吉拉特语 (gujarati)
- 样本数量: 13,703
- 数据集大小: 438,496 字节
- 下载大小: 472,195 字节
5. 印地语 (hindi)
- 样本数量: 31,627
- 数据集大小: 1,012,064 字节
- 下载大小: 1,107,650 字节
6. 卡纳达语 (kannada)
- 样本数量: 28,110
- 数据集大小: 899,520 字节
- 下载大小: 995,380 字节
7. 马拉雅拉姆语 (malayalam)
- 样本数量: 43,426
- 数据集大小: 1,389,632 字节
- 下载大小: 1,489,512 字节
8. 马拉地语 (marathi)
- 样本数量: 41,702
- 数据集大小: 1,334,464 字节
- 下载大小: 1,256,031 字节
9. 尼泊尔语 (nepali)
- 样本数量: 37,368
- 数据集大小: 1,195,776 字节
- 下载大小: 1,324,974 字节
数据特征
所有配置均包含以下4个特征:
- row_idx: 数据类型为 int64。
- DNSMOS_OVRL: 数据类型为 float64。
- DNSMOS_SIG: 数据类型为 float64。
- DNSMOS_BAK: 数据类型为 float64。
数据文件路径
每个配置的数据文件路径模式如下:
{语言名称}/train-*



