相关数据集
D653_Uyghur_Pronunciation_Dictionary
维语发音词典收集194,999条维语词汇及发音,发音精准。该词典可用于为录音人员提供发音参考、发音识别技术的研发等。
Opencsg2026-03-04 更新200
Lkhagvasurenam/common_voice_little_test
该数据集包含多个特征,如client_id、path、audio、sentence等,并且这些特征的数据类型也被详细列出。数据集分为训练集和测试集,分别包含2275和1877个样本。此外,还提供了数据集的总下载大小和数据集大小。
Hugging Face2023-12-19 更新140
Chvntala/bembaspeech
该数据集包含音频数据和对应的文本句子,主要用于音频与文本的关联任务。数据集仅包含一个训练集,共有12421个样本,总大小为2458890204.774字节。下载大小为2390558125字节。数据文件路径为data/train-*。
Hugging Face2024-07-08 更新120
PeacefulData/Robust-HyPoradise
Robust HyPoradise数据集是一个用于生成式错误校正和大语言模型研究的数据集,特别关注噪声鲁棒的语音识别。该数据集包含训练数据和测试数据,格式相同。由于语音特征文件较大,训练数据中未包含语音特征,但提供了脚本用于从原始语音文件(.wav)生成这些特征。数据集支持用户从自己的ASR数据集中生成训练和测试数据,并提供了必要的脚本和包。数据集的相关研究已在ICLR 2024会议上发表。
Hugging Face2024-05-17 更新150
ViSpeak-Instruct
数据集文件元信息以及数据文件,请浏览“数据集文件”页面获取。 当前数据集卡片使用的是默认模版,数据集的贡献者未提供更加详细的数据集介绍,但是您可以通过如下GIT Clone命令,或者ModelScope SDK来下载数据集 #### 下载方法 :modelscope-code[]{type="sdk"} :modelscope-code[]{type="git"}
魔搭社区2026-04-28 更新130



