官方服务:
资源简介:
16 Audio speech recordings SGA0028-2019
应用场景:
创建时间:
2022-12-06
相关数据集
DNASpeech
DNASpeech是一个新颖的文本到语音数据集,包含高质量的演讲和DNA提示注释(对话上下文、叙事和动作状态)。该数据集包含2,395个不同角色、4,4529个场景和22,975个对话话语,以及超过18小时的高质量语音录音,为文本到语音任务提供了更详细的描述。
github2024-06-08 更新440
theodorr/librispeech_asr_encodec
该数据集包含多个字段,包括文件路径、音频数据、文本、说话者ID、章节ID和唯一ID。音频数据的采样率为24000Hz。数据集被分为多个分割,如train.clean.100、train.clean.360、train.other.500等,每个分割都有相应的字节大小和样本数量。数据集的下载大小为61838030296字节,总大小为63779756983.662字节。
Hugging Face2024-07-07 更新220
smcproject/MSC
SMC Malayalam Speech Corpus数据集是一个用于自动语音识别系统开发以及说话者性别和年龄识别的语音数据集。该数据集包含1541个语音样本,由75位语音贡献者提供,总时长为1小时38分钟16秒。数据集包含482个独特的句子、1400个独特的单词、553个独特的音节和48个独特的音素。语音数据是通过一个网页应用收集的,志愿者使用个人设备录制语音,并由其他用户进行评分。数据集的语言
Hugging Face2023-11-21 更新200
hf-audio/esb-datasets-test-only
ESB数据集是一个用于自动语音识别(ASR)任务的多数据集集合,包含LibriSpeech、Common Voice、VoxPopuli等多个子数据集。这些数据集涵盖了不同的领域和说话风格,如有声读物、维基百科、欧洲议会演讲等。每个数据集都提供了详细的训练、验证和测试集,以及相应的转录文本。数据集的使用需要通过Hugging Face Datasets库进行加载和准备,且部分数据集需要特定的使用协
Hugging Face2023-08-29 更新230
HiTZ/composite_corpus_es_v1.0
这是一个由多个公开西班牙语数据集组成的复合数据集,包括Common Voice、OpenSLR、Multilingual Librispeech、VoxPopuli和Basque Parliament的数据。数据集分为训练集、测试集和验证集,每个集合都经过清理和平衡处理,以用于不同的开发任务。
Hugging Face2025-05-12 更新220



