官方服务:
资源简介:
Accent of various languages
多语言口音
应用场景:
创建时间:
2025-03-20
相关数据集
asierhv/composite_corpus_es_v1.0
这是一个西班牙语复合语料库,版本为1.0。语料库包含了音频数据、文本句子和每个句子的持续时间。提供了训练集、多种验证集变体以及多种测试集,用于不同的模型训练和评估。
Hugging Face2024-12-04 更新140
PharynxAI/merged_english_accent_dataset
--- dataset_info: features: - name: audio dtype: audio - name: 'Unnamed: 0' dtype: int64 - name: text dtype: string - name: speaker_id dtype: int64 - name: source dtype
Hugging Face2025-10-09 更新100
D657_Hours_Mandarin_Speech_by_Mobile_Phone
中国普通话语音数据_朗读(手机),基于给定的脚本朗读并模拟录制,由6278位分布于广东、福建、山东、江苏、北京、湖南等全国33省中国发音人参与录制。其中,男性2980人,女性3298人,录音内容为常用口语句子,录音环境包含安静环境和噪音环境,文本经过人工校对,准确率高,为语音识别相关研究及应用提供了丰富的资源,经多家AI公司验证:有助于模型面对真实世界的多样性时能够表现出色。我们严格遵循数据保护法
Opencsg2026-03-04 更新80
procit006/augmented_stc_saskia_latest_prioritize
这是一个包含音频数据和相应文本描述的数据集,其中包括用户信息和音频的相关属性。数据集分为训练集,可用于音频处理和语言理解等相关任务。
Hugging Face2025-04-07 更新100
seanghay/khmer-speech-large
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: sentence dtype: string splits: - name: train num_bytes: 5686102163.1 num_ex
Hugging Face2023-04-30 更新90



