官方服务:
资源简介:
Dataset of Korean language reading
应用场景:
创建时间:
2023-11-10
相关数据集
Emo-Emilia
Emo-Emilia是一个新的语音情感识别测试集,用于更好地模拟真实世界的环境。它通过自动化标注方法对Emilia进行标注,Emilia是一个大规模的多语言和多样化的语音生成资源,包含超过100,000小时的语音数据,涵盖广泛的情感语境。每个语句至少由两名专家进行验证,以确保情感标签的准确性和可靠性。最终提出的测试集Emo-Emilia包含1400个测试样本,涵盖七种情感类别(愤怒、快乐、恐惧、惊
github2025-03-03 更新1090
CodecSR/fluent_speech_commands_male
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: id dtype: string - name: gender dtype: string splits: - name: original nu
Hugging Face2024-04-25 更新250
kuanhuggingface/promptTTS_encodec_v2_small
--- dataset_info: features: - name: file_id dtype: string - name: instruction dtype: string - name: transcription dtype: string - name: src_encodec_0 sequence: int64 - name
Hugging Face2023-06-12 更新130
MLC-SLM
MLC-SLM数据集是一个包含约1604小时多语言对话语音数据的真实世界数据集,包含11种语言,包括英语、法语、德语、意大利语、葡萄牙语、西班牙语、日语、韩语、俄语、泰语和越南语。数据集分为训练集、开发集、评估集1和评估集2,每个集合包含大约1507小时、32小时、32小时和32小时的语音数据。数据集旨在用于构建多语言对话语音语言模型,解决语言多样性、说话者变化和上下文挑战。数据集的创建过程包括录
arXiv2025-09-17 更新870
Codec-SUPERB/ljspeech_extract_unit
--- configs: - config_name: default data_files: - split: academicodec_hifi_16k_320d path: data/academicodec_hifi_16k_320d-* - split: academicodec_hifi_16k_320d_large_uni path: data/acade
Hugging Face2023-12-28 更新130



