相关数据集
TTS-SCFEmoSC: A Scripted Chinese Female Emotion Speech Corpus
This dataset consists of 40 hours of annotated female voices in Mandarin Chinese that is applicable for Text-to-Speech Synthesis, where 21,342 utterances collected from a 22-year-old woman were contai
MagicHub开源社区2021-11-04 更新400
laion/voices-with-captions
合成语音描述数据集包含3180个合成的语音样本,每个样本都配有一个简短的描述,描述内容大致包括声音的年龄、性别、口音以及一些语音的一般特征(例如“老妇人,爱尔兰口音”)。所有语音均为合成生成,不代表任何真实个人,适合用于训练和评估语音转换模型,而不会侵犯个人身份或权利。
Hugging Face2025-03-21 更新220
SPRINGLab/IndicTTS_Manipuri
Manipuri Indic TTS数据集是从Indic TTS数据库中提取的,专门使用了男女两位Manipuri母语者的单语录音。该数据集包含高质量的语音录音及其对应的文本转录,适用于文本到语音(TTS)的研究和开发。
Hugging Face2025-06-26 更新80
filipinospeechcorpus
菲律宾语音语料库(Filipino Speech Corpus, FSC)是一个用于自动语音识别(ASR)和文本转语音(TTS)任务的句子级语音数据集。该数据集以Hugging Face Parquet格式存储,包含16kHz单声道音频片段。数据集总大小约为6GB,由139个分片组成。每个样本包含音频文件、对应的文本转录、音频时长、单词数量、说话者ID、性别、年龄组、语音类型(朗读/自发/机器生成
Hugging Face2026-03-22 更新240
azerbaijani-tts-dataset-audio
Azerbaijani TTS 数据集是一个用于文本到语音(TTS)和自动语音识别(ASR)任务的阿塞拜疆语数据集。该数据集包含阿塞拜疆语的音频样本及其对应的转录文本。数据集采用 MIT 许可证发布,可通过 HuggingFace 的 datasets 库加载使用。
Hugging Face2026-02-09 更新140



