相关数据集
En1gma02/processed_english_emotions
该数据集包含音频、文本、说话者ID、风格和ID等特征。数据集分为训练集,包含2905个样本,总大小为813330192.875字节。下载大小为783497413字节。数据集的配置为默认配置,数据文件路径为data/train-*。
Hugging Face2024-11-24 更新180
AIGenLab/Speech-and-Music
这是一个包含音频数据和对应标签的数据集,用于训练模型。数据集包含一个训练集,共有44901个示例,音频采样率为16000Hz。数据集的总大小为66786079860字节。
Hugging Face2025-11-12 更新130
TheHolyPacman/test_dataset_2_mod
该数据集主要用于语音识别和口音分析,包含文件名、口音类型、声音数组(其中声音数组是一个包含float64类型数据的序列)、输入值和标签。数据集分为训练集,共有419个示例,总数据大小为447549854字节,下载大小为375726911字节。训练数据文件路径为data/train-*。
Hugging Face2024-03-25 更新90
procit007/mozilla_commonVoice_Texts
该数据集包含两个主要特征:句子(sentence)和版本(version),均为字符串类型。数据集仅包含一个训练集(train),共有611,731个示例,总大小为43,216,559字节。数据集的下载大小为25,136,543字节。默认配置下的数据文件路径为data/train-*。
Hugging Face2024-12-10 更新150
uniiiii/Whisper-fine-tune-p-26
该数据集包含音频和对应的转录文本。音频的采样率为16000Hz,转录文本为字符串类型。数据集仅包含一个训练分割,共有87845个样本,总大小为6459605615.84字节,下载大小为5684807498字节。默认配置下的数据文件路径为data/train-*。
Hugging Face2024-05-17 更新100



