nonverbal_vocalization_VC
收藏资源简介:
该数据集包含音频数据及其对应的原始标签和新标签,适用于语音处理和分类任务。数据集包含369个训练样本,每个样本包含原始音频(采样率24000Hz)、转换后的音频(采样率24000Hz)、原始标签文本和新标签文本。总下载大小约为74.96MB,解压后数据集大小约为82.42MB。数据以单一训练集形式提供,未包含验证或测试集。
This dataset comprises audio data alongside its corresponding original and new labels, tailored for speech processing and classification tasks. It includes 369 training samples, with each sample containing raw audio (sampling rate: 24000 Hz), transformed audio (sampling rate: 24000 Hz), original label text, and new label text. The total download size of the dataset is approximately 74.96 MB, and its unzipped size is roughly 82.42 MB. The dataset is provided solely as a training set, with no validation or test sets included.
根据您提供的数据集详情页面地址和README文件内容,以下是该数据集的概述:
数据集名称
nadsoft/nonverbal_vocalization_VC
数据集描述
该数据集专注于非语言发声(nonverbal vocalization)的语音转换(Voice Conversion,VC)任务。
数据集特征
数据集包含以下特征:
- audio: 音频数据,采样率为24000 Hz。
- original_label: 原始标签,类型为字符串(string)。
- new_label: 新标签,类型为字符串(string)。
- converted_audio: 转换后的音频数据,采样率为24000 Hz。
数据集划分
数据集仅包含一个划分:
- train: 训练集,包含369个样本,总字节数为82,423,348。
数据集大小
- 下载大小: 74,963,999 字节
- 数据集总大小: 82,423,348 字节
配置文件
数据集有1个默认配置:
- config_name:
default - 数据文件路径:
data/train-*




