suleiman2003/waxalnlp-hau-tts-chunked2
收藏资源简介:
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: text dtype: string - name: speaker_id dtype: string - name: gender dtype: string splits: - name: train num_bytes: 842874379 num_examples: 5507 - name: validation num_bytes: 104728639 num_examples: 660 - name: test num_bytes: 115875717 num_examples: 774 download_size: 1073087139 dataset_size: 1063478735 configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* ---
数据集信息: 特征项: - 名称:音频(audio),数据类型为音频,采样率(sampling_rate)为16000 - 名称:文本(text),数据类型为字符串 - 名称:说话人ID(speaker_id),数据类型为字符串 - 名称:性别(gender),数据类型为字符串 数据集拆分: - 拆分名称:训练集(train),字节占用量:842874379,样本总数:5507 - 拆分名称:验证集(validation),字节占用量:104728639,样本总数:660 - 拆分名称:测试集(test),字节占用量:115875717,样本总数:774 下载总大小:1073087139 字节 数据集总占用大小:1063478735 字节 配置项: - 配置名称:默认配置(default),数据文件对应关系: - 训练集(train):路径为 data/train-* - 验证集(validation):路径为 data/validation-* - 测试集(test):路径为 data/test-*



