ilsp/aperathiot-speech-corpus
收藏资源简介:
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: raw_text dtype: string - name: normalized_text dtype: string - name: speaker_id dtype: string splits: - name: train num_bytes: 98882813.0 num_examples: 638 - name: validation num_bytes: 11472329.0 num_examples: 80 - name: test num_bytes: 11711103.0 num_examples: 80 download_size: 120433962 dataset_size: 122066245.0 configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* ---
数据集信息: 特征: - 名称:音频(audio),数据类型: 音频: 采样率:16000 - 名称:原始文本(raw_text),数据类型:字符串 - 名称:归一化文本(normalized_text),数据类型:字符串 - 名称:说话人ID(speaker_id),数据类型:字符串 数据集划分: - 名称:训练集(train),字节数:98882813.0,样本数量:638 - 名称:验证集(validation),字节数:11472329.0,样本数量:80 - 名称:测试集(test),字节数:11711103.0,样本数量:80 下载大小:120433962 总数据集大小:122066245.0 配置项: - 配置名称:默认(default),数据文件: - 划分:训练集,路径:data/train-* - 划分:验证集,路径:data/validation-* - 划分:测试集,路径:data/test-*



