srija616/IV-R
收藏资源简介:
--- license: cc-by-4.0 dataset_info: features: - name: text dtype: string - name: lang dtype: string - name: samples dtype: int64 - name: verbatim dtype: string - name: normalized dtype: string - name: speaker_id dtype: string - name: scenario dtype: string - name: task_name dtype: string - name: gender dtype: string - name: age_group dtype: string - name: job_type dtype: string - name: qualification dtype: string - name: area dtype: string - name: district dtype: string - name: state dtype: string - name: occupation dtype: string - name: audio dtype: audio: sampling_rate: 48000 - name: utterance_pitch_mean dtype: float64 - name: utterance_pitch_std dtype: float64 - name: snr dtype: float64 - name: c50 dtype: float64 - name: speaking_rate dtype: float64 - name: cer dtype: string - name: duration dtype: float64 splits: - name: train num_bytes: 47656325970.611 num_examples: 27153 - name: validation num_bytes: 995277556.0 num_examples: 569 - name: test num_bytes: 995277556.0 num_examples: 569 download_size: 49849931596 dataset_size: 49646881082.611 configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* ---
许可证:CC BY 4.0 数据集信息: 特征: - 名称:文本(text),数据类型:字符串(string) - 名称:语言(lang),数据类型:字符串(string) - 名称:样本数(samples),数据类型:整型(int64) - 名称:原始文本(verbatim),数据类型:字符串(string) - 名称:归一化文本(normalized),数据类型:字符串(string) - 名称:说话人ID(speaker_id),数据类型:字符串(string) - 名称:场景(scenario),数据类型:字符串(string) - 名称:任务名称(task_name),数据类型:字符串(string) - 名称:性别(gender),数据类型:字符串(string) - 名称:年龄组(age_group),数据类型:字符串(string) - 名称:职业类型(job_type),数据类型:字符串(string) - 名称:学历资质(qualification),数据类型:字符串(string) - 名称:区域(area),数据类型:字符串(string) - 名称:县区(district),数据类型:字符串(string) - 名称:州/省(state),数据类型:字符串(string) - 名称:职业(occupation),数据类型:字符串(string) - 名称:音频(audio),数据类型: 音频元数据: 采样率:48000 Hz - 名称:语句基频均值(utterance_pitch_mean),数据类型:浮点型(float64) - 名称:语句基频标准差(utterance_pitch_std),数据类型:浮点型(float64) - 名称:信噪比(snr),数据类型:浮点型(float64) - 名称:C50指标(c50),数据类型:浮点型(float64) - 名称:语速(speaking_rate),数据类型:浮点型(float64) - 名称:字符错误率(cer),数据类型:字符串(string) - 名称:时长(duration),数据类型:浮点型(float64) 数据集划分: - 划分名称:训练集(train),字节占用量:47656325970.611,样本数量:27153 - 划分名称:验证集(validation),字节占用量:995277556.0,样本数量:569 - 划分名称:测试集(test),字节占用量:995277556.0,样本数量:569 下载总大小:49849931596 字节 数据集总存储大小:49646881082.611 字节 数据集配置: - 配置名称:默认配置(default) 数据文件: - 划分:训练集(train),路径:data/train-* - 划分:验证集(validation),路径:data/validation-* - 划分:测试集(test),路径:data/test-*



