equal-ai/conversational-hindi-large
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: valid path: data/valid-* dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: text dtype: string - name: normalized dtype: string - name: unsanitized_verbatim dtype: string - name: unsanitized_normalized dtype: string splits: - name: train num_bytes: 40057912984 num_examples: 383004 - name: valid num_bytes: 420723806 num_examples: 4740 download_size: 40286918872 dataset_size: 40478636790 ---
配置项: - 配置名称:default 数据文件: - 划分集:训练集(train) 路径:data/train-* - 划分集:验证集(valid) 路径:data/valid-* 数据集信息: 特征字段: - 名称:音频(audio) 数据类型: 音频: 采样率:16000 - 名称:文本(text) 数据类型:字符串(string) - 名称:归一化文本(normalized) 数据类型:字符串(string) - 名称:未清理逐字转录文本(unsanitized_verbatim) 数据类型:字符串(string) - 名称:未清理归一化文本(unsanitized_normalized) 数据类型:字符串(string) 划分集详情: - 名称:训练集(train) 字节数:40057912984 样本数:383004 - 名称:验证集(valid) 字节数:420723806 样本数:4740 下载总大小:40286918872 数据集总大小:40478636790



