averageandyyy/part_1_imda_30000
收藏资源简介:
--- dataset_info: features: - name: transcript dtype: string - name: path dtype: string - name: waveform sequence: float64 splits: - name: train num_bytes: 20108404239.03722 num_examples: 30000 download_size: 4854168355 dataset_size: 20108404239.03722 --- # Dataset Card for "part_1_imda_30000" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征字段: - 字段名:transcript(转录文本),数据类型:字符串(string) - 字段名:path(文件路径),数据类型:字符串(string) - 字段名:waveform(波形数据),数据类型:64位浮点数序列(sequence,float64) 数据划分: - 划分名称:train(训练集),字节数:20108404239.03722,样本数量:30000 下载大小:4854168355 数据集总大小:20108404239.03722 # "part_1_imda_30000" 数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
- 名称: part_1_imda_30000
数据集特征
- 特征1: transcript
- 数据类型: string
- 特征2: path
- 数据类型: string
- 特征3: waveform
- 数据类型: float64
- 属性: sequence
数据集分割
- 分割名称: train
- 示例数量: 30000
- 字节大小: 20108404239.03722
数据集大小
- 下载大小: 4854168355
- 总大小: 20108404239.03722



