thanhduycao/soict_train_dataset_all
收藏官方服务:
资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: id dtype: string - name: audio struct: - name: array sequence: float64 - name: path dtype: string - name: sampling_rate dtype: int64 - name: sentence_norm dtype: string - name: wer dtype: float64 splits: - name: train num_bytes: 4845993689.0 num_examples: 9498 - name: test num_bytes: 491716 num_examples: 1 download_size: 1887544391 dataset_size: 4846485405.0 --- # Dataset Card for "soict_train_dataset_all" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
提供机构:
thanhduycao原始信息汇总
数据集概述
数据集配置
- 默认配置 (
default)- 训练数据 (
train):路径为data/train-* - 测试数据 (
test):路径为data/test-*
- 训练数据 (
数据特征
id:类型为字符串 (string)audio:结构包含以下字段array:序列类型为浮点数 (float64)path:类型为字符串 (string)sampling_rate:类型为整数 (int64)
sentence_norm:类型为字符串 (string)wer:类型为浮点数 (float64)
数据分割
- 训练集 (
train)- 字节数:4845993689.0
- 样本数:9498
- 测试集 (
test)- 字节数:491716
- 样本数:1
数据集大小
- 下载大小:1887544391
- 数据集大小:4846485405.0



