quocanh34/soict_train_synthesis_dataset_v2
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: audio struct: - name: array sequence: float64 - name: path dtype: string - name: sampling_rate dtype: int64 - name: sentence_norm dtype: string - name: id dtype: string splits: - name: train num_bytes: 4941296103 num_examples: 9807 - name: test num_bytes: 389967953 num_examples: 748 download_size: 1260225691 dataset_size: 5331264056 --- # Dataset Card for "soict_train_synthesis_dataset_v2" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 配置项: - 配置名称:默认配置 数据文件: - 数据子集:训练集 路径:data/train-* - 数据子集:测试集 路径:data/test-* 数据集信息: 特征字段: - 字段名:音频(audio) 结构体: - 子字段:数组 序列类型:float64 - 子字段:路径 数据类型:字符串 - 子字段:采样率(sampling_rate) 数据类型:int64 - 字段名:归一化语句(sentence_norm) 数据类型:字符串 - 字段名:编号(id) 数据类型:字符串 数据拆分: - 子集名称:训练集 字节大小:4941296103 样本数量:9807 - 子集名称:测试集 字节大小:389967953 样本数量:748 下载总大小:1260225691 数据集总大小:5331264056 --- # 「soict_train_synthesis_dataset_v2」数据集卡片 [需补充更多数据集卡片相关信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集卡片 "soict_train_synthesis_dataset_v2"
配置
- 默认配置
- 数据文件
- 训练集
- 路径:
data/train-*
- 路径:
- 测试集
- 路径:
data/test-*
- 路径:
- 训练集
- 数据文件
数据集信息
-
特征
- 音频
- 数组
- 序列:
float64
- 序列:
- 路径
- 数据类型:
string
- 数据类型:
- 采样率
- 数据类型:
int64
- 数据类型:
- 数组
- 句子归一化
- 数据类型:
string
- 数据类型:
- ID
- 数据类型:
string
- 数据类型:
- 音频
-
拆分
- 训练集
- 字节数: 4941296103
- 样本数: 9807
- 测试集
- 字节数: 389967953
- 样本数: 748
- 训练集
-
下载大小: 1260225691
-
数据集大小: 5331264056




