pufanyi/DiffVoice
收藏资源简介:
--- license: cc0-1.0 dataset_info: features: - name: id dtype: int32 - name: meanfreq dtype: float32 - name: sd dtype: float32 - name: median dtype: float32 - name: Q25 dtype: float32 - name: Q75 dtype: float32 - name: IQR dtype: float32 - name: skew dtype: float32 - name: kurt dtype: float32 - name: sp.ent dtype: float32 - name: sfm dtype: float32 - name: mode dtype: float32 - name: centroid dtype: float32 - name: meanfun dtype: float32 - name: minfun dtype: float32 - name: maxfun dtype: float32 - name: meandom dtype: float32 - name: mindom dtype: float32 - name: maxdom dtype: float32 - name: dfrange dtype: float32 - name: modindx dtype: float32 - name: age dtype: string - name: gender dtype: string - name: accent dtype: string splits: - name: train num_bytes: 1345201 num_examples: 12135 - name: validation num_bytes: 748157 num_examples: 7013 - name: test num_bytes: 741413 num_examples: 7014 download_size: 3086869 dataset_size: 2834771 configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* --- This dataset is created for the project of [*NTU MH3511 Data Analysis with Computer*](https://www.ntu.edu.sg/docs/librariesprovider123/obtl/mas/updated-obtl/mh3511-spms-mas-outcomes-based-teaching-and-learning-document-(obtl)-8th-dec-2021.pdf?sfvrsn=3d0ca932_3). The original dataset is from [Common Voice](https://commonvoice.mozilla.org/en).
数据集概述
数据集特征
- id: 整数类型 (int32)
- meanfreq: 浮点类型 (float32)
- sd: 浮点类型 (float32)
- median: 浮点类型 (float32)
- Q25: 浮点类型 (float32)
- Q75: 浮点类型 (float32)
- IQR: 浮点类型 (float32)
- skew: 浮点类型 (float32)
- kurt: 浮点类型 (float32)
- sp.ent: 浮点类型 (float32)
- sfm: 浮点类型 (float32)
- mode: 浮点类型 (float32)
- centroid: 浮点类型 (float32)
- meanfun: 浮点类型 (float32)
- minfun: 浮点类型 (float32)
- maxfun: 浮点类型 (float32)
- meandom: 浮点类型 (float32)
- mindom: 浮点类型 (float32)
- maxdom: 浮点类型 (float32)
- dfrange: 浮点类型 (float32)
- modindx: 浮点类型 (float32)
- age: 字符串类型 (string)
- gender: 字符串类型 (string)
- accent: 字符串类型 (string)
数据集分割
- 训练集: 12135个样本,占用1345201字节
- 验证集: 7013个样本,占用748157字节
- 测试集: 7014个样本,占用741413字节
数据集大小
- 下载大小: 3086869字节
- 数据集大小: 2834771字节
配置
- 默认配置:
- 训练数据路径:
data/train-* - 验证数据路径:
data/validation-* - 测试数据路径:
data/test-*
- 训练数据路径:



