hhhaaahhhaa/text-guided-vc-google-tts-api-v0
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* dataset_info: features: - name: file_id dtype: string - name: instruction dtype: string - name: transcription dtype: string - name: src_encodec_0 sequence: int64 - name: src_encodec_1 sequence: int64 - name: src_encodec_2 sequence: int64 - name: src_encodec_3 sequence: int64 - name: src_encodec_4 sequence: int64 - name: src_encodec_5 sequence: int64 - name: src_encodec_6 sequence: int64 - name: src_encodec_7 sequence: int64 - name: tgt_encodec_0 sequence: int64 - name: tgt_encodec_1 sequence: int64 - name: tgt_encodec_2 sequence: int64 - name: tgt_encodec_3 sequence: int64 - name: tgt_encodec_4 sequence: int64 - name: tgt_encodec_5 sequence: int64 - name: tgt_encodec_6 sequence: int64 - name: tgt_encodec_7 sequence: int64 splits: - name: train num_bytes: 3704687470 num_examples: 90000 - name: validation num_bytes: 203094306 num_examples: 5000 - name: test num_bytes: 209112202 num_examples: 5000 download_size: 140841385 dataset_size: 4116893978 --- # Dataset Card for "text-guided-vc-google-tts-api" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集配置
- 默认配置:
- 训练集:路径为
data/train-* - 验证集:路径为
data/validation-* - 测试集:路径为
data/test-*
- 训练集:路径为
数据集特征
- 特征列表:
file_id:类型为字符串instruction:类型为字符串transcription:类型为字符串src_encodec_0:类型为整数序列src_encodec_1:类型为整数序列src_encodec_2:类型为整数序列src_encodec_3:类型为整数序列src_encodec_4:类型为整数序列src_encodec_5:类型为整数序列src_encodec_6:类型为整数序列src_encodec_7:类型为整数序列tgt_encodec_0:类型为整数序列tgt_encodec_1:类型为整数序列tgt_encodec_2:类型为整数序列tgt_encodec_3:类型为整数序列tgt_encodec_4:类型为整数序列tgt_encodec_5:类型为整数序列tgt_encodec_6:类型为整数序列tgt_encodec_7:类型为整数序列
数据集分割
- 训练集:
- 字节数:3704687470
- 样本数:90000
- 验证集:
- 字节数:203094306
- 样本数:5000
- 测试集:
- 字节数:209112202
- 样本数:5000
数据集大小
- 下载大小:140841385 字节
- 数据集大小:4116893978 字节



