hhhaaahhhaa/text-guided-vc-google-tts-api
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* dataset_info: features: - name: file_id dtype: string - name: instruction dtype: string - name: transcription dtype: string - name: src_encodec_0 sequence: int64 - name: src_encodec_1 sequence: int64 - name: src_encodec_2 sequence: int64 - name: src_encodec_3 sequence: int64 - name: src_encodec_4 sequence: int64 - name: src_encodec_5 sequence: int64 - name: src_encodec_6 sequence: int64 - name: src_encodec_7 sequence: int64 - name: tgt_encodec_0 sequence: int64 - name: tgt_encodec_1 sequence: int64 - name: tgt_encodec_2 sequence: int64 - name: tgt_encodec_3 sequence: int64 - name: tgt_encodec_4 sequence: int64 - name: tgt_encodec_5 sequence: int64 - name: tgt_encodec_6 sequence: int64 - name: tgt_encodec_7 sequence: int64 splits: - name: train num_bytes: 3702179864 num_examples: 90000 - name: validation num_bytes: 202955396 num_examples: 5000 - name: test num_bytes: 208971751 num_examples: 5000 download_size: 139226240 dataset_size: 4114107011 --- # Dataset Card for "text-guided-vc-google-tts-api" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
配置项: - 配置名称:default 数据文件: - 数据集划分(split):训练集(train),路径:data/train-* - 数据集划分(split):验证集(validation),路径:data/validation-* - 数据集划分(split):测试集(test),路径:data/test-* 数据集元信息: 数据特征: - 字段名:文件标识符(file_id),数据类型:字符串(string) - 字段名:任务指令(instruction),数据类型:字符串(string) - 字段名:语音转录文本(transcription),数据类型:字符串(string) - 字段名:src_encodec_0,数据类型:int64类型序列 - 字段名:src_encodec_1,数据类型:int64类型序列 - 字段名:src_encodec_2,数据类型:int64类型序列 - 字段名:src_encodec_3,数据类型:int64类型序列 - 字段名:src_encodec_4,数据类型:int64类型序列 - 字段名:src_encodec_5,数据类型:int64类型序列 - 字段名:src_encodec_6,数据类型:int64类型序列 - 字段名:src_encodec_7,数据类型:int64类型序列 - 字段名:tgt_encodec_0,数据类型:int64类型序列 - 字段名:tgt_encodec_1,数据类型:int64类型序列 - 字段名:tgt_encodec_2,数据类型:int64类型序列 - 字段名:tgt_encodec_3,数据类型:int64类型序列 - 字段名:tgt_encodec_4,数据类型:int64类型序列 - 字段名:tgt_encodec_5,数据类型:int64类型序列 - 字段名:tgt_encodec_6,数据类型:int64类型序列 - 字段名:tgt_encodec_7,数据类型:int64类型序列 数据集划分详情: - 划分名称:训练集(train),字节占用量:3702179864,样本数量:90000 - 划分名称:验证集(validation),字节占用量:202955396,样本数量:5000 - 划分名称:测试集(test),字节占用量:208971751,样本数量:5000 下载总大小:139226240 数据集总占用大小:4114107011 --- # 「text-guided-vc-google-tts-api」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
配置
- 默认配置:
- 训练集路径:
data/train-* - 验证集路径:
data/validation-* - 测试集路径:
data/test-*
- 训练集路径:
数据特征
- 特征列表:
file_id:字符串类型instruction:字符串类型transcription:字符串类型src_encodec_0:整数序列类型src_encodec_1:整数序列类型src_encodec_2:整数序列类型src_encodec_3:整数序列类型src_encodec_4:整数序列类型src_encodec_5:整数序列类型src_encodec_6:整数序列类型src_encodec_7:整数序列类型tgt_encodec_0:整数序列类型tgt_encodec_1:整数序列类型tgt_encodec_2:整数序列类型tgt_encodec_3:整数序列类型tgt_encodec_4:整数序列类型tgt_encodec_5:整数序列类型tgt_encodec_6:整数序列类型tgt_encodec_7:整数序列类型
数据分割
- 训练集:
- 字节数:3702179864
- 样本数:90000
- 验证集:
- 字节数:202955396
- 样本数:5000
- 测试集:
- 字节数:208971751
- 样本数:5000
数据集大小
- 下载大小:139226240 字节
- 数据集大小:4114107011 字节



