sankar1535/jenny-tts-6h-tagged
收藏资源简介:
--- dataset_info: features: - name: file_name dtype: string - name: text dtype: string - name: transcription_normalised dtype: string - name: utterance_pitch_mean dtype: float32 - name: utterance_pitch_std dtype: float32 - name: snr dtype: float64 - name: c50 dtype: float64 - name: speaking_rate dtype: string - name: phonemes dtype: string - name: noise dtype: string - name: reverberation dtype: string - name: speech_monotony dtype: string - name: text_description dtype: string splits: - name: train num_bytes: 2258889 num_examples: 4000 download_size: 1066360 dataset_size: 2258889 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 名称:文件名(file_name),数据类型:字符串型 - 名称:原始文本(text),数据类型:字符串型 - 名称:归一化转录文本(transcription_normalised),数据类型:字符串型 - 名称:语句基频均值(utterance_pitch_mean),数据类型:32位浮点型 - 名称:语句基频标准差(utterance_pitch_std),数据类型:32位浮点型 - 名称:信噪比(snr),数据类型:64位浮点型 - 名称:C50清晰度指数(c50),数据类型:64位浮点型 - 名称:语速(speaking_rate),数据类型:字符串型 - 名称:音素序列(phonemes),数据类型:字符串型 - 名称:噪声类型(noise),数据类型:字符串型 - 名称:混响参数(reverberation),数据类型:字符串型 - 名称:言语单调度(speech_monotony),数据类型:字符串型 - 名称:文本描述(text_description),数据类型:字符串型 数据划分: - 名称:训练集(train),字节占用量:2258889,样本总数:4000 下载总大小:1066360 数据集总大小:2258889 配置项: - 配置名称:default,数据文件: - 数据划分:训练集(train),文件路径:data/train-*
数据集概述
数据集特征
- file_name: 数据类型为字符串。
- text: 数据类型为字符串。
- transcription_normalised: 数据类型为字符串。
- utterance_pitch_mean: 数据类型为float32。
- utterance_pitch_std: 数据类型为float32。
- snr: 数据类型为float64。
- c50: 数据类型为float64。
- speaking_rate: 数据类型为字符串。
- phonemes: 数据类型为字符串。
- noise: 数据类型为字符串。
- reverberation: 数据类型为字符串。
- speech_monotony: 数据类型为字符串。
- text_description: 数据类型为字符串。
数据集划分
- train:
- 数据大小: 2258889字节
- 示例数量: 4000
数据集大小
- 下载大小: 1066360字节
- 数据集总大小: 2258889字节



