遇见数据集

sankar1535/jenny-tts-6h-tagged

收藏
Hugging Face2024-05-13 更新2024-06-12 收录
官方服务:

资源简介:

--- dataset_info: features: - name: file_name dtype: string - name: text dtype: string - name: transcription_normalised dtype: string - name: utterance_pitch_mean dtype: float32 - name: utterance_pitch_std dtype: float32 - name: snr dtype: float64 - name: c50 dtype: float64 - name: speaking_rate dtype: string - name: phonemes dtype: string - name: noise dtype: string - name: reverberation dtype: string - name: speech_monotony dtype: string - name: text_description dtype: string splits: - name: train num_bytes: 2258889 num_examples: 4000 download_size: 1066360 dataset_size: 2258889 configs: - config_name: default data_files: - split: train path: data/train-* ---

数据集信息: 特征字段: - 名称:文件名(file_name),数据类型:字符串型 - 名称:原始文本(text),数据类型:字符串型 - 名称:归一化转录文本(transcription_normalised),数据类型:字符串型 - 名称:语句基频均值(utterance_pitch_mean),数据类型:32位浮点型 - 名称:语句基频标准差(utterance_pitch_std),数据类型:32位浮点型 - 名称:信噪比(snr),数据类型:64位浮点型 - 名称:C50清晰度指数(c50),数据类型:64位浮点型 - 名称:语速(speaking_rate),数据类型:字符串型 - 名称:音素序列(phonemes),数据类型:字符串型 - 名称:噪声类型(noise),数据类型:字符串型 - 名称:混响参数(reverberation),数据类型:字符串型 - 名称:言语单调度(speech_monotony),数据类型:字符串型 - 名称:文本描述(text_description),数据类型:字符串型 数据划分: - 名称:训练集(train),字节占用量:2258889,样本总数:4000 下载总大小:1066360 数据集总大小:2258889 配置项: - 配置名称:default,数据文件: - 数据划分:训练集(train),文件路径:data/train-*

提供机构:
sankar1535
原始信息汇总

数据集概述

数据集特征

  • file_name: 数据类型为字符串。
  • text: 数据类型为字符串。
  • transcription_normalised: 数据类型为字符串。
  • utterance_pitch_mean: 数据类型为float32。
  • utterance_pitch_std: 数据类型为float32。
  • snr: 数据类型为float64。
  • c50: 数据类型为float64。
  • speaking_rate: 数据类型为字符串。
  • phonemes: 数据类型为字符串。
  • noise: 数据类型为字符串。
  • reverberation: 数据类型为字符串。
  • speech_monotony: 数据类型为字符串。
  • text_description: 数据类型为字符串。

数据集划分

  • train:
    • 数据大小: 2258889字节
    • 示例数量: 4000

数据集大小

  • 下载大小: 1066360字节
  • 数据集总大小: 2258889字节
二维码
社区交流群
二维码
科研交流群
商业服务