遇见数据集

Saurabh4509/jenny-tts-tags-6h

收藏
Hugging Face2024-05-08 更新2024-06-12 收录
官方服务:

资源简介:

该数据集包含语音相关的多种特征,如文件名、文本、标准化转录、平均音高、音高标准差、信噪比、C50、语速、音素、噪声、混响和语音单调性等。数据集仅包含一个训练分割,共有4000个样本,总大小为1814021字节。

该数据集包含语音相关的多种特征,如文件名、文本、标准化转录、平均音高、音高标准差、信噪比、C50、语速、音素、噪声、混响和语音单调性等。数据集仅包含一个训练分割,共有4000个样本,总大小为1814021字节。

提供机构:
Saurabh4509
原始信息汇总

数据集概述

数据集特征

  • file_name:文件名,数据类型为字符串。
  • text:文本内容,数据类型为字符串。
  • transcription_normalised:标准化转录文本,数据类型为字符串。
  • utterance_pitch_mean:语音平均音高,数据类型为float32。
  • utterance_pitch_std:语音音高标准差,数据类型为float32。
  • snr:信噪比,数据类型为float64。
  • c50:C50值,数据类型为float64。
  • speaking_rate:说话速度,数据类型为字符串。
  • phonemes:音素,数据类型为字符串。
  • noise:噪音类型,数据类型为字符串。
  • reverberation:混响类型,数据类型为字符串。
  • speech_monotony:语音单调性,数据类型为字符串。

数据集划分

  • 训练集(train)
    • 数据大小:1814021字节
    • 样本数量:4000个

数据集大小

  • 下载大小:933391字节
  • 数据集总大小:1814021字节

配置信息

  • 默认配置(default)
    • 数据文件路径:data/train-*
二维码
社区交流群
二维码
科研交流群
商业服务