遇见数据集

syllasgiorgos/commonVoice_greek_clean_with_top_speaker_ids-text-tags

收藏
Hugging Face2025-01-30 更新2025-02-15 收录
官方服务:

资源简介:

这是一个包含语音相关特征的语音数据集,适用于语音信号处理和语音识别等领域的研究。数据集包括文件名、文本内容、归一化转录、说话者ID、客户端ID、语音基频均值和标准差、信噪比、c50、说话速率、音素、stoi、si-sdr、pesq等特征。数据集分为训练集,共包含14312个示例,数据集大小为7620005字节。

This is a speech dataset containing various speech-related features suitable for research in speech signal processing and speech recognition. The dataset includes features such as file name, text content, normalized transcription, speaker ID, client ID, mean and standard deviation of speech pitch, signal-to-noise ratio, c50, speaking rate, phonemes, stoi, si-sdr, pesq, etc. The dataset is split into a training set with a total of 14312 examples and a size of 7620005 bytes.

提供机构:
syllasgiorgos
二维码
社区交流群
二维码
科研交流群
商业服务