toloka/CLESC
收藏资源简介:
--- dataset_info: features: - name: audio dtype: string - name: Crowd_Worker_1 dtype: string - name: Crowd_Worker_2 dtype: string - name: Crowd_Worker_3 dtype: string - name: Expert_1 dtype: string - name: Expert_2 dtype: string - name: Expert_3 dtype: string - name: source_dataset dtype: string - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 475376 num_examples: 500 download_size: 112382 dataset_size: 475376 configs: - config_name: default data_files: - split: train path: data/train-* license: cc-by-4.0 language: - en --- CLESC-dataset (Crowd Labeled Emotions and Speech Characteristics) is a dataset of 500 audio samples with transcriptions mixed of 2 open sourced Common Voice (100) and Voxceleb* (400) with voice features labels. We focus on annotating scalable voice characteristics such as pace (slow, normal, fast, variable), pitch (low, medium, high, variable), and volume (quiet, medium, loud, variable) as well as labeling emotions and unique voice features (free input, based on instructions provided). Curated by: Evgeniya Sukhodolskaya, Ilya Kochik (Toloka) [1] J. S. Chung, A. Nagrani, A. Zisserman VoxCeleb2: Deep Speaker Recognition INTERSPEECH, 2018. [2] A. Nagrani, J. S. Chung, A. Zisserman VoxCeleb: a large-scale speaker identification dataset INTERSPEECH, 2017
数据集信息: 特征项: - 名称:音频(audio),数据类型:字符串 - 名称:众包标注员1(Crowd_Worker_1),数据类型:字符串 - 名称:众包标注员2(Crowd_Worker_2),数据类型:字符串 - 名称:众包标注员3(Crowd_Worker_3),数据类型:字符串 - 名称:专家标注员1(Expert_1),数据类型:字符串 - 名称:专家标注员2(Expert_2),数据类型:字符串 - 名称:专家标注员3(Expert_3),数据类型:字符串 - 名称:源数据集(source_dataset),数据类型:字符串 - 名称:__index_level_0__,数据类型:64位整数 数据集划分: - 名称:训练集(train),占用字节数:475376,样本数量:500 下载大小:112382 数据集总大小:475376 配置项: - 配置名称:默认配置(default),数据文件: - 划分:训练集,路径:data/train-* 许可证:CC BY 4.0 语言:英语(en) CLESC数据集(众包标注情感与语音特征数据集,Crowd Labeled Emotions and Speech Characteristics)包含500条音频样本,其转录文本混合自两个开源数据集:Common Voice(100条)与Voxceleb*(400条),并附带语音特征标签。本数据集聚焦于可规模化标注的语音属性,包括语速(慢、正常、快、可变)、音高(低、中、高、可变)与音量(轻、中等、响亮、可变),同时可对情感与独特语音特征进行标注(需遵循给定说明进行自由文本输入)。 本数据集由叶夫根尼娅·苏霍多尔斯卡娅(Evgeniya Sukhodolskaya)、伊利亚·科奇克(Ilya Kochik,Toloka团队)整理。 [1] J. S. 钟、A. 纳格拉尼、A. 齐斯曼:《VoxCeleb2:深度说话人识别》,INTERSPEECH,2018年。 [2] A. 纳格拉尼、J. S. 钟、A. 齐斯曼:《VoxCeleb:大规模说话人识别数据集》,INTERSPEECH,2017年。



