jha2ee/Sound_Spectrogram
收藏资源简介:
--- dataset_info: features: - name: image dtype: image - name: label dtype: class_label: names: '0': Sound_Drum '1': Sound_Piano '2': Sound_Violin '3': airplane '4': breathing '5': brushing_teeth '6': can_opening '7': car_horn '8': cat '9': chainsaw '10': chirping_birds '11': church_bells '12': clapping '13': clock_alarm '14': clock_tick '15': coughing '16': cow '17': crackling_fire '18': crickets '19': crow '20': crying_baby '21': dog '22': door_wood_creaks '23': door_wood_knock '24': drinking_sipping '25': engine '26': fireworks '27': footsteps '28': frog '29': glass_breaking '30': helicopter '31': hen '32': insects '33': keyboard_typing '34': laughing '35': mouse_click '36': pig '37': pouring_water '38': rain '39': rooster '40': sea_waves '41': sheep '42': siren '43': sneezing '44': snoring '45': toilet_flush '46': train '47': vacuum_cleaner '48': washing_machine '49': water_drops '50': wind splits: - name: train num_bytes: 141766644.635 num_examples: 1981 download_size: 141547931 dataset_size: 141766644.635 task_categories: - feature-extraction tags: - sound - environment - instrument - effect --- # Dataset Card for "Sound_Spectrogram" # Questions about dataset 1. What is Spectrogram? 2. How were these converted to image? 3. Where is dataset from? 4. How can I use this? [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集信息: 特征列表: - 名称:image(图像),数据类型:图像 - 名称:label(标签),数据类型:类别标签,类别名称映射如下: '0': 鼓声(Sound_Drum) '1': 钢琴声(Sound_Piano) '2': 小提琴声(Sound_Violin) '3': 飞机声响(airplane) '4': 呼吸声(breathing) '5': 刷牙声(brushing_teeth) '6': 开罐声(can_opening) '7': 汽车鸣笛声(car_horn) '8': 猫叫(cat) '9': 链锯声(chainsaw) '10': 鸟鸣声(chirping_birds) '11': 教堂钟声(church_bells) '12': 鼓掌声(clapping) '13': 闹钟声(clock_alarm) '14': 时钟滴答声(clock_tick) '15': 咳嗽声(coughing) '16': 牛叫声(cow) '17': 柴火噼啪声(crackling_fire) '18': 蟋蟀叫声(crickets) '19': 乌鸦叫声(crow) '20': 婴儿哭声(crying_baby) '21': 狗叫声(dog) '22': 木门嘎吱声(door_wood_creaks) '23': 木门敲击声(door_wood_knock) '24': 啜饮声(drinking_sipping) '25': 引擎声(engine) '26': 烟花声(fireworks) '27': 脚步声(footsteps) '28': 青蛙叫声(frog) '29': 玻璃破碎声(glass_breaking) '30': 直升机声(helicopter) '31': 母鸡叫声(hen) '32': 昆虫声(insects) '33': 键盘敲击声(keyboard_typing) '34': 笑声(laughing) '35': 鼠标点击声(mouse_click) '36': 猪叫声(pig) '37': 倒水声(pouring_water) '38': 雨声(rain) '39': 公鸡叫声(rooster) '40': 海浪声(sea_waves) '41': 羊叫声(sheep) '42': 警报声(siren) '43': 打喷嚏声(sneezing) '44': 打鼾声(snoring) '45': 马桶冲水声(toilet_flush) '46': 火车声(train) '47': 吸尘器声(vacuum_cleaner) '48': 洗衣机声(washing_machine) '49': 水滴声(water_drops) '50': 风声(wind) 划分集: - 名称:train(训练集),字节数:141766644.635,样本数量:1981 下载大小:141547931,数据集总大小:141766644.635 任务类别: - 特征提取(feature-extraction) 数据集标注标签: - sound(声音) - environment(环境音) - instrument(乐器音) - effect(音效) --- # “声谱图(Sound_Spectrogram)”数据集卡片 ## 数据集相关疑问 1. 什么是声谱图(Spectrogram)? 2. 此类数据是如何转换为图像格式的? 3. 该数据集的来源是什么? 4. 我应如何使用该数据集? 【需补充更多信息】(https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
特征
- image: 图像数据类型
- label: 分类标签数据类型,包含以下类别:
- 0: Sound_Drum
- 1: Sound_Piano
- 2: Sound_Violin
- 3: airplane
- 4: breathing
- 5: brushing_teeth
- 6: can_opening
- 7: car_horn
- 8: cat
- 9: chainsaw
- 10: chirping_birds
- 11: church_bells
- 12: clapping
- 13: clock_alarm
- 14: clock_tick
- 15: coughing
- 16: cow
- 17: crackling_fire
- 18: crickets
- 19: crow
- 20: crying_baby
- 21: dog
- 22: door_wood_creaks
- 23: door_wood_knock
- 24: drinking_sipping
- 25: engine
- 26: fireworks
- 27: footsteps
- 28: frog
- 29: glass_breaking
- 30: helicopter
- 31: hen
- 32: insects
- 33: keyboard_typing
- 34: laughing
- 35: mouse_click
- 36: pig
- 37: pouring_water
- 38: rain
- 39: rooster
- 40: sea_waves
- 41: sheep
- 42: siren
- 43: sneezing
- 44: snoring
- 45: toilet_flush
- 46: train
- 47: vacuum_cleaner
- 48: washing_machine
- 49: water_drops
- 50: wind
数据分割
- train: 训练集,包含1981个样本,总大小为141766644.635字节
数据集大小
- 下载大小: 141547931字节
- 数据集大小: 141766644.635字节
任务类别
- 特征提取
标签
- sound
- environment
- instrument
- effect




