遇见数据集

Nexdata/Scene_Noise_Data_by_Voice_Recorder

收藏
Hugging Face2024-04-17 更新2024-03-04 收录
官方服务:

资源简介:

该数据集是多场景噪声数据,涵盖了地铁、超市、餐厅、道路、机场、展览馆、高铁、高速公路、城市道路、电影院等日常生活场景。数据由专业录音设备Sony ICD-UX560F录制,采用高采样率和双声道格式,录音清晰自然。有效数据量为101小时。该数据集可用于自动语音识别(ASR)和噪声语音识别任务的模型训练。

This is a multi-scenario noise dataset covering daily life scenarios including subway, supermarket, restaurant, road, airport, exhibition hall, high-speed rail, expressway, urban road, cinema and others. The data was recorded using the professional recording device Sony ICD-UX560F, adopting high sampling rate and dual-channel audio format, with clear and natural audio quality. The total valid recording duration is 101 hours. This dataset can be used for model training in automatic speech recognition (ASR) and noisy speech recognition tasks.

提供机构:
Nexdata
原始信息汇总

数据集概述

数据集名称

  • 名称: Nexdata/Scene_Noise_Data_by_Voice_Recorder

数据集描述

  • 摘要: 该数据集包含多场景噪音数据,覆盖地铁、超市、餐厅、道路、机场、展览馆、高速铁路、高速公路、城市道路、电影院等日常生活场景。数据由专业录音机Sony ICD-UX560F录制,采样率高,双通道格式,录音清晰自然。有效数据时长为101小时。
  • 支持的任务: 自动语音识别(ASR)、噪声环境下的语音识别。
  • 语言: 噪音数据

数据集结构

  • 数据实例: [信息待补充]
  • 数据字段: [信息待补充]
  • 数据分割: [信息待补充]

数据集创建

  • 采集理由: [信息待补充]
  • 源数据: [信息待补充]
  • 标注: [信息待补充]
  • 个人和敏感信息: [信息待补充]

使用数据注意事项

  • 社会影响: [信息待补充]
  • 偏见讨论: [信息待补充]
  • 其他已知限制: [信息待补充]

附加信息

  • 数据集管理者: [信息待补充]
  • 许可信息: 商业许可,详情见链接 https://drive.google.com/file/d/1saDCPm74D4UWfBL17VbkTsZLGfpOQj1J/view?usp=sharing
  • 引用信息: [信息待补充]
  • 贡献: [信息待补充]
搜集汇总
数据集介绍
Nexdata/Scene_Noise_Data_by_Voice_Recorder 数据集图片
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务