five

Nexdata/Minnan_Dialect_Conversational_Speech_Data_by_Mobile_Phone

收藏
Hugging Face2023-08-31 更新2024-03-04 收录
下载链接:
https://hf-mirror.com/datasets/Nexdata/Minnan_Dialect_Conversational_Speech_Data_by_Mobile_Phone
下载链接
链接失效反馈
官方服务:
资源简介:
该数据集包含500小时的闽南语对话语音数据,由约1000名来自泉州、漳州和厦门的闽南语使用者通过手机录制。数据集的男女比例均衡,覆盖了多个年龄组。录音内容没有预设的语料库,录音者根据自己熟悉的话题进行对话,以确保对话的流畅和自然。数据集支持的任务包括自动语音识别(ASR)和音频说话人识别。数据集的语言为闽南语。

This dataset contains 500 hours of Minnan dialect conversational speech data, recorded by approximately 1,000 Minnan speakers from Quanzhou, Zhangzhou, and Xiamen via mobile phones. The dataset has a balanced gender ratio and covers multiple age groups. The recordings were not based on a pre-defined corpus; speakers conducted conversations on topics they were familiar with to ensure the fluency and naturalness of the dialogues. Supported tasks include automatic speech recognition (ASR) and audio speaker recognition. The language of this dataset is Minnan dialect.
提供机构:
Nexdata
原始信息汇总

数据集概述

数据集描述

数据集总结

  • 时长: 500小时
  • 语言: 闽南语
  • 录音者: 约1,000名当地闽南语使用者,来自泉州、漳州和厦门
  • 性别比例: 平衡
  • 年龄覆盖: 多个年龄组
  • 录音内容: 无预设文稿,根据熟悉的话题进行自然对话录音

支持的任务和排行榜

  • 任务: 自动语音识别 (ASR), 音频说话人识别

数据集结构

数据实例

  • 信息: 待补充

数据字段

  • 信息: 待补充

数据分割

  • 信息: 待补充

数据集创建

数据收集理由

  • 信息: 待补充

源数据

  • 初始数据收集和标准化: 待补充
  • 源语言生产者: 待补充

注释

  • 注释过程: 待补充
  • 注释者: 待补充

个人和敏感信息

  • 信息: 待补充

使用数据的考虑

数据集的社会影响

  • 信息: 待补充

偏见讨论

  • 信息: 待补充

其他已知限制

  • 信息: 待补充

附加信息

数据集管理者

  • 信息: 待补充

许可信息

引用信息

  • 信息: 待补充

贡献

  • 信息: 待补充
搜集汇总
数据集介绍
main_image_url
以上内容由遇见数据集搜集并总结生成
5,000+
优质数据集
54 个
任务类型
进入经典数据集
二维码
社区交流群

面向社区/商业的数据集话题

二维码
科研交流群

面向高校/科研机构的开源数据集话题

数据驱动未来

携手共赢发展

商业合作