遇见数据集

ASR-SCDgSC: A Scripted Chinese Digits Speech Corpus

收藏
MagicHub开源社区2021-09-15 更新2024-06-08 收录
官方服务:

资源简介:

This dataset consists of 117 hours of transcribed Mandarin Chinese scripted speech on digits contributed by 1,465 speakers.

本数据集包含117小时经转录的普通话数字脚本语音语料,由1465名发音人录制提供。

创建时间:
2021-09-15
搜集汇总
数据集介绍
ASR-SCDgSC: A Scripted Chinese Digits Speech Corpus 数据集图片
背景与挑战
背景概述
ASR-SCDgSC是一个中文数字语音语料库,专门用于自动语音识别研究。它包含117小时的脚本朗读语音,由1,465名说话者录制,音频参数为16 kHz、16位、单声道,文件格式为WAV和TXT,录制环境为室内环境。该数据集聚焦于数字内容,适用于语音技术开发和测试。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务