登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
多语言单人语音
多语言单人语音
收藏
OpenXLab
2026-07-31 收录
多语言语音识别
语音语料库
数据链接:
https://openxlab.org.cn/datasets/Dataify/Multilingual-Single-Voice-First-Clear-Ac
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
本数据集覆盖中文、英语、日语、法语、韩语五大主流语种,全部样本为单人连续独发音, 单条发言时长大于60 秒,数据来源公开数据爬取
应用场景:
提供机构:
Dataify
创建时间:
2026-07-21
相关数据集
VoxBox
语音语料库
文本到语音
VoxBox是一个大规模语音语料库,由多样化的开源数据集构建而成,用于训练文本到语音(TTS)系统。
github
2025-04-11 更新
778
0
DynamicSuperb/MultiLingualSpeechRecognition_MLS-nl
多语言语音识别
荷兰语
该数据集名为MultiLingualSpeechRecognition_MLS-nl,主要用于多语言语音识别任务。数据集包含音频数据、对应的指令和标签。测试集包含3075个示例,总大小为777179107.325字节。数据集的下载大小为773894496字节。
Hugging Face
2024-08-05 更新
9
0
barockok/dataset-alpha-v1
多语言语音识别
南岛语系语音资源
--- language: - mul tags: - speech - audio - asr - tts - multilingual size_categories: - 10K<n<100K license: cc-by-4.0 --- # Dataset Alpha V1 A multilingual audio-text parallel corpus compiled from
Hugging Face
2026-05-27 更新
7
0
वाक् सञ्चयः (/Vāksañcayaḥ/)
多语言语音识别
语言学研究
数据集वाक् सञ्चयः (/Vāksañcayaḥ/)由印度理工学院孟买分校等机构创建,旨在解决梵语自动语音识别(ASR)的挑战。该数据集包含超过78小时、约46,000句的语音数据,涵盖从公元前1500年到现代的三个时期,涉及哲学、文学等多个领域。数据收集自27位不同母语的演讲者,确保了语言的多样性和真实性。创建过程中,特别注意了梵语特有的语音和语法特点,如Sandhi规则的应用。该数据
arXiv
2021-07-23 更新
19
0
CSLU: Spoltech Brazilian Portuguese Version 1.0
巴西葡萄牙语
语音语料库
Introduction CSLU: Spoltech Brazilian Portuguese Version 1.0, Linguistic Data Consortium (LDC) catalog number LDC2006S16 and ISBN 1-58563-383-6, contains microphone speech from a variety of regions in
Mendeley Data
2024-01-31 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广