登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
普通话(中国)会议演讲语音数据库
普通话(中国)会议演讲语音数据库
收藏
魔搭社区
2026-06-24 更新
2024-08-31 收录
语音识别
语言处理
数据链接:
https://modelscope.cn/datasets/market.aliyun/MAC_ASR001
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
dataset_response_desc
数据集响应描述
应用场景:
提供机构:
maas
创建时间:
2024-07-29
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集是一个普通话会议演讲语音数据库,包含2000名成年发言人在会议中录制的约20万句语音,总时长323小时,采样率8kHz,带转录文本。数据适用于自动语音识别、呼叫中心和虚拟助手等场景,来源为Appen Global,需登录下载。
以上内容由遇见数据集搜集并总结生成
相关数据集
小规模alpaca
指令微调
语言模型训练
经过处理,用于megatron训练llama的小规模数据集
魔搭社区
2025-08-02 更新
9
0
whisper_transcriptions.reazonspeech.all.wer_10.0
语音识别
文本处理
该数据集包含多个特征,包括音频(采样率为16000Hz)、文本、Whisper转录、输入长度和标签。数据集分为训练集,包含902252个样本,总大小为126006279839.24字节。数据集的下载大小为123990907824字节。
Hugging Face
2024-08-30 更新
6
0
adp-v2
# ADP v2 This is an incremental ADP v2 dataset release generated from the `neulab/agent-data-protocol` pipeline. Each config corresponds to one source dataset. The initial upload contains only conf
魔搭社区
2026-08-01 更新
0
0
DylanonWic/common_voice_10_1_th_clean_split_0
语音识别
数据处理
--- dataset_info: features: - name: sentence dtype: string - name: labels sequence: int64 - name: input_values sequence: float32 splits: - name: train num_bytes: 1210156060
Hugging Face
2023-04-07 更新
8
0
MikhailT/voxpopuli-nl
语音识别
文本分类
--- dataset_info: features: - name: input_ids sequence: int32 - name: labels sequence: sequence: float32 - name: speaker_embeddings sequence: float32 splits: - name: trai
Hugging Face
2023-08-14 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广