登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
ASR-THCHS30-CSC: A Chinese Speech Corpus from Tsinghua University
ASR-THCHS30-CSC: A Chinese Speech Corpus from Tsinghua University
收藏
MagicHub开源社区
2021-07-06 更新
2024-06-08 收录
语音识别
中文字符
数据链接:
https://magichub.com/datasets/chinese-speech-corpus-from-tsinghua-university/
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
About this resource:
应用场景:
创建时间:
2021-07-06
相关数据集
2017 NIST OpenSAT Pilot - SSSF
语音识别
公共安全通信
Introduction 2017 NIST OpenSAT Pilot - SSSF was developed by NIST (National Institute of Standards and Technology) and contains approximately one hour of operational speech data, transcripts and annot
Mendeley Data
2024-01-31 更新
15
0
test
语音识别
自然语言处理
该数据集包含56,716条训练样本,总大小约66.59GB,主要存储为音频文本配对数据。每条记录包含10个结构化字段:说话人ID(string)、年龄(float)、性别(string);内容分类字段包括主题(topic)和子主题(subtopic);文本标识字段包含段落ID(int64)和句子ID(string);核心数据为转录文本(transcript)和音频(16kHz采样率的音频数据),并
Hugging Face
2026-03-16 更新
12
0
procit009/nl_stt
语音识别
自然语言处理
该数据集包含音频文件及其相关信息,如用户ID、路径、句子、投票数、年龄、性别、口音、地区、片段和变体等。数据集分为训练集、测试集和验证集,总大小超过5GB。
Hugging Face
2024-12-24 更新
9
0
syvai/dk-voice-single-speaker
语音识别
机器学习
该数据集包含音频和文本数据,文本数据分为带标签和不带标签两种。数据集划分为训练集,共有719个样本,数据集总大小为849,905,320字节。
Hugging Face
2025-06-03 更新
12
0
cpalenmichel/kmr-bible
语音识别
音频处理
--- dataset_info: features: - name: text dtype: string - name: path dtype: string - name: audio dtype: audio: sampling_rate: 16000 splits: - name: train num_b
Hugging Face
2023-12-13 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广