登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
arnepeine/medspeech
arnepeine/medspeech
收藏
Hugging Face
2023-01-03 更新
2024-03-04 收录
医疗语音
语音识别
数据链接:
https://hf-mirror.com/datasets/arnepeine/medspeech
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
该数据集包含音频和对应的文本句子,主要用于训练集,共有3个样本。数据集总大小为133517.0字节,下载大小为126401字节。
应用场景:
提供机构:
arnepeine
原始信息汇总
数据集概述
数据集名称
medspeech
数据特征
audio
: 音频数据类型
sentence
: 字符串数据类型
数据分割
train
:
示例数量: 3
数据大小: 133517.0 字节
数据集大小
下载大小: 126401 字节
数据集总大小: 133517.0 字节
相关数据集
PeacefulData/Robust-HyPoradise
语音识别
噪声鲁棒性
Robust HyPoradise数据集是一个用于生成式错误校正和大语言模型研究的数据集,特别关注噪声鲁棒的语音识别。该数据集包含训练数据和测试数据,格式相同。由于语音特征文件较大,训练数据中未包含语音特征,但提供了脚本用于从原始语音文件(.wav)生成这些特征。数据集支持用户从自己的ASR数据集中生成训练和测试数据,并提供了必要的脚本和包。数据集的相关研究已在ICLR 2024会议上发表。
Hugging Face
2024-05-17 更新
15
0
ViSpeak-Instruct
语音识别
数据集文件元信息以及数据文件,请浏览“数据集文件”页面获取。 当前数据集卡片使用的是默认模版,数据集的贡献者未提供更加详细的数据集介绍,但是您可以通过如下GIT Clone命令,或者ModelScope SDK来下载数据集 #### 下载方法 :modelscope-code[]{type="sdk"} :modelscope-code[]{type="git"}
魔搭社区
2026-04-28 更新
13
0
seanghay/khmer-speech-large
语音识别
自然语言处理
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: sentence dtype: string splits: - name: train num_bytes: 5686102163.1 num_ex
Hugging Face
2023-04-30 更新
9
0
Lkhagvasurenam/common_voice_little_test
语音识别
特定语言处理
该数据集包含多个特征,如client_id、path、audio、sentence等,并且这些特征的数据类型也被详细列出。数据集分为训练集和测试集,分别包含2275和1877个样本。此外,还提供了数据集的总下载大小和数据集大小。
Hugging Face
2023-12-19 更新
14
0
Chvntala/bembaspeech
语音识别
自然语言处理
该数据集包含音频数据和对应的文本句子,主要用于音频与文本的关联任务。数据集仅包含一个训练集,共有12421个样本,总大小为2458890204.774字节。下载大小为2390558125字节。数据文件路径为data/train-*。
Hugging Face
2024-07-08 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广