登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Arabic Speech Corpus
Arabic Speech Corpus
收藏
SSH Open MarketPlace
2025-07-04 更新
2025-07-05 收录
语音识别
阿拉伯语言学
数据链接:
https://marketplace.sshopencloud.eu/dataset/hAboZh
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This corpus is available for download from the Oxford Text Archive.
应用场景:
创建时间:
2025-07-04
相关数据集
ASR-SCDgSC: A Scripted Chinese Digits Speech Corpus
语音识别
中文数字
This dataset consists of 117 hours of transcribed Mandarin Chinese scripted speech on digits contributed by 1,465 speakers.
MagicHub开源社区
2021-09-15 更新
33
0
kadirnar/Emilia-DE-SmolLM2
语音识别
自然语言处理
该数据集包含以下字段:持续时间(浮点型)、说话者(字符串型)、语言(字符串型)、dnsmos(语音质量评分,浮点型)、phone_count(电话数量,整型)、唯一标识符(字符串型)、源文件夹路径(字符串型)、输入ID序列(整型序列)、标签序列(长整型序列)和注意力掩码序列(字整型序列)。数据集分为训练集,包含约200万4966个示例,总大小约为21.68GB。
Hugging Face
2025-06-27 更新
12
0
audio_L2-regular-15_trivia_qa-audio
语音识别
问答系统
该数据集包含问题、问题来源、实体页面信息(如文档来源、文件名、标题、维基百科上下文)、搜索结果(包括描述、文件名、排名、标题、URL、搜索上下文)、答案(包括别名、标准化别名、匹配的维基实体名称、标准化匹配的维基实体名称、标准化值、类型、值)、问题单位、响应交叠、响应文本、响应令牌、响应语音、响应ASR和MOS评分等字段。数据集包含验证集,验证集有1000个示例,总字节数为671,381,944字
Hugging Face
2025-05-08 更新
9
0
NMSQA
语音识别
无文本问答
# Dataset Card for NMSQA(Natural Multi-speaker Spoken Question Answering) ## Table of Contents - [Table of Contents](#table-of-contents) - [Dataset Description](#dataset-description) - [Dataset Su
魔搭社区
2025-11-02 更新
14
0
litus-ai/google_fleurs_it_pseudo_labelled_whisper_large_v3
语音识别
自然语言处理
--- dataset_info: config_name: it_it features: - name: id dtype: string - name: audio dtype: audio: sampling_rate: 16000 - name: transcription dtype: string - nam
Hugging Face
2024-04-24 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广