登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
aredaw/asr-spell-pairs-makoveevk
aredaw/asr-spell-pairs-makoveevk
收藏
Hugging Face
2025-10-12 更新
2025-10-25 收录
自动语音识别
拼写校正
数据链接:
https://hf-mirror.com/datasets/aredaw/asr-spell-pairs-makoveevk
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
俄罗斯自动语音识别(ASR)错误到正确文本的配对数据集
Russian ASR noisy to clean text pairs dataset
应用场景:
提供机构:
aredaw
相关数据集
RetaSy/quranic_audio_dataset
古兰经诵读
自动语音识别
我们探索了众包一个精心标注的古兰经数据集的可能性,在此基础上可以构建AI模型以简化学习过程。特别是,我们使用基于志愿者的众包类型,并实现了一个众包API来收集音频资源。我们开发了一个名为Quran Voice的众包平台来标注收集的音频资源。结果,我们从11个以上非阿拉伯国家的1287名参与者中收集了约7000个古兰经诵读音频,并从数据集中标注了1166个诵读音频,分为六个类别。我们达到了0.77的
Hugging Face
2024-05-14 更新
29
0
MothersTongue/mother_tongue_dataset
自动语音识别
Shona语
该数据集包含音频和句子两个特征,音频的采样率为16000Hz,句子为字符串类型。数据集分为训练集,包含240个样本,总大小为57965401字节。数据集用于自动语音识别任务,语言为绍纳语(Shona),数据集的名称为learn shona,许可证为MIT。
Hugging Face
2024-06-18 更新
9
0
polish_presidential_debate
自动语音识别
波兰语言
波兰总统辩论自动语音识别数据集,包含13位候选人在辩论中的15个音频样本,每个音频样本都有对应的文本字幕。数据集适用于自动语音识别任务,特别是针对波兰语言在政治领域的应用。
Hugging Face
2025-05-28 更新
8
0
pasketti
语音识别
自动语音识别
该数据集名为'On Top of Pasketti — Children's Word ASR (Training Data)',是一个用于儿童语音自动识别(ASR)任务的训练数据集。数据集包含95,572条语音样本,总时长约185.4小时,音频格式为FLAC。每条样本包含多个字段:utterance_id(唯一标识符)、child_id(匿名说话者标识符)、session_id(录音会话标识符)
Hugging Face
2026-02-19 更新
26
0
BD-4SK-ASR (Basic Dataset for Sorani Kurdish Automatic Speech Recognition)
自动语音识别
库尔德语处理
The Basic Dataset for Sorani Kurdish Automatic Speech Recognition (BD-4SK-ASR) 是一个用于 Sorani Kurdish 自动语音识别的数据集。我们提出了一个实验数据集,即 Sorani Kurdish 自动语音识别基本数据集 (BD-4SK-ASR),它我们第一次尝试为 Sorani Kurdish 开发自动语音识别。
OpenDataLab
2026-07-12 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广