登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
tamil podcast asr dataset
tamil podcast asr dataset
收藏
kaggle
2026-01-14 更新
2026-06-17 收录
自动语音识别
多语言语音处理
数据链接:
https://www.kaggle.com/datasets/infobayai/audio-podcast-tamil
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
High-quality Marathi Audio data for training and evaluating AI models.
用于AI模型训练与评估的高质量马拉地语音频数据
应用场景:
创建时间:
2026-01-14
相关数据集
RetaSy/quranic_audio_dataset
古兰经诵读
自动语音识别
我们探索了众包一个精心标注的古兰经数据集的可能性,在此基础上可以构建AI模型以简化学习过程。特别是,我们使用基于志愿者的众包类型,并实现了一个众包API来收集音频资源。我们开发了一个名为Quran Voice的众包平台来标注收集的音频资源。结果,我们从11个以上非阿拉伯国家的1287名参与者中收集了约7000个古兰经诵读音频,并从数据集中标注了1166个诵读音频,分为六个类别。我们达到了0.77的
Hugging Face
2024-05-14 更新
29
0
BD-4SK-ASR (Basic Dataset for Sorani Kurdish Automatic Speech Recognition)
自动语音识别
库尔德语处理
The Basic Dataset for Sorani Kurdish Automatic Speech Recognition (BD-4SK-ASR) 是一个用于 Sorani Kurdish 自动语音识别的数据集。我们提出了一个实验数据集,即 Sorani Kurdish 自动语音识别基本数据集 (BD-4SK-ASR),它我们第一次尝试为 Sorani Kurdish 开发自动语音识别。
OpenDataLab
2026-07-12 更新
8
0
AutomaticSpeechRecognition_LJSpeech
自动语音识别
语音处理
# Dataset Card for "AutomaticSpeechRecognition_LJSpeech" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
魔搭社区
2026-05-13 更新
7
0
farsi-asr/farsi-asr-dataset
波斯语
自动语音识别
Farsi ASR Dataset是最大的开源波斯语自动语音识别(ASR)数据集,从各种来源收集而成。该数据集包含了大量的波斯语音频转录数据,用于自动语音识别研究。
Hugging Face
2025-03-13 更新
19
0
polish_presidential_debate
自动语音识别
波兰语言
波兰总统辩论自动语音识别数据集,包含13位候选人在辩论中的15个音频样本,每个音频样本都有对应的文本字幕。数据集适用于自动语音识别任务,特别是针对波兰语言在政治领域的应用。
Hugging Face
2025-05-28 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广