登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Audio_Tamil_1
Audio_Tamil_1
收藏
kaggle
2025-10-12 更新
2025-10-25 收录
语音识别
印度语言处理
数据链接:
https://www.kaggle.com/datasets/sbhyya/audio-tamil-1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Based on MS speech data on Indian languages
基于微软(Microsoft)针对印度语言的语音数据集
应用场景:
创建时间:
2025-10-12
相关数据集
xmodar/commonvoice-12.0-arabic-voice-converted
语音识别
声音转换
该数据集是从Common Voice Arabic Corpus 12.0派生而来的,包含了自动添加音标的转录和音素表示。数据集中的录音是由用户朗读的阿拉伯语文本,这些文本最初没有音标,可能导致阅读错误。音标和音素是自动生成的,因此数据集对于语音识别任务有价值,但存在固有的噪声。数据集创建于SDAIA冬季学校,适用于对现代标准阿拉伯语的音标化语音数据和语音转换音频感兴趣的研究人员和从业者。音频文件
Hugging Face
2024-12-17 更新
14
0
PharynxAI/merged_english_accent_dataset
语音识别
口音分析
--- dataset_info: features: - name: audio dtype: audio - name: 'Unnamed: 0' dtype: int64 - name: text dtype: string - name: speaker_id dtype: int64 - name: source dtype
Hugging Face
2025-10-09 更新
10
0
การรู้จำแบบทนทานต่อเสียงรบกวนสำหรับเสียงพูดภาษาไทยโดยใช้อัลกอริทึม N-best LIMABEAM
语音识别
泰语语音
งานวิจัยนี้เสนอวิธีรู้จำเสียงพูดภาษาไทยแบบทนทานต่อเสียงรบกวนในสภาพแวดล้อมจริงที่ประกอบไปด้วยเสียงรบกวนจากเครื่องจักร และเสียงพูดที่ไม่สนใจ ซึ่งประสิทธิภาพในการรู้จำสามารถเพิ่มขึ้นได้ โดยการใช้หลักการข
Mendeley Data
2024-01-31 更新
8
0
asierhv/composite_corpus_es_v1.0
自然语言处理
语音识别
这是一个西班牙语复合语料库,版本为1.0。语料库包含了音频数据、文本句子和每个句子的持续时间。提供了训练集、多种验证集变体以及多种测试集,用于不同的模型训练和评估。
Hugging Face
2024-12-04 更新
14
0
seanghay/khmer-speech-large
语音识别
自然语言处理
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: sentence dtype: string splits: - name: train num_bytes: 5686102163.1 num_ex
Hugging Face
2023-04-30 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广