登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
WAXAL Cleaned 16k
WAXAL Cleaned 16k
收藏
kaggle
2026-07-28 更新
2026-08-01 收录
非洲语言
多语言语音处理
数据链接:
https://www.kaggle.com/datasets/enesg26/waxal-cleaned-16k
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Cleaned 16 kHz WAXAL speech across 19 African languages
应用场景:
创建时间:
2026-07-28
相关数据集
yanickschraner/swiss_parliament_corpus
议会语音识别
多语言语音处理
--- dataset_info: features: - name: client_id dtype: int64 - name: audio dtype: audio: sampling_rate: 16000 - name: sentence dtype: string - name: up_votes dtyp
Hugging Face
2022-12-16 更新
18
0
BembaSpeech
自动语音识别
非洲语言
BembaSpeech是一个专为Bemba语言设计的自动语音识别数据集,由赞比亚大学计算机科学系创建。该数据集包含超过24小时的Bemba语言朗读语音,总计14,438条录音,适用于训练和测试自动语音识别系统。数据集内容来源于Bemba文学和其他在线资源,通过Lig-Aikuma应用收集。BembaSpeech旨在解决非洲语言资源稀缺的问题,特别是针对赞比亚的Bemba语言,支持构建更有效的语音识
arXiv
2021-02-09 更新
8
0
PHBJT/cml-tts
语音合成
多语言语音处理
该数据集包含多种语言的音频和文本数据,每种语言(如荷兰语、法语、德语、意大利语、波兰语、葡萄牙语和西班牙语)都有独立的配置。每个配置包含音频文件、文本、转录文本、编辑距离、音频时长、单词数量和说话者ID等特征。数据集被分割为训练集、开发集和测试集,每个分割都有相应的字节大小和示例数量。
Hugging Face
2024-09-25 更新
6
0
michsethowusu/ganda-nuer_sentence-pairs
非洲语言
自然语言处理
Ganda-Nuer句子对数据集包含非洲语言的句子对以及它们之间的相似度分数。这个数据集可以用于机器翻译、句子对齐或其他自然语言处理任务。数据集中的每一行包含三个列:相似度分数、第一个句子(语言1)和第二个句子(语言2)。该数据集旨在用于训练和评估用于翻译、句子相似度以及跨语言迁移学习的机器学习模型。
Hugging Face
2025-04-02 更新
10
0
michsethowusu/dyula-hausa_sentence-pairs
自然语言处理
非洲语言
Dyula-Hausa_Sentence-Pairs数据集包含非洲语言句子对及其相似度分数,适用于机器翻译、句子对齐等自然语言处理任务。该数据集基于NLLBv1构建,每行包含三个字段:相似度分数、Dyula语句子和Hausa语句子。
Hugging Face
2025-04-02 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广