登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Yorùbá_qa_pairs
Yorùbá_qa_pairs
收藏
kaggle
2026-08-13 更新
2026-08-19 收录
方言问答对
约鲁巴语
数据链接:
https://www.kaggle.com/datasets/itiolaolabisi/adaption-yoruba-qa-pairs
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Ṣúpárè_Yoruba-dialect_QA_pairs
Ṣúpárè约鲁巴方言(Yoruba-dialect)问答对(QA pairs)
应用场景:
创建时间:
2026-08-13
相关数据集
Yankari
自然语言处理
约鲁巴语
Yankari数据集是由非洲语言保护中心创建的一个大规模单语种约鲁巴语数据集,旨在填补自然语言处理(NLP)领域中约鲁巴语资源的重大空白。该数据集包含51,407份文档,总计超过3000万Tokens,来源于13个不同的高质量来源,如新闻网站、博客和维基百科等。数据集的创建过程强调了伦理数据收集、严格的质量控制和语言真实性的保护,避免了宗教文本和机器翻译内容的使用。Yankari数据集的应用领域广
arXiv
2024-12-04 更新
139
0
Diacritic Restoration in Yoruba Language
语言处理
约鲁巴语
A project on diacritic restoration of languages
kaggle
2022-01-23 更新
13
0
shunyalabs/yoruba-speech-dataset
语音识别
约鲁巴语
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: transcript dtype: string splits: - name: train num_bytes: 2311876592.205 nu
Hugging Face
2025-08-25 更新
8
0
YOSM
情感分析
约鲁巴语
YOSM是首个针对尼日利亚电影评论的约鲁巴语情感语料库,由蒙特克莱尔州立大学创建。该数据集包含1500条电影评论,这些评论来自IMDB、Rotten Tomatoes等五个在线电影评论平台,涵盖了平衡的正面和负面评论。数据集的创建过程包括从英文评论中收集数据,然后由约鲁巴语母语者进行手动翻译。YOSM数据集主要应用于情感分析领域,旨在帮助电影制片人和观众了解电影的市场反应和观众情感,从而优化电影制
arXiv
2022-04-21 更新
21
0
ÌròyìnSpeech
语音识别
约鲁巴语
ÌròyìnSpeech是一个旨在增加高质量当代约鲁巴语语音数据量的新型语料库,适用于文本到语音(TTS)和自动语音识别(ASR)任务。该数据集由斯坦福大学等机构创建,包含约23000条从新闻和创意写作领域精选的文本句子,以及42小时的语音数据,由80名志愿者录制。数据集创建过程中,采用了参与式方法,将5000条句子提供给Mozilla Common Voice平台进行众包录音和验证。Ìròyìn
arXiv
2024-03-27 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广