登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
WURA corpus
WURA corpus
收藏
NIAID Data Ecosystem
2026-05-02 收录
非洲语言
多语言文本生成
数据链接:
https://zenodo.org/record/14585910
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
WURA corpus used to train AfriTeVa V2 T5 model
应用场景:
创建时间:
2025-01-02
相关数据集
Afrivoice_Kinyarwanda
语音识别
非洲语言
非洲语音基尼亚鲁旺达语音识别数据集(Afrivoice Kinyarwanda ASR dataset),包含农业、教育、金融、政府和健康五个领域的图像、音频描述和转录数据。
Hugging Face
2025-09-09 更新
16
0
Additional file 4 of Automatic construction of generic Hausa language stop words list using term frequency-inverse document frequency
自然语言处理
非洲语言
Additional file 4
DataCite Commons
2024-12-16 更新
11
0
RB5-Bantu_Ekoid_Bakor_Nkum - Bantu Ekoid Bakor Nkum
非洲语言
Bantu语系
. Language as given: Nkum
Research Data Australia
8
0
masakhane/afrimmlu
多语言问答
非洲语言
AFRIMMLU是一个评估数据集,包含将MMLU数据集的一部分翻译成15种非洲语言的版本。它包括所有17种语言的测试集,并保留了原始MMLU数据集中的英语和法语子集。数据集的结构包括问题、选项、答案和主题字段,并且每种语言都有验证集、开发集和测试集的分割。
Hugging Face
2025-04-15 更新
14
0
michsethowusu/afrikaans-sentiments-corpus
情感分析
非洲语言
Afrikaans Sentiment Corpus数据集包含了150万条经过情感标注的阿非利堪斯语文本数据,用于二元情感分类(积极/消极)。这些情感是通过将句子的英语含义提取并使用DistilBERT模型进行情感分类得出的。该数据集是更大型的非洲语言情感分析资源集合的一部分。
Hugging Face
2025-07-02 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广