登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
fair-forward/arc-easy-autotranslated
fair-forward/arc-easy-autotranslated
收藏
Hugging Face
2025-10-26 更新
2025-11-01 收录
自动翻译
多语言数据
数据链接:
https://hf-mirror.com/datasets/fair-forward/arc-easy-autotranslated
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
数据集包含多个配置,每个配置有训练集和测试集,包含问题、选项和答案等信息。
应用场景:
提供机构:
fair-forward
相关数据集
LeWiDi-2025
自然语言处理
多语言数据
LeWiDi-2025数据集是一个用于训练和评估自然语言处理模型的资源,它包含了四个数据集,分别是:Conversational Sarcasm Corpus (CSC)、MultiPICo dataset (MP)、VariErr NLI dataset (VEN)和Paraphrase Detection dataset (Par)。这些数据集覆盖了自然语言处理的多个领域,包括讽刺检测、自然语
arXiv
2025-10-10 更新
44
0
C4Corpus
多语言数据
网络数据分析
C4Corpus是一个多语言的Web规模数据集,具有免费许可证,用于处理和分析来自CommonCrawl的Creative Commons内容。
github
2024-03-01 更新
31
0
QubitPi/wiktionary-data
多语言数据
自然语言处理
该数据集是从英语维基词典(English Wiktionary)中提取的子数据集,支持多种语言,包括德语、拉丁语、古希腊语、韩语、古波斯语、阿卡德语、埃兰语和梵语。数据集分为两个子集:一个是语言子集,包含上述语言的提取数据;另一个是图子集,用于构建知识图谱。数据集的来源是tatuylonen的wiktextract项目,数据以JSONL格式提供。
Hugging Face
2024-12-14 更新
18
0
GlobMed
自然语言处理
多语言数据
GlobMed是迄今为止最大的多语言医疗数据集,涵盖20种语言,包含80万+条目。覆盖高资源语言(如阿拉伯语、中文、英语等)和低资源语言(如孟加拉语、马来语等)。核心任务包括自然语言推理、长形式问答和多选题问答等。
github
2026-01-10 更新
42
0
Arknights En-Ja-Zh
游戏本地化
多语言数据
Multilingual in Arknignights. English, Japanese and Chinese langs. Cleaned.
kaggle
2023-07-01 更新
21
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广