登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Polygl0t/MMLU-poly
Polygl0t/MMLU-poly
收藏
Hugging Face
2025-11-05 更新
2025-11-15 收录
多语言问答
自然语言理解
数据链接:
https://hf-mirror.com/datasets/Polygl0t/MMLU-poly
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
该数据集包含多个语言的配置,每个配置都有问题、选项和答案等特征,以及开发、验证和测试等数据分割。每个语言配置都有其特定的数据文件路径。数据集包含大量示例,并提供了详细的文件大小信息。
应用场景:
提供机构:
Polygl0t
相关数据集
J-CRe3
机器人交互
自然语言理解
J-CRe3是一个专为真实世界参考解析设计的日语对话数据集,由京都大学和RIKEN合作创建。该数据集包含93个视频和对话音频,记录了家庭环境中主人和助理机器人之间的真实对话,涉及大量物体操作任务。数据集通过众包方式收集对话场景,并由演员模拟对话录制。每个对话都与视频帧中的物体边界框进行了跨模态标注,包括直接和间接参考关系。J-CRe3旨在解决机器人与人类在真实环境中交互时的理解问题,特别是在处理零
arXiv
2024-03-28 更新
34
0
IGLU
自然语言处理
自然语言理解
IGLU是为交互式扎根语言理解而设计的数据集。它总共有8,136个单回合数据对的指令和操作。每个样本都使用先前收集的多回合交互数据中的预构建结构随机初始化。
OpenDataLab
2026-07-12 更新
23
0
indonlu
自然语言理解
NLU基准资源
IndoNLU 是一套用于训练、评估和分析印尼语自然语言理解系统的基准资源集合。它包含12个印尼语自然语言理解数据集,涵盖情感分类、方面情感分析、文本蕴含、词性标注、关键词提取、命名实体识别和问答等多种任务。这些数据集的规模从几百到上万不等,标注信息由专家生成,并采用MIT许可协议。IndoNLU 为印尼语自然语言处理任务提供了标准化的数据操作。
OpenCSG
2024-07-19 更新
12
0
SEACrowd/mabl
比喻语言
多语言问答
MABL(跨边界和语言的隐喻)数据集是一个包含6,366个来自七种语言的比喻性语言表达的集合,旨在提高多语言模型对比喻性语言及其语言变体的理解。该数据集通过众包方式由母语者生成,生成了以相同词开头但意义不同的成对隐喻,以及这两个短语的字面解释。每个表达都经过流利说话者的检查,以确保其清晰、适当并符合格式要求,未达到这些标准的表达被丢弃。
Hugging Face
2024-06-24 更新
33
0
基于维基结构信息构造的大规模多语言指令微调数据
自然语言处理
自然语言理解
mWiki-Instruct通过维基中的结构化信息构造了基于分类和抽取的多语言指令微调数据。该数据在语言分布上相比于现有指令微调数据更加均衡
魔搭社区
2026-07-04 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广