suryaat19/Multilingual_gpqa
收藏资源简介:
该数据集是一个多语言多项选择题数据集,包含17种语言:俄语、简体中文、日语、泰语、斯瓦希里语、孟加拉语、泰卢固语、英语、法语、德语、西班牙语、阿拉伯语、韩语、塞尔维亚语、匈牙利语、越南语和捷克语。每种语言都有198个示例,总计约3366个示例。每个示例包含一个问题和四个答案选项:一个正确答案和三个错误答案,用于评估模型在知识问答或推理任务中的性能。数据集可能旨在支持跨语言自然语言处理研究,如多语言问答系统或模型泛化能力测试。
This dataset is a multilingual multiple-choice question dataset covering 17 languages: Russian, Simplified Chinese, Japanese, Thai, Swahili, Bengali, Telugu, English, French, German, Spanish, Arabic, Korean, Serbian, Hungarian, Vietnamese, and Czech. Each language contains 198 examples, totaling approximately 3,366 examples. Each example consists of a question and four answer options: one correct answer and three incorrect answers, designed to evaluate model performance in knowledge-based or reasoning tasks. The dataset likely aims to support cross-lingual natural language processing research, such as multilingual question answering systems or model generalization testing.



