SEACrowd/okapi_m_mmlu
收藏资源简介:
Okapi M Mmlu数据集是MMLU(大规模多任务语言理解)的多语言翻译版本,源自论文《Measuring Massive Multitask Language Understanding》(Hendrycks et al., 2021)。MMLU是一个包含来自多个知识领域的多项选择题的大规模多任务测试,涵盖人文学科、社会科学、硬科学等领域,共包含57个任务,如基础数学、美国历史、计算机科学、法律等。要在该测试中取得高准确率,模型需要具备广泛的世界知识和问题解决能力。该数据集支持印度尼西亚语(ind)和越南语(vie),主要任务为问答任务。数据集的使用方法包括使用`datasets`库和`seacrowd`库进行加载。数据集的版本信息包括源版本1.0.0和SEACrowd版本2024.06.20,许可证为Creative Commons Attribution Non Commercial 4.0 (cc-by-nc-4.0)。
The Okapi M Mmlu dataset is a multilingual translation of MMLU (Massive Multitask Language Understanding) from the paper Measuring Massive Multitask Language Understanding (Hendrycks et al., 2021). MMLU is a massive multitask test consisting of multiple-choice questions from various branches of knowledge, spanning subjects in the humanities, social sciences, hard sciences, and other areas, covering 57 tasks including elementary mathematics, US history, computer science, law, and more. To attain high accuracy on this test, models must possess extensive world knowledge and problem-solving ability. The dataset supports Indonesian (ind) and Vietnamese (vie) languages, with the primary task being question answering. The dataset can be loaded using the `datasets` library and the `seacrowd` library. The dataset version includes the source version 1.0.0 and the SEACrowd version 2024.06.20, licensed under Creative Commons Attribution Non Commercial 4.0 (cc-by-nc-4.0).
Okapi M Mmlu 数据集概述
数据集简介
mMMLU 是 MMLU 的多语言翻译版本,源自论文 "Measuring Massive Multitask Language Understanding" (Hendrycks et al., 2021)。MMLU 是一个大规模的多任务测试,包含来自各个知识分支的多项选择题。测试涵盖人文、社会科学、自然科学及其他重要学习领域。MMLU 包含 57 个任务,包括初等数学、美国历史、计算机科学、法律等。
语言
- 印尼语 (ind)
- 越南语 (vie)
支持的任务
- 问答 (Question Answering)
数据集使用
使用 datasets 库
python from datasets import load_dataset dset = datasets.load_dataset("SEACrowd/okapi_m_mmlu", trust_remote_code=True)
使用 seacrowd 库
python import seacrowd as sc
使用默认配置加载数据集
dset = sc.load_dataset("okapi_m_mmlu", schema="seacrowd")
查看数据集的所有可用子集(配置名称)
print(sc.available_config_names("okapi_m_mmlu"))
使用特定配置加载数据集
dset = sc.load_dataset_by_config_name(config_name="<config_name>")
数据集版本
- 源版本: 1.0.0
- SEACrowd 版本: 2024.06.20
数据集许可证
Creative Commons Attribution Non Commercial 4.0 (cc-by-nc-4.0)
引用
plaintext @article{dac2023okapi, title={Okapi: Instruction-tuned Large Language Models in Multiple Languages with Reinforcement Learning from Human Feedback}, author={Dac Lai, Viet and Van Nguyen, Chien and Ngo, Nghia Trung and Nguyen, Thuat and Dernoncourt, Franck and Rossi, Ryan A and Nguyen, Thien Huu}, journal={arXiv e-prints}, pages={arXiv--2307}, year={2023} }
@article{hendryckstest2021, title={Measuring Massive Multitask Language Understanding}, author={Dan Hendrycks and Collin Burns and Steven Basart and Andy Zou and Mantas Mazeika and Dawn Song and Jacob Steinhardt}, journal={Proceedings of the International Conference on Learning Representations (ICLR)}, year={2021} }
@article{lovenia2024seacrowd, title={SEACrowd: A Multilingual Multimodal Data Hub and Benchmark Suite for Southeast Asian Languages}, author={Holy Lovenia and Rahmad Mahendra and Salsabil Maulana Akbar and Lester James V. Miranda and Jennifer Santoso and Elyanah Aco and Akhdan Fadhilah and Jonibek Mansurov and Joseph Marvin Imperial and Onno P. Kampman and Joel Ruben Antony Moniz and Muhammad Ravi Shulthan Habibi and Frederikus Hudi and Railey Montalan and Ryan Ignatius and Joanito Agili Lopo and William Nixon and Börje F. Karlsson and James Jaya and Ryandito Diandaru and Yuze Gao and Patrick Amadeus and Bin Wang and Jan Christian Blaise Cruz and Chenxi Whitehouse and Ivan Halim Parmonangan and Maria Khelli and Wenyu Zhang and Lucky Susanto and Reynard Adha Ryanda and Sonny Lazuardi Hermawan and Dan John Velasco and Muhammad Dehan Al Kautsar and Willy Fitra Hendria and Yasmin Moslem and Noah Flynn and Muhammad Farid Adilazuarda and Haochen Li and Johanes Lee and R. Damanhuri and Shuo Sun and Muhammad Reza Qorib and Amirbek Djanibekov and Wei Qi Leong and Quyet V. Do and Niklas Muennighoff and Tanrada Pansuwan and Ilham Firdausi Putra and Yan Xu and Ngee Chia Tai and Ayu Purwarianti and Sebastian Ruder and William Tjhi and Peerat Limkonchotiwat and Alham Fikri Aji and Sedrick Keh and Genta Indra Winata and Ruochen Zhang and Fajri Koto and Zheng-Xin Yong and Samuel Cahyawijaya}, year={2024}, eprint={2406.10118}, journal={arXiv preprint arXiv: 2406.10118} }




