数据链接:
官方服务:
资源简介:
ChatGPT Database comparison (students vs ChatGPT summary)
应用场景:
创建时间:
2023-06-09
相关数据集
CLIcK 韩语文化与语言智能数据集
CLIcK 数据集由韩国科学技术院创建,旨在填补韩语大模型在文化与语言知识评估方面的空白。该数据集包含 1995 对问答样本,源自官方韩国考试与教科书,覆盖语言和文化两大类,细分为 11 个子类别,每个样本都提供了细粒度的注释,指明回答问题所需的文化和语言知识。
超神经2024-03-29 更新280
orai-nlp/EHQA
EHQA是一个包含1500个多项选择题的数据集,旨在评估关于巴斯克地区的事实知识。问题基于巴斯克维基百科的文章生成,并通过Elia翻译和GPT-4 Turbo生成问题。数据集的结构为JSON格式,每个问题包含问题、答案、选项、ID和源文档URL。数据集在性别和地理来源上进行了平衡,并进行了多项实验以评估大型语言模型对巴斯克文化的适应性。
Hugging Face2024-07-10 更新120
OALL/details_airev-ai__Amal-70b-v1.1
--- pretty_name: Evaluation run of airev-ai/Amal-70b-v1.1 dataset_summary: "Dataset automatically created during the evaluation run of model\ \ [airev-ai/Amal-70b-v1.1](https://huggingface.co/airev-
Hugging Face2024-08-07 更新80
TimelyEventsBenchmark/TiEBe
TiEBe(及时事件基准)数据集旨在评估大型语言模型(LLM)在事实回忆和区域知识表现方面的能力,涉及全球和区域重要事件。该数据集包含超过11000个从2015年至2024年的回顾性维基百科页面及其引用中提取的问题-答案对,覆盖了六个地理区域(世界、美国、巴西、中国、葡萄牙和法国)。
Hugging Face2025-05-16 更新120
Development and evaluation of the knowledge about evolution 2.0 instrument (KAEVO 2.0)
In evolution education, misconceptions about evolutionary concepts impact students’ learning. Much research exists on assessing knowledge about evolution using different instruments. The current artic
DataCite Commons2020-12-02 更新110



