登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
TinyGPT-Test
TinyGPT-Test
收藏
kaggle
2025-10-26 更新
2025-12-06 收录
指令微调
语言模型评估
数据链接:
https://www.kaggle.com/datasets/antonintomecek/tinygpt-test
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Instruction based Dataset
基于指令的数据集(Instruction based Dataset)
应用场景:
创建时间:
2025-10-26
相关数据集
Flan V2
指令微调
多任务指令
Flan Collection 将 Flan 2021、P3、Super-Natural Instructions 的数据集以及数十个数据集编译到一个地方,将它们格式化为零样本、少样本和思维链模板的混合体,然后将它们混合在 正如 Scaling Flan 论文和 Flan Collection 论文中针对 Flan-T5 和 Flan-PaLM 所报告的那样,发现在保留的评估基准上取得了很好结果的
OpenXLab
5
0
atreydesai/augmented-mcqa-gpt-choices-only
多项选择
语言模型评估
--- dataset_info: - config_name: vllm_Qwen_Qwen3-4B-Instruct-2507 features: - name: id dtype: string - name: question_id dtype: int64 - name: dataset_type dtype: string - name: r
Hugging Face
2026-04-03 更新
3
0
sapiens-technology/global_mmlu_lite
语言模型评估
多领域推理
Global-MMLU Lite数据集是一个轻量级的基准测试,用于评估大型语言模型在多个领域的表现。它是Global Massive Multitask Language Understanding (MMLU)基准的一个精选子集,旨在减少计算开销,同时保持多样性和严谨性。该数据集包含跨多个学术和专业领域的多项选择题问答任务,采用简单的JSON结构,便于集成。其广泛的领域覆盖包括科学、数学、历史、
Hugging Face
2026-05-01 更新
2
0
miladalsh/docent-val-Qwen3-VL-8B-Instruct-bbox-w-text_no_ref
细粒度图像编辑
语言模型评估
--- dataset_info: features: - name: uuid dtype: string - name: step dtype: int64 - name: items list: string - name: segment_ids list: int64 - name: segment_positions li
Hugging Face
2026-04-09 更新
4
0
ai-coscientist/researcher-ablation-judge-eval
科学实验消融规划
语言模型评估
该数据集旨在评估ResearcherAblationBench的评判框架,这是AblationBench评估套件的一部分,用于评估LMs在消元计划中的表现。数据集的语言为英语。
Hugging Face
2025-05-15 更新
3
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广