登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
InternScience/SciEvalKit-Internal
InternScience/SciEvalKit-Internal
收藏
Hugging Face
2025-12-17 更新
2025-12-20 收录
数据链接:
https://hf-mirror.com/datasets/InternScience/SciEvalKit-Internal
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
许可证:Apache许可证2.0版(Apache License 2.0)
应用场景:
提供机构:
InternScience
相关数据集
InternScience/SGI-IdeaGeneration-Lite
科学想法生成
科学通用智能评估
--- dataset_info: features: - name: idx dtype: string - name: question dtype: string - name: related_work dtype: string - name: challenge dtype: string - name: limitation
Hugging Face
2026-03-25 更新
14
0
InternScience/MME-Reasoning
多模态逻辑推理评估
视觉问答基准
--- task_categories: - visual-question-answering language: - en pretty_name: i size_categories: - 1K<n<10K --- # MME-Reasoning 🔥: A Comprehensive Benchmark for Logical Reasoning in MLLMs ![Multimoda
Hugging Face
2025-06-13 更新
10
0
InternScience/SGI-WetExperiment
湿实验
实验室协议
SGI-Bench数据集旨在通过科学家对齐的工作流程评估大型语言模型(LLMs)的科学通用智能(SGI)。该数据集涵盖10个学科,包含1000多个由专家精心策划的样本,灵感来源于《科学》杂志的125个重大问题。数据集包括四个主要任务家族:科学深度研究、创意生成、干/湿实验和多模态实验推理。数据集的结构旨在评估科学研究的完整探究周期,包括审议、构思、行动和感知。README还详细介绍了数据集的构建、
Hugging Face
2025-12-30 更新
8
0
InternScience/SGI-Reasoning
科学推理
多模态
SGI-Bench数据集旨在通过科学家对齐的工作流程评估大型语言模型(LLMs)的科学通用智能(SGI)。该数据集涵盖10个学科,包含超过1,000个由专家策划的样本,灵感来源于《科学》杂志的125个重大问题。数据集包含多模态和推理任务,覆盖科学探究的多个方面,如深思熟虑、构思、行动和感知。数据集分为不同任务,并包含一个可定制的代理评估框架和多种指标。README还详细介绍了数据集的特征、分割、使
Hugging Face
2025-12-30 更新
13
0
InternScience/SGI-DryExperiment
科学通用智能
代码生成
SGI-Bench是一个用于评估科学通用智能(SGI)的数据集,涵盖了科学探究的完整循环:思考、构思、行动和感知。该数据集跨越10个学科,包含超过1,000个专家策划的样本,灵感来源于《科学》杂志的125个重大问题。数据集包括科学深度研究、想法生成、干/湿实验和多模态实验推理等任务。数据集通过专家评审和数据清理确保高质量和挑战性。
Hugging Face
2025-12-30 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广