登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Testing Data - Clinical Reasoning Skills
Testing Data - Clinical Reasoning Skills
收藏
Figshare
2023-01-16 更新
2026-04-08 收录
推理评估
医学教育测试
数据链接:
https://figshare.com/articles/dataset/Testing_Data_-_Clinical_Reasoning_Skills/21905220/1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Data of clinical reasoning skills course testing
应用场景:
提供机构:
Fässler, Christian
创建时间:
2023-01-16
相关数据集
EleutherAI/quirky_squaring_increment0_bob_easy
逻辑推理问答
推理评估
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: test path: data/test-* dataset_info: featur
Hugging Face
2024-01-11 更新
16
0
RMSteering/ai2_arc
推理评估
抽象推理
--- dataset_info: - config_name: ARC-Challenge features: - name: id dtype: string - name: question dtype: string - name: choices struct: - name: label sequence: string
Hugging Face
2026-03-20 更新
12
0
EntropyMath-Gen-v1
推理评估
EntropyMath-Generated-v1是一个经过质量控制的、声明唯一的生成式数学推理评估数据集。该数据集包含934个问题,每个问题均配有声明、答案、解决方案、用于一致性验证的`verification_code`字段、谱系和来源元数据以及内容哈希值。数据集来源于EntropyMath生成框架,经过自动化质量门控和人工专家验证,确保了内容的独特性和质量。数据集的构建过程包括从生成运行中导出
Hugging Face
2026-05-05 更新
10
0
v6
数学问题求解
推理评估
该数据集涉及两个数学问题集:MATH100用作源材料,由Qwen3-30B-A3B-Thinking模型处理生成150个思维链(CoTs),输出保存为raw_cots.jsonl文件;AIME 2025包含15个问题,用作评估推理时激活控制技术的测试集。README未提供数据集的背景、具体内容、规模或字段结构描述,仅作为项目工作流程的输入和输出文件。
Hugging Face
2026-05-14 更新
12
0
pkuHaowei/kumo-easy
视觉语言模型
推理评估
KUMO是一个评估大型语言模型复杂推理能力的基准测试数据集,通过程序生成的推理游戏进行。数据集包含五个环境:MedicalEnv、EducationEnv、MusicEnv、FantasyEnv和ChemicalEnv,每个环境有50个示例。还包括100个自动生成的示例领域,涉及计算机科学、生物学、艺术等多个类别,每个领域包含约50个真相和30个动作。
Hugging Face
2025-04-10 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广