登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
TOFU-SFT/NuminaMath-CoT-100k
TOFU-SFT/NuminaMath-CoT-100k
收藏
Hugging Face
2026-04-29 更新
2026-05-03 收录
数学推理
数据链接:
https://hf-mirror.com/datasets/TOFU-SFT/NuminaMath-CoT-100k
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
应用场景:
提供机构:
TOFU-SFT
相关数据集
VCBench
数学推理
感知信息处理
VCBench是一个用于评估多模态数学推理能力的综合基准数据集,专注于评估模型解决小学数学问题的能力,这些问题依赖于明确的视觉依赖关系。数据集包含1720个问题,跨越六个认知领域,并配以6697张图片,平均每个问题包含3.9张图片。该数据集的创建过程严格筛选并翻译了中国小学数学教科书中的问题,确保每个问题都具有独特且明确的答案。VCBench旨在解决当前基准测试中缺乏对视觉-数学推理能力的充分评估
arXiv
2025-04-24 更新
33
0
mlfoundations-dev/a1_math_natural_reasoning
数学推理
自然语言处理
这是一个包含指令种子(instruction_seed)、参考答案(reference_answer)、多个响应(responses)、推理过程(reasoning)、deepseek解决方案(deepseek_solution)、原始行索引(__original_row_idx)、最终推理轨迹(final_reasoning_trace)和对话(conversations)等字段的数据集。数据集
Hugging Face
2025-04-10 更新
14
0
math-reasoning-dataset
数学推理
机器学习
该数据集包含了三个字段:prompt(提示)、solution(解决方案)和gold_reasoning(黄金推理)。它被划分为训练集和测试集,训练集有50个示例,测试集有200个示例。
Hugging Face
2025-06-01 更新
11
0
open-deepscaler
数学推理
机器学习
open-deepscaler数据集包含来自DeepScaleR数据集的21044个具有挑战性的数学推理问题,用于支持Open RS项目,通过强化学习增强小型语言模型的推理能力。
Hugging Face
2025-03-21 更新
14
0
MATH()
数学推理
语言模型评估
MATH()是由Consequent AI创建的一个数据集,旨在通过功能化的基准测试来评估语言模型的推理能力。该数据集包含5000个问题,目前已有41.2%的问题被转化为功能化形式,以测试模型在未见过的问题上的表现。数据集的访问地址为https://github.com/consequentai/fneval/,用户可以获取到最新的数据集快照和评估代码。MATH()数据集的应用领域主要集中在提高大
arXiv
2024-03-01 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广