RSR_data
收藏资源简介:
该数据集伴随论文《哪些推理轨迹能更好地教会学生推理?一种信息对齐的简单度量》发布,旨在研究推理蒸馏中的数据-学生适用性,并引入了Rank-Surprisal Ratio (RSR)这一简单有效的度量标准。数据集包含33个JSON文件,每个文件包含5000条数学问题的推理轨迹,由11个教师模型生成(每个模型对应3个数据集)。每条数据以消息列表形式存储,包含系统、用户和助理角色的对话内容。适用于推理蒸馏和相关教育技术研究。
This dataset is released alongside the paper *Which Reasoning Trajectories Better Teach Students to Reason? A Simple Metric for Information Alignment*, which aims to investigate data-student suitability in reasoning distillation and introduces Rank-Surprisal Ratio (RSR), a simple yet effective metric. The dataset comprises 33 JSON files, each holding 5000 reasoning trajectories of mathematical problems generated by 11 teacher models, with each model corresponding to 3 datasets. Each data entry is stored as a message list containing dialogue content with system, user, and assistant roles. It is applicable to research on reasoning distillation and related educational technologies.




