JingweiNi/ocr2_k2_medium_sample500_qwen35_fp8_step1k_seed20260527
收藏资源简介:
该数据集是一个包含多步骤推理和验证任务的数据集,主要用于问题回答和推理过程分析。它包含1000个训练示例,每个示例具有多个特征字段,如候选ID、问题、答案、回复、推理努力程度、验证状态、错误标识、步骤位置信息等。数据来源于多个平台和数据集,支持多语言分割,并可能用于评估模型在复杂推理任务中的性能。特征如prior_steps、steps_so_far、latest_step表明涉及序列推理步骤,而claim_sentence、claim_text、aligned_token_ids可能用于文本对齐或验证。
This dataset is a multi-step reasoning and verification task dataset, primarily used for question answering and reasoning process analysis. It contains 1000 training examples, each with multiple feature fields such as candidate_id, question, answer, reply, reasoning_effort, verified, is_error, step position information, etc. The data is sourced from multiple platforms and datasets, supports multilingual splits, and may be used to evaluate model performance in complex reasoning tasks. Features like prior_steps, steps_so_far, latest_step indicate sequential reasoning steps, while claim_sentence, claim_text, aligned_token_ids may be used for text alignment or verification.




