JingweiNi/ocr2_k2_lowmed_sample500_qwen35_fp8_step1k_seed20260527
收藏资源简介:
--- dataset_info: features: - name: candidate_id dtype: string - name: source_hf_repo dtype: string - name: reasoning_effort dtype: string - name: row_idx dtype: int64 - name: step_idx dtype: int64 - name: question dtype: string - name: answer dtype: string - name: reply dtype: string - name: prior_steps dtype: string - name: steps_so_far dtype: string - name: latest_step dtype: string - name: claim_sentence dtype: string - name: claim_text dtype: string - name: aligned_token_ids list: int64 - name: verified dtype: float64 - name: is_error dtype: bool - name: valid_step_position dtype: int64 - name: valid_step_count dtype: int64 - name: step_relative_position dtype: float64 - name: step_position_decile dtype: int64 - name: problem_source_dataset dtype: string - name: question_id dtype: string - name: ocr2_id dtype: string - name: language_split dtype: string - name: source_split dtype: string - name: source_platform dtype: string - name: difficulty dtype: string - name: judgement dtype: string - name: pass_rate dtype: string - name: source_index dtype: string - name: sample_idx dtype: int64 - name: original_index dtype: int64 - name: sample_id dtype: int64 - name: sample_seed dtype: int64 splits: - name: train num_bytes: 65480374 num_examples: 1000 download_size: 31530058 dataset_size: 65480374 configs: - config_name: default data_files: - split: train path: data/train-* ---




