haoranli-ml/genvf-filtered-proof-graded_score7_only_test
收藏资源简介:
--- dataset_info: features: - name: index dtype: int64 - name: row_id dtype: int64 - name: problem dtype: string - name: answer dtype: 'null' - name: source list: string - name: mean_reward dtype: float64 - name: full_response dtype: string - name: full_reasoning dtype: string - name: model dtype: string - name: prefix dtype: string - name: prefix_end_index dtype: int64 - name: num_thoughts dtype: int64 - name: prefix_type dtype: string - name: prefix_type_description dtype: string - name: suffix_num list: int64 - name: suffix_model list: string - name: pending list: bool - name: pending_model list: 'null' - name: suffix_response list: string - name: suffix_summary list: string - name: self_summary list: string - name: suffix_reasoning list: 'null' - name: finish_reason list: string - name: budget_used list: int64 - name: escalation list: int64 - name: usage list: - name: completion_tokens dtype: int64 - name: prompt_tokens dtype: int64 - name: total_tokens dtype: int64 - name: error list: 'null' - name: error_type list: 'null' - name: prefix_model dtype: string - name: gemini_summary_of_future dtype: string - name: gemini_summary_list list: string - name: prefix_steps list: string - name: suffix_variants list: - name: detailed_steps list: string - name: high_level_steps list: string - name: id dtype: int64 - name: dedup_note dtype: string - name: cross_prefix_alignment_scores list: - name: avg_alignment dtype: float64 - name: individual_scores list: - name: compared_row_id dtype: int64 - name: compared_summary_id dtype: int64 - name: direction dtype: string - name: output_text dtype: string - name: problem_index dtype: int64 - name: reasoning dtype: string - name: score dtype: float64 - name: num_comparisons dtype: int64 - name: summary_id dtype: int64 - name: filtered_suffix list: - name: detailed_steps list: string - name: high_level_steps list: string - name: id dtype: int64 - name: rubrics dtype: string - name: prefix_summary_steps dtype: string - name: filtered_suffix_summary_steps list: string - name: input_to_VF dtype: string - name: proof_scores list: - name: points dtype: int64 - name: suffix_id dtype: int64 - name: proof_details list: - name: assessment dtype: string - name: errors dtype: string - name: suffix_id dtype: int64 splits: - name: train num_bytes: 7349052 num_examples: 26 download_size: 5859927 dataset_size: 7349052 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征: - 名称:索引,数据类型:64位整数 - 名称:行ID,数据类型:64位整数 - 名称:问题,数据类型:字符串 - 名称:答案,数据类型:空类型 - 名称:来源,数据类型:字符串列表 - 名称:平均奖励,数据类型:64位浮点数 - 名称:完整响应,数据类型:字符串 - 名称:完整推理过程,数据类型:字符串 - 名称:模型,数据类型:字符串 - 名称:前缀,数据类型:字符串 - 名称:前缀结束索引,数据类型:64位整数 - 名称:思维数量,数据类型:64位整数 - 名称:前缀类型,数据类型:字符串 - 名称:前缀类型描述,数据类型:字符串 - 名称:后缀数量,数据类型:64位整数列表 - 名称:后缀模型,数据类型:字符串列表 - 名称:待处理状态,数据类型:布尔值列表 - 名称:待处理模型,数据类型:空列表 - 名称:后缀响应,数据类型:字符串列表 - 名称:后缀摘要,数据类型:字符串列表 - 名称:自我摘要,数据类型:字符串列表 - 名称:后缀推理过程,数据类型:空列表 - 名称:终止原因,数据类型:字符串列表 - 名称:已使用预算,数据类型:64位整数列表 - 名称:升级次数,数据类型:64位整数列表 - 名称:用量: - 名称:补全令牌数,数据类型:64位整数 - 名称:提示令牌数,数据类型:64位整数 - 名称:总令牌数,数据类型:64位整数 - 名称:错误信息,数据类型:空列表 - 名称:错误类型,数据类型:空列表 - 名称:前缀模型,数据类型:字符串 - 名称:Gemini未来摘要,数据类型:字符串 - 名称:Gemini摘要列表,数据类型:字符串列表 - 名称:前缀步骤,数据类型:字符串列表 - 名称:后缀变体: - 名称:详细步骤,数据类型:字符串列表 - 名称:高层步骤,数据类型:字符串列表 - 名称:ID,数据类型:64位整数 - 名称:去重备注,数据类型:字符串 - 名称:跨前缀对齐分数: - 名称:平均对齐度,数据类型:64位浮点数 - 名称:单项分数: - 名称:对比行ID,数据类型:64位整数 - 名称:对比摘要ID,数据类型:64位整数 - 名称:方向,数据类型:字符串 - 名称:输出文本,数据类型:字符串 - 名称:问题索引,数据类型:64位整数 - 名称:推理过程,数据类型:字符串 - 名称:分数,数据类型:64位浮点数 - 名称:对比次数,数据类型:64位整数 - 名称:摘要ID,数据类型:64位整数 - 名称:过滤后后缀: - 名称:详细步骤,数据类型:字符串列表 - 名称:高层步骤,数据类型:字符串列表 - 名称:ID,数据类型:64位整数 - 名称:评分标准,数据类型:字符串 - 名称:前缀摘要步骤,数据类型:字符串 - 名称:过滤后后缀摘要步骤,数据类型:字符串列表 - 名称:VF输入,数据类型:字符串 - 名称:证明分数: - 名称:得分点数,数据类型:64位整数 - 名称:后缀ID,数据类型:64位整数 - 名称:证明详情: - 名称:评估结果,数据类型:字符串 - 名称:错误信息,数据类型:字符串 - 名称:后缀ID,数据类型:64位整数 拆分: - 名称:训练集,字节大小:7349052,示例数量:26 下载大小:5859927 数据集总大小:7349052 配置: - 配置名称:默认配置,数据文件: - 拆分:训练集,路径:data/train-*




