haoranli-ml/genvf-multi-policy-train-v1_final_bulle_list_final_filtered
收藏资源简介:
--- dataset_info: features: - name: index dtype: int64 - name: row_id dtype: int64 - name: problem dtype: string - name: answer dtype: string - name: source list: string - name: mean_reward dtype: float64 - name: full_response dtype: string - name: full_reasoning dtype: string - name: model dtype: string - name: prefix dtype: string - name: prefix_end_index dtype: int64 - name: num_thoughts dtype: int64 - name: prefix_type dtype: string - name: prefix_type_description dtype: string - name: suffix_num list: int64 - name: suffix_model list: string - name: pending list: bool - name: pending_model list: 'null' - name: suffix_response list: string - name: suffix_summary list: string - name: self_summary list: string - name: suffix_reasoning list: string - name: finish_reason list: string - name: budget_used list: int64 - name: escalation list: int64 - name: usage list: - name: completion_tokens dtype: int64 - name: prompt_tokens dtype: int64 - name: total_tokens dtype: int64 - name: error list: 'null' - name: error_type list: 'null' - name: prefix_model dtype: string - name: gemini_summary_of_future dtype: string - name: gemini_summary_list list: string - name: prefix_steps list: string - name: suffix_variants list: - name: detailed_steps list: string - name: high_level_steps list: string - name: id dtype: int64 - name: dedup_note dtype: string - name: cross_prefix_alignment_scores list: - name: avg_alignment dtype: float64 - name: individual_scores list: - name: compared_row_id dtype: int64 - name: compared_summary_id dtype: int64 - name: direction dtype: string - name: output_text dtype: string - name: problem_index dtype: int64 - name: reasoning dtype: string - name: score dtype: float64 - name: num_comparisons dtype: int64 - name: summary_id dtype: int64 - name: filtered_suffix list: - name: detailed_steps list: string - name: high_level_steps list: string - name: id dtype: int64 - name: rubrics dtype: string splits: - name: train num_bytes: 3006081656 num_examples: 10520 download_size: 2474383139 dataset_size: 3006081656 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 字段名:index,数据类型:64位整数(int64) - 字段名:row_id,数据类型:64位整数(int64) - 字段名:problem,数据类型:问题文本(string) - 字段名:answer,数据类型:标准答案(string) - 字段名:source,数据类型:字符串列表(list<string>) - 字段名:mean_reward,数据类型:平均奖励得分(float64) - 字段名:full_response,数据类型:完整生成响应(string) - 字段名:full_reasoning,数据类型:完整推理过程(string) - 字段名:model,数据类型:使用模型(string) - 字段名:prefix,数据类型:前缀提示词(string) - 字段名:prefix_end_index,数据类型:前缀结束索引(int64) - 字段名:num_thoughts,数据类型:思考步数(int64) - 字段名:prefix_type,数据类型:前缀类型(string) - 字段名:prefix_type_description,数据类型:前缀类型描述(string) - 字段名:suffix_num,数据类型:后缀数量列表(list<int64>) - 字段名:suffix_model,数据类型:后缀生成模型列表(list<string>) - 字段名:pending,数据类型:待处理状态列表(list<bool>) - 字段名:pending_model,数据类型:待处理模型列表(list<null>) - 字段名:suffix_response,数据类型:后缀生成响应列表(list<string>) - 字段名:suffix_summary,数据类型:后缀摘要列表(list<string>) - 字段名:self_summary,数据类型:自身摘要列表(list<string>) - 字段名:suffix_reasoning,数据类型:后缀推理过程列表(list<string>) - 字段名:finish_reason,数据类型:生成结束原因列表(list<string>) - 字段名:budget_used,数据类型:已使用预算列表(list<int64>) - 字段名:escalation,数据类型:升级次数列表(list<int64>) - 字段名:usage,数据类型:令牌使用情况嵌套结构: - 字段名:completion_tokens,数据类型:补全令牌数(int64) - 字段名:prompt_tokens,数据类型:提示令牌数(int64) - 字段名:total_tokens,数据类型:总令牌数(int64) - 字段名:error,数据类型:错误信息列表(list<null>) - 字段名:error_type,数据类型:错误类型列表(list<null>) - 字段名:prefix_model,数据类型:前缀生成模型(string) - 字段名:gemini_summary_of_future,数据类型:未来摘要(Gemini生成)(string) - 字段名:gemini_summary_list,数据类型:Gemini生成摘要列表(list<string>) - 字段名:prefix_steps,数据类型:前缀步骤列表(list<string>) - 字段名:suffix_variants,数据类型:后缀变体嵌套结构: - 字段名:detailed_steps,数据类型:详细步骤列表(list<string>) - 字段名:high_level_steps,数据类型:高阶步骤列表(list<string>) - 字段名:id,数据类型:标识符(int64) - 字段名:dedup_note,数据类型:去重备注(string) - 字段名:cross_prefix_alignment_scores,数据类型:跨前缀对齐得分嵌套结构: - 字段名:avg_alignment,数据类型:平均对齐得分(float64) - 字段名:individual_scores,数据类型:单条对齐得分列表: - 字段名:compared_row_id,数据类型:对比行ID(int64) - 字段名:compared_summary_id,数据类型:对比摘要ID(int64) - 字段名:direction,数据类型:对齐方向(string) - 字段名:output_text,数据类型:输出文本(string) - 字段名:problem_index,数据类型:问题索引(int64) - 字段名:reasoning,数据类型:推理过程(string) - 字段名:score,数据类型:对齐得分(float64) - 字段名:num_comparisons,数据类型:对比次数(int64) - 字段名:summary_id,数据类型:摘要ID(int64) - 字段名:filtered_suffix,数据类型:过滤后后缀嵌套结构: - 字段名:detailed_steps,数据类型:详细步骤列表(list<string>) - 字段名:high_level_steps,数据类型:高阶步骤列表(list<string>) - 字段名:id,数据类型:标识符(int64) - 字段名:rubrics,数据类型:评判准则(string) 数据集划分: - 划分名称:train,字节占用:3006081656,样本数量:10520 下载大小:2474383139 数据集总大小:3006081656 配置项: - 配置名称:default,数据文件: - 划分集:train,路径:data/train-*



