zvzv1919/proposer_test_200-400-gemini
收藏资源简介:
--- dataset_info: features: - name: instance_id dtype: string - name: line_numbers dtype: string - name: chunk_content dtype: string - name: is_valid_chunk dtype: bool - name: problem_statement dtype: string - name: gold_reasoning dtype: string - name: gold_files dtype: string - name: gold_functions dtype: string - name: pred_file dtype: string - name: pred_func dtype: string - name: file_match dtype: bool - name: function_match dtype: bool - name: reasoning dtype: string - name: num_turns dtype: int64 - name: total_cost_usd dtype: 'null' - name: usage dtype: 'null' - name: is_catalog_issue dtype: bool - name: diagnosis dtype: string - name: proposed_filepath dtype: string - name: proposed_change dtype: string - name: md_files_provided dtype: string splits: - name: train num_bytes: 523487 num_examples: 81 download_size: 276609 dataset_size: 523487 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 名称:实例ID(instance_id),数据类型:字符串 - 名称:行号(line_numbers),数据类型:字符串 - 名称:分块内容(chunk_content),数据类型:字符串 - 名称:有效分块标记(is_valid_chunk),数据类型:布尔型 - 名称:问题描述(problem_statement),数据类型:字符串 - 名称:标准答案推理过程(gold_reasoning),数据类型:字符串 - 名称:标准答案文件(gold_files),数据类型:字符串 - 名称:标准答案函数(gold_functions),数据类型:字符串 - 名称:预测文件(pred_file),数据类型:字符串 - 名称:预测函数(pred_func),数据类型:字符串 - 名称:文件匹配标记(file_match),数据类型:布尔型 - 名称:函数匹配标记(function_match),数据类型:布尔型 - 名称:推理过程(reasoning),数据类型:字符串 - 名称:交互轮次(num_turns),数据类型:64位整型 - 名称:美元总花费(total_cost_usd),数据类型:空值 - 名称:使用情况(usage),数据类型:空值 - 名称:目录问题标记(is_catalog_issue),数据类型:布尔型 - 名称:诊断结果(diagnosis),数据类型:字符串 - 名称:建议文件路径(proposed_filepath),数据类型:字符串 - 名称:建议修改内容(proposed_change),数据类型:字符串 - 名称:提供的Markdown文件(md_files_provided),数据类型:字符串 数据集划分: - 划分名称:训练集(train),字节量:523487,样本数量:81 下载大小:276609 数据集总大小:523487 配置项: - 配置名称:默认配置(default),数据文件: - 划分:训练集(train),文件路径:data/train-*




