nandansarkar/evalset_f912
收藏资源简介:
--- dataset_info: features: - name: context list: - name: content dtype: string - name: role dtype: string - name: gen_kwargs struct: - name: do_sample dtype: bool - name: max_new_tokens dtype: int64 - name: seed dtype: int64 - name: temperature dtype: float64 - name: repeat_idx dtype: int64 - name: request_idx dtype: int64 - name: task_name dtype: string - name: metadata struct: - name: expected_answer dtype: string - name: problem_id dtype: string - name: reference_solution dtype: string splits: - name: train num_bytes: 845204 num_examples: 990 download_size: 81875 dataset_size: 845204 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 上下文(context):列表型字段,包含以下子字段: - 内容(content):数据类型为字符串 - 角色(role):数据类型为字符串 - 生成参数字段(gen_kwargs):结构体型字段,包含以下子字段: - 是否采样(do_sample):数据类型为布尔值 - 最大新生成词元 (Token)(max_new_tokens):数据类型为64位整数 - 随机种子(seed):数据类型为64位整数 - 温度系数(temperature):数据类型为64位浮点数 - 重复索引(repeat_idx):数据类型为64位整数 - 请求索引(request_idx):数据类型为64位整数 - 任务名称(task_name):数据类型为字符串 - 元数据(metadata):结构体型字段,包含以下子字段: - 预期答案(expected_answer):数据类型为字符串 - 问题ID(problem_id):数据类型为字符串 - 参考解法(reference_solution):数据类型为字符串 数据集划分: - 训练集(train):字节数为845204,样本数量为990 下载大小:81875 数据集总大小:845204 配置项: - 配置名称:default(默认配置) 数据文件: - 划分集:train(训练集) 路径:data/train-*



