curriculum_1_compare_count_drawing_4000
收藏资源简介:
该数据集包含多个字段,如数据来源(data_source)、提示(prompt)、图片(images)、能力(ability)、环境名称(env_name)、奖励模型(reward_model)和额外信息(extra_info)。其中,提示(prompt)包含内容(content)和角色(role);额外信息(extra_info)包含答案(answer)、比较类型(comparison_type)、数量(count)、训练阶段(curriculum_stage)、真实点数(ground_truth_points)、索引(index)、原始问题(original_question)、坐标点(point_coordinates)、问题(question)、参考点(reference_point)和单位步长(x_unit_step, y_unit_step)。数据集分为训练集(train),包含4000个示例,大小为86242522字节。
本数据集包含多类字段,具体包括数据来源(data_source)、提示(prompt)、图片(images)、能力(ability)、环境名称(env_name)、奖励模型(reward_model)以及额外信息(extra_info)。其中,提示(prompt)包含内容(content)与角色(role);额外信息(extra_info)则涵盖答案(answer)、比较类型(comparison_type)、数量(count)、训练阶段(curriculum_stage)、真实点数(ground_truth_points)、索引(index)、原始问题(original_question)、坐标点(point_coordinates)、问题(question)、参考点(reference_point)以及单位步长(x_unit_step, y_unit_step)。本数据集划分为训练集(train),共计包含4000条示例,数据总大小为86242522字节。
数据集概述
基本信息
- 数据集名称: curriculum_1_compare_count_drawing_4000
- 数据总量: 4000个样本
- 训练集大小: 86,242,522字节
- 下载大小: 74,868,257字节
数据结构
主要特征
- data_source: 字符串类型,表示数据来源
- prompt: 列表结构,包含内容(content)和角色(role)两个字符串字段
- images: 图像列表
- ability: 字符串类型,表示能力类型
- env_name: 字符串类型,表示环境名称
奖励模型特征
- reward_model: 结构体,包含:
- ground_truth: 字符串类型
- style: 字符串类型
额外信息特征
- extra_info: 结构体,包含多个字段:
- answer: 字符串类型
- comparison_type: 字符串类型
- count: 整数类型(int64)
- curriculum_stage: 整数类型(int64)
- ground_truth_points: 字符串类型
- index: 字符串类型
- original_question: 字符串类型
- point_coordinates: 字符串类型
- question: 字符串类型
- reference_point: 字符串类型
- reference_x: 浮点数类型(float64)
- reference_y: 浮点数类型(float64)
- split: 空值类型
- x_unit_step: 浮点数类型(float64)
- y_unit_step: 浮点数类型(float64)
数据配置
- 配置名称: default
- 数据文件:
- 分割类型: train
- 文件路径: data/train-*




