dev_set_v2_a3_rl_DCAgent_selfinstruct_naive_sandboxes_2_verified_70_8B_20260825_134035
收藏资源简介:
该数据集包含5003个训练样本,每个样本存储在一系列字段中。核心字段为conversations,它是一个列表,每个元素包含对话角色(role)和内容(content)。此外,每条记录还提供了代理名称(agent)、模型名称(model)及其提供商(model_provider)、日期(date)、任务描述(task)、回合标识(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。数据整体以JSON格式组织,文件大小约343MB。
This dataset contains 5003 training samples, each stored in a series of fields. The core field is conversations, which is a list, each element containing the dialogue role and content. Additionally, each record provides the agent name, model name and its provider, date, task description, episode identifier, run ID, trial name, result, verifier output, and trace source. The data is organized in JSON format, with a file size of approximately 343MB.
数据集概述
该数据集名为 laion/dev_set_v2_a3_rl_DCAgent_selfinstruct_naive_sandboxes_2_verified_70_8B_20260825_134035,由 LAION 组织发布,是一个面向智能体(Agent)训练与评估的开发集(dev set),包含 5,003 条训练样本,总数据集大小约为 343.94 MB。
数据内容与格式
- 核心字段:每条样本包含多轮对话历史(
conversations,由role和content组成)、智能体标识(agent)、模型名称(model)、模型提供方(model_provider)、日期(date)、任务描述(task)、回合编号(episode)、运行 ID(run_id)、试验名称(trial_name)、执行结果(result)、验证器输出(verifier_output)以及轨迹来源(trace_source)。 - 数据用途:适用于强化学习、指令微调、智能体行为分析等场景,尤其侧重于自我指令(self-instruct)在沙盒环境中的任务执行与验证。
数据划分
- 训练集(train):共 5,003 条样本,文件存储于
data/train-*路径下,总字节数为 343,940,365。 - 下载大小:约 305.69 MB。
数据特征
- 对话记录采用角色-内容交替结构,便于直接用于序列建模或 RL 训练。
- 每条样本附带详细的元数据(如模型、运行标识、验证输出),支持可追溯的实验分析与结果复现。




