dev_set_v2_a1_stack_go_20260811_103421
收藏资源简介:
该数据集包含多轮对话记录,每个对话由一系列消息组成,每条消息包含角色(role)和内容(content)。此外,每条记录还附带了与对话相关的元数据,包括使用的agent、模型名称、模型提供商、日期、任务类型、对话轮次(episode)、运行ID、试验名称、最终结果、验证器输出以及追踪来源(trace_source)。数据集共有6069个训练样本,总大小约为484MB。该数据集适用于训练和评估对话系统、agent行为分析、任务完成度评估以及模型验证等场景。
This dataset contains multi-turn dialogue records, each consisting of a series of messages, where each message includes a role and content. Additionally, each record is accompanied by metadata related to the conversation, including the agent used, model name, model provider, date, task type, dialogue episode, run ID, trial name, final result, validator output, and trace source. The dataset has a total of 6069 training samples, with a total size of approximately 484MB. It is suitable for training and evaluating dialogue systems, agent behavior analysis, task completion assessment, and model validation.
数据集概述:dev_set_v2_a1_stack_go_20260811_103421
该数据集由 LAION 发布,是一个用于训练和评估智能体(Agent)在 StackGo 环境中的多轮交互与任务执行能力的数据集。
核心信息
- 数据集名称:dev_set_v2_a1_stack_go_20260811_103421
- 发布机构:LAION
- 任务类型:基于智能体(Agent)的交互式任务数据集(涉及 StackGo 环境)
- 数据集规模:
- 总样本量:6,069 条
- 数据集总大小:484,031,599 字节(约 484 MB)
- 下载大小:422,770,125 字节(约 423 MB)
数据结构
数据集包含 13 个特征字段,具体如下:
| 字段名 | 数据类型 | 说明 |
|---|---|---|
conversations |
list(嵌套结构) | 多轮对话记录,包含 role(角色)与 content(内容),均为字符串类型 |
agent |
string | 智能体标识或配置信息 |
model |
string | 使用的模型名称 |
model_provider |
string | 模型提供商(如 OpenAI、Anthropic 等) |
date |
string | 数据产生日期 |
task |
string | 任务描述或任务 ID |
episode |
string | 回合编号(用于区分同一任务的不同执行轮次) |
run_id |
string | 运行标识 |
trial_name |
string | 试验名称 |
result |
string | 智能体任务的最终结果 |
verifier_output |
string | 验证器输出(用于结果校验) |
trace_source |
string | 溯源数据来源(trace 的出处) |
数据划分
该数据集仅包含一个划分:
- train(训练集):包含全部 6,069 条样本
数据特点
- 数据以 Parquet 格式存储(路径为
data/train-*) - 每个样本包含完整的 智能体执行轨迹(包括多轮对话、模型配置、运行记录及验证结果),可用于监督微调(SFT)、奖励建模或智能体行为评估等场景
- 数据集带有
verifier_output字段,适合用于带验证信号的强化学习或偏好优化类任务




