terminal_bench_2_a3_rl_DCAgent_exp_rpt_unitsyn_python_v3_10_8B_20260829_192924
收藏资源简介:
该数据集是一个多轮对话数据集,包含3763个训练样本。每条样本记录了一段AI代理与用户之间的对话历史(conversations),包括说话角色(role)和对话内容(content)。此外,还提供了代理名称(agent)、使用的模型(model)及模型提供商(model_provider)、对话日期(date)、所属任务(task)、剧集编号(episode)、运行标识(run_id)、试验名称(trial_name)、最终结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。数据适用于对话系统训练、AI代理行为分析、模型评估与验证等场景。
This dataset is a multi-turn dialogue dataset containing 3,763 training samples. Each sample records a conversation history between an AI agent and a user, including speaker role and content. Additionally, it provides agent name, used model and model provider, conversation date, task, episode number, run ID, trial name, result, verifier output, and trace source. The data is suitable for dialogue system training, AI agent behavior analysis, model evaluation and verification, etc.
数据集概述
该数据集为 laion/terminal_bench_2_a3_rl_DCAgent_exp_rpt_unitsyn_python_v3_10_8B_20260829_192924,由 LAION 发布,主要面向终端操作基准测试中的强化学习(RL)智能体训练与评估场景。
基本信息
- 数据集规模:训练集包含 3,763 条样本,总大小为 441,107,137 字节(约 420.7 MB),下载大小为 246,909,884 字节(约 235.5 MB)。
- 数据划分:仅提供
train划分,数据文件路径为data/train-*。 - 默认配置:配置名为
default。
特征字段
每个样本包含以下字段:
| 字段名 | 类型 | 说明 |
|---|---|---|
conversations |
列表 | 对话记录,每项包含 role(角色,字符串)和 content(内容,字符串) |
agent |
字符串 | 智能体标识 |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供方 |
date |
字符串 | 日期信息 |
task |
字符串 | 任务描述 |
episode |
字符串 | 回合编号 |
run_id |
字符串 | 运行标识 |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 任务结果 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 追踪来源 |
数据集用途
该数据集名称中体现了以下关键要素:
- 任务类型:终端基准(terminal_bench),涉及命令行/终端操作任务。
- 算法:基于强化学习的智能体实验(RL_DCAgent_exp),可能包含逆序单元同步(rpt_unitsyn)等技术。
- 环境与模型:Python 3.10 环境,8B 规模模型(可能为特定开源大语言模型)。
- 时间戳:20260829_192924 表明数据生成于 2026 年 8 月 29 日,包含具体的轨迹数据、验证结果及对话历史,适用于训练或评估终端操作型智能体。




