terminal_bench_2_Qwen3_32B_OT_Agent_SFT_10K_axolotl_step250_traces
收藏资源简介:
该数据集包含多轮对话记录,每条样本包含一系列对话轮次(conversations),每个轮次包含角色(role,如用户或助手)和文本内容(content)。此外,每条样本还记录了所使用的智能体(agent)、模型名称(model)、模型提供商(model_provider)、日期(date)、任务描述(task)、运行集数(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。数据集共有398个训练样本,适用于对话系统训练、智能体行为分析、模型评估等场景。
This dataset contains multi-turn dialogue records. Each sample includes a series of conversation turns, where each turn consists of a role (e.g., user or assistant) and text content. Additionally, each sample records the agent used, model name, model provider, date, task description, episode, run ID, trial name, result, verifier output, and trace source. The dataset has 398 training samples and is suitable for dialogue system training, agent behavior analysis, and model evaluation.
数据集概述
该数据集名为 laion/terminal_bench_2_Qwen3_32B_OT_Agent_SFT_10K_axolotl_step250_traces,托管于 Hugging Face 平台,属于 LAION 组织发布的数据集。它主要用于终端任务场景下的智能体(Agent)行为追踪与评估,特别关注基于 Qwen3-32B 模型的智能体在特定任务中的交互记录。
数据集构成
- 数据总量:包含 398 个训练样本(
train分割),文件总大小约 31.1 MB(dataset_size: 31117687字节),下载大小约 9.39 MB(download_size: 9387981字节)。 - 数据分割:仅提供
train分割,无验证或测试集。 - 数据格式:采用 Parquet 格式存储,数据文件路径为
data/train-*。
特征字段(Features)
每个样本包含以下字段,涵盖对话内容、模型信息、任务背景及执行结果:
| 字段名 | 类型 | 描述 |
|---|---|---|
conversations |
list[dict] | 对话序列,每个元素包含 content(字符串,对话内容)和 role(字符串,角色标识)。 |
agent |
string | 智能体名称或标识。 |
model |
string | 使用的模型名称(如 Qwen3-32B)。 |
model_provider |
string | 模型提供方。 |
date |
string | 记录日期。 |
task |
string | 任务类型或描述。 |
episode |
string | 回合/轮次标识。 |
run_id |
string | 运行 ID。 |
trial_name |
string | 试验名称。 |
result |
string | 任务执行结果。 |
verifier_output |
string | 验证器输出。 |
trace_source |
string | 追踪来源。 |
用途与应用场景
该数据集适合用于智能体(Agent)在终端(Terminal)环境下的行为数据分析、对话系统训练、任务完成度评估以及模型追踪与调优。其命名中提及 OT_Agent_SFT 与 axolotl_step250,暗示此数据可能来自基于 Axolotl 工具进行的有监督微调(SFT)过程,且已训练至第 250 步。




