terminal_bench_2_a1_curriculum_easy_20260731_004546
收藏资源简介:
该数据集是一个多轮对话数据集,包含2961个训练样本,总大小约为284 MB。每个样本包含多轮对话历史(conversations),其中每轮对话由内容(content)和角色(role)组成。此外,还提供了丰富的元数据:对话代理(agent)、使用的模型(model)、模型提供者(model_provider)、日期(date)、任务(task)、试验轮次(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。该数据集适用于对话系统训练、多轮对话建模、对话代理行为分析或模型评估等任务。
This multi-turn dialogue dataset consists of 2,961 training samples and has a total size of roughly 284 MB. Each sample includes multi-turn dialogue history (conversations), where each dialogue turn is composed of a content field and a role field. Additionally, a rich collection of metadata is provided, covering dialogue agent (agent), used model (model), model provider (model_provider), date, task, episode, run ID (run_id), trial name (trial_name), result, verifier output (verifier_output), and trace source. This dataset is applicable for tasks such as dialogue system training, multi-turn dialogue modeling, dialogue agent behavior analysis, and model evaluation.
数据集概述
该数据集名为 laion/terminal_bench_2_a1_curriculum_easy_20260731_004546,由 LAION 组织发布,是一个面向终端(Terminal)任务基准的对话数据集,版本代号为 2_a1_curriculum_easy,生成日期为 2026 年 7 月 31 日。
数据集内容
数据集包含 2,961 条训练样本,总大小约 271.3 MB(下载大小约 70.4 MB)。每条样本记录了一次完整的终端交互任务过程,包含以下字段:
- conversations:对话列表,每条对话包含:
content(字符串):对话内容(用户指令或模型回复)role(字符串):对话角色(如 user/assistant)
- agent(字符串):执行任务的智能体名称
- model(字符串):使用的模型名称
- model_provider(字符串):模型提供商
- date(字符串):任务日期
- task(字符串):任务描述或类型
- episode(字符串):任务所属的回合/场景编号
- run_id(字符串):运行标识符
- trial_name(字符串):试验名称
- result(字符串):任务最终结果
- verifier_output(字符串):验证器输出内容
- trace_source(字符串):轨迹来源
数据集结构
数据以 JSON 格式存储,文件路径为 data/train-*(分片存储)。仅包含一个 train 划分,无独立的验证集或测试集。默认配置名为 default。
适用范围
该数据集适用于训练和评估智能体在终端环境下的任务执行能力,尤其侧重于“课程学习(curriculum)”策略中的简单任务(“easy”级别),可用于强化学习、指令微调或行为克隆等研究场景。




