terminal_bench_2_a1_pr_mining_20260805_114333
收藏资源简介:
该数据集包含多轮对话记录,每条记录由一系列对话轮次(conversations)组成,每个轮次包含角色(role)和内容(content)字符串。此外,每条记录还包含代理(agent)、模型(model)、模型提供者(model_provider)、日期(date)、任务(task)、回合(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)和追踪来源(trace_source)等字段。训练集共有2991个样本,总数据集大小约为300MB。
This dataset contains multi-turn dialogue records, each consisting of a series of conversation turns (conversations) with each turn containing a role (role) and content (content) string. Additionally, each record includes fields such as agent, model, model_provider, date, task, episode, run_id, trial_name, result, verifier_output, and trace_source. The training set has 2991 samples, and the total dataset size is approximately 300MB.
数据集概述:laion/terminal_bench_2_a1_pr_mining_20260805_114333
基本信息
- 数据集名称:terminal_bench_2_a1_pr_mining_20260805_114333
- 所属机构:LAION
- 数据集大小:约 300.25 MB(下载大小约 256.97 MB)
- 数据分割:仅包含训练集(train),共 2,991 条样本
数据字段
该数据集包含以下字段:
| 字段名 | 类型 | 说明 |
|---|---|---|
conversations |
列表 | 对话记录,包含 role(角色)和 content(内容)两个子字段 |
agent |
字符串 | 智能体名称 |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供方 |
date |
字符串 | 日期 |
task |
字符串 | 任务描述 |
episode |
字符串 | 回合编号 |
run_id |
字符串 | 运行标识 |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 结果 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 追踪来源 |
数据集用途
从数据集名称(terminal_bench_2_a1_pr_mining)和字段结构来看,该数据集主要用于:
- 终端基准测试(Terminal Bench)场景
- Pull Request 挖掘(PR Mining)任务
- 评估和记录智能体在执行特定任务时的表现
数据格式
- 数据文件路径:
data/train-* - 数据格式为 Parquet 格式(由
data/train-*路径模式推断) - 配置名称:
default




