swebench_verified_random_100_folders_a3_rl_DCAgent_mix_h4_binary_easy_50_8B_20260897d58773
收藏资源简介:
该数据集是一个多轮对话记录集合,专注于AI agent与用户或系统之间的交互。每条样本包含完整的对话历史(conversations),其中每条消息带有角色(role)和内容(content);此外还记录了使用的agent名称(agent)、模型名称(model)及其提供商(model_provider)、对话日期(date)、任务类型(task)、轮次(episode)、运行ID(run_id)、试验名称(trial_name)、最终结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。训练集共包含12,240条样本,数据规模约2GB。该数据集可用于训练、评估或分析对话agent的行为、模型性能、任务完成情况等,适用于多轮对话系统、强化学习、agent行为分析等研究场景。
数据集详情总结
该数据集由 laion 上传,是 swebench_verified_random_100_folders_a3_rl_DCAgent_mix_h4_binary_easy_50_8B_20260897d58773,主要面向代码智能体(Agent)领域的强化学习训练数据,来源为 SWE-bench 验证集上的随机任务样本。
数据集规模
- 总大小:约 2.08 GB(实际字节数 2,081,413,492)
- 下载大小:约 1.20 GB(实际字节数 1,197,025,012)
- 分割:仅包含训练集(train),共 12,240 条样本
数据特征
每条样本包含以下字段:
| 字段 | 类型 | 说明 |
|---|---|---|
conversations |
列表(含 role 和 content,均为字符串) |
对话记录,包含角色与内容 |
agent |
字符串 | 智能体名称或标识 |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供方 |
date |
字符串 | 日期信息 |
task |
字符串 | 任务标识 |
episode |
字符串 | 回合或情景编号 |
run_id |
字符串 | 运行 ID |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 任务结果 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 轨迹来源 |
其中,conversations 字段为嵌套结构,包含 role(如 system/user/assistant 等)与 content(对话内容),代表智能体与环境的多轮交互过程。
配置说明
- 配置文件名为
default - 数据文件路径为
data/train-*(通配符格式,对应多个分片文件)
用途总结
此数据集适用于训练和评估代码生成/代码修复类智能体,结合了 SWE-bench 的真实软件工程任务,并加入了混合策略(mix_h4_binary_easy_50_8B)的强化学习采样数据,可用于研究代码智能体在简单二元任务上的行为模式与结果验证。




