dev_set_v2_a1_stack_junit_20260811_171122
收藏资源简介:
该数据集包含多轮对话记录,每个样本由 agent、model、model_provider、date、task、episode、run_id、trial_name、result、verifier_output、trace_source 等字段组成,其中 conversations 字段为对话历史,包含 role 和 content 两个子字段。数据集仅包含训练集,共 4605 个样本,总大小约 421 MB。适用于对话系统评估、多轮交互分析、AI 代理行为追踪等任务。
This dataset contains multi-turn conversation records, with each sample consisting of fields such as agent, model, model_provider, date, task, episode, run_id, trial_name, result, verifier_output, and trace_source. The conversations field holds the dialogue history, containing two sub-fields: role and content. The dataset includes only the training set, with a total of 4605 samples and a size of approximately 421 MB. It is suitable for tasks such as dialogue system evaluation, multi-turn interaction analysis, and AI agent behavior tracking.
数据集详情
基本信息
- 数据集名称:dev_set_v2_a1_stack_junit_20260811_171122
- 数据集来源:由 LAION 组织发布
- 数据集大小:约 421 MB(解压后),下载大小约 359 MB
- 数据分割:仅包含训练集(train),共 4,605 个样本
数据字段说明
该数据集包含以下字段:
| 字段名 | 类型 | 说明 |
|---|---|---|
conversations |
列表 | 对话内容,包含 role(角色)和 content(内容)两个字段,均为字符串类型 |
agent |
字符串 | 智能体标识 |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供方 |
date |
字符串 | 日期信息 |
task |
字符串 | 任务类型 |
episode |
字符串 | 会话轮次(episode)标识 |
run_id |
字符串 | 运行 ID |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 结果信息 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 跟踪来源 |
数据特点
- 数据集以对话(conversations)为核心,每条记录包含完整的对话历史,角色分为用户和助手。
- 每个样本附带丰富的元数据,包括智能体信息、模型信息、运行参数、结果验证等多维度标注。
- 该数据集可能与代码生成或 Junit 测试相关任务有关(从名称中的 "stack_junit" 推测),包含任务执行结果和验证器输出,适合用于智能体行为分析、对话系统训练或代码相关基准测试等场景。




