dev_set_v2_a1_stack_pytest_gpt5mini_20260811_194428
收藏资源简介:
该数据集包含 5073 条训练样本,每条样本记录了一次多轮对话及相关元信息。对话内容以列表形式存储,每条消息包含角色(role)和内容(content)。此外,每条样本还附带了代理(agent)、模型名称(model)、模型提供方(model_provider)、日期(date)、任务(task)、实验轮次(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及溯源来源(trace_source)等字段。数据集适用于对话系统训练、模型行为分析、实验追踪等任务。
This dataset contains 5073 training samples, each recording a multi-turn dialogue and related metadata. The dialogue content is stored as a list, with each message containing role and content. Additionally, each sample includes fields such as agent, model name, model provider, date, task, episode, run ID, trial name, result, verifier output, and trace source. The dataset is suitable for dialogue system training, model behavior analysis, experiment tracking, and other tasks.
数据集详情总结
基本信息
该数据集名称为 laion/dev_set_v2_a1_stack_pytest_gpt5mini_20260811_194428,属于开发集(dev set)类型,由 LAION 组织发布。数据集总大小约 480 MB(下载大小约 404 MB),仅包含一个训练集(train)划分,共 5,073 条样本。
数据字段
数据集包含以下 12 个字段:
| 字段名 | 类型 | 说明 |
|---|---|---|
conversations |
列表(含 role 和 content 两个字符串子字段) | 对话记录,包含角色(如用户/助手)和内容 |
agent |
字符串 | 智能体标识 |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供商 |
date |
字符串 | 日期信息 |
task |
字符串 | 任务类型 |
episode |
字符串 | 剧集/轮次编号 |
run_id |
字符串 | 运行标识符 |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 结果信息 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 追踪来源 |
内容特征
- 对话结构:每条样本包含多轮对话(conversations),每轮对话记录角色与内容,适合用于训练多轮交互式智能体。
- 任务多样性:字段中包含
task、episode、run_id、trial_name等,暗示数据来源于多次运行、多个试验场景,可能覆盖不同任务类型。 - 验证与追踪:包含
verifier_output(验证器输出)和trace_source(追踪来源),表明数据带有验证标签和来源追踪信息,可用于评估与审计。 - 模型相关:字段中记录了
model和model_provider,数据可能由 GPT-5-mini 等特定模型生成(根据数据集名称推断)。
应用场景
该数据集适用于智能体对话系统训练、多轮交互任务学习、模型输出验证与评估、以及基于轨迹追踪的强化学习或模仿学习等场景。




