dev_set_v2_a1_stack_pytest_withtests_20260811_201502
收藏资源简介:
该数据集包含多轮对话记录,每条对话由多个回合组成,每个回合包含角色(role)和内容(content)。此外,每条记录还提供了使用的智能体(agent)、模型(model)、模型提供商(model_provider)、日期(date)、任务(task)、情节(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)等元数据。数据集共包含5123个训练样本,总大小约500MB,适合用于多轮对话研究、智能体行为分析、模型评估与验证等场景。
This dataset contains multi-turn dialogue records, where each dialogue consists of multiple turns, each turn includes a role and content. Additionally, each record provides metadata such as the agent, model, model provider, date, task, episode, run ID, trial name, result, verifier output, and trace source. The dataset includes 5123 training samples with a total size of approximately 500MB, suitable for multi-turn dialogue research, agent behavior analysis, model evaluation, and verification.
数据集概述
该数据集名为 laion/dev_set_v2_a1_stack_pytest_withtests_20260811_201502,托管在 Hugging Face 平台上,主要用于开发与测试场景的对话数据收集与分析。
基本信息
- 数据集大小:下载大小约 432.79 MB,完整数据集大小约 500.56 MB
- 数据划分:仅包含训练集(train),共 5,123 条样本
数据特征
每条样本包含以下字段:
| 字段名 | 类型 | 说明 |
|---|---|---|
conversations |
列表 | 对话记录,每项包含 role(角色)和 content(内容),均为字符串 |
agent |
字符串 | 涉及的主体(如代理或系统) |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供方 |
date |
字符串 | 日期信息 |
task |
字符串 | 任务类型 |
episode |
字符串 | 会话轮次或集数 |
run_id |
字符串 | 运行标识 |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 结果信息 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 追踪来源 |
数据用途
该数据集包含带测试的对话记录,适用于模型行为分析、任务完成评估、agent 交互追踪等场景。每条记录附带运行标识、试验名称和结果,便于复现与验证。




