dev_set_v2_a3_rl_DCAgent_exp_rpt_curriculum_easy_21_8B_20260827_004041
收藏资源简介:
该数据集是一个多轮对话交互数据集,包含4248个训练样本。每条样本包含完整的对话记录(conversations),其中每个对话轮次由角色(role)和内容(content)组成。此外,还提供了参与者信息(agent)、使用的模型(model)及模型提供商(model_provider)、日期(date)、任务类型(task)、任务轮次(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及轨迹来源(trace_source)等字段。数据集可用于训练或评估对话系统、智能体推理、任务导向型对话等场景。
This dataset is a multi-turn dialogue interaction dataset containing 4,248 training samples. Each sample includes a complete conversation history (conversations), where each turn consists of a role and content. Additionally, it provides fields such as agent, model, model_provider, date, task, episode, run_id, trial_name, result, verifier_output, and trace_source. The dataset can be used for training or evaluating dialogue systems, agent reasoning, task-oriented dialogue, etc.
数据集概述
该数据集名为 dev_set_v2_a3_rl_DCAgent_exp_rpt_curriculum_easy_21_8B_20260827_004041,由 LAION 团队发布,托管于 Hugging Face 平台。
数据集结构
数据集包含以下字段:
- conversations:对话记录列表,每条包含
role(角色)和content(内容)两个子字段 - agent:智能体标识
- model:使用的模型名称
- model_provider:模型提供方
- date:日期信息
- task:任务名称
- episode:回合编号
- run_id:运行 ID
- trial_name:试验名称
- result:结果
- verifier_output:验证器输出
- trace_source:追踪来源
数据划分
数据集仅包含一个划分:
| 划分 | 样本数 | 大小 |
|---|---|---|
| train | 4,248 | 324,039,143 字节(约 309 MB) |
- 下载大小:284,211,768 字节(约 271 MB)
- 数据集总大小:324,039,143 字节(约 309 MB)
数据以 data/train-* 格式存储,采用默认配置(default)。
数据集特征
该数据集看起来是一个用于智能体(Agent)强化学习(RL)训练的开发集(dev set),包含对话轨迹、任务执行结果以及验证器输出等信息,适用于训练或评估具备任务执行能力的对话智能体模型。




