dev_set_v2_a3_rl_DCAgent_code_contests_noblock_5_8B_20260827_060900
收藏资源简介:
该数据集包含3771个训练样本,记录了多轮对话交互过程。每个样本包含一个对话列表(conversations),其中每条消息由角色(role)和内容(content)组成。此外,每条样本还标注了代理名称(agent)、模型名称(model)、模型提供商(model_provider)、日期(date)、任务(task)、回合编号(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。数据集可应用于对话系统评估、模型性能分析、多轮对话生成等任务。
This dataset contains 3771 training samples, recording multi-turn dialogue interaction processes. Each sample includes a conversation list (conversations), where each message consists of a role and content. Additionally, each sample is annotated with agent name (agent), model name (model), model provider (model_provider), date (date), task (task), episode number (episode), run ID (run_id), trial name (trial_name), result (result), verifier output (verifier_output), and trace source (trace_source). The dataset can be applied to tasks such as dialogue system evaluation, model performance analysis, and multi-turn dialogue generation.
数据集概述
该数据集名为 laion/dev_set_v2_a3_rl_DCAgent_code_contests_noblock_5_8B_20260827_060900,托管于 Hugging Face 平台,属于 LAION 组织下的开发集版本。
数据集规模
- 训练集:包含 3,771 条样本,占用 309,434,837 字节(约 295 MB)
- 下载大小:268,420,300 字节(约 256 MB)
- 总数据集大小:309,434,837 字节
数据特征
每条样本包含以下字段:
| 字段名 | 类型 | 说明 |
|---|---|---|
conversations |
列表 | 对话记录,每项包含 role(角色)和 content(内容),均为字符串类型 |
agent |
字符串 | 智能体标识 |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供方 |
date |
字符串 | 日期信息 |
task |
字符串 | 任务描述(根据名称推测为代码竞赛相关任务) |
episode |
字符串 | 训练轮次或会话编号 |
run_id |
字符串 | 运行标识 |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 执行结果 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 追踪来源 |
数据集用途
根据数据集名称推断,该数据集涉及:
- DCAgent:深度学习智能体(Deep Coding Agent)相关的强化学习(RL)开发集
- 代码竞赛任务:包含编程竞赛(code contests)相关的数据
- 模型规模:涉及 5B 至 8B 参数范围的模型
配置信息
- 默认配置名为
default - 数据文件路径为
data/train-*(分片存储) - 主要划分为单轨训练集(train split)




