swebench_verified_random_100_folders_a1_stack_rust_20260818_162727
收藏资源简介:
该数据集包含9839个训练样本,每个样本记录了一次完整的对话过程及相关的元数据。对话内容以多轮对话形式存储,每条消息包含角色(role)和内容(content)。此外,每个样本还提供了执行对话的代理(agent)、使用的模型(model)及模型提供商(model_provider)、日期(date)、任务(task)、剧集(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)等字段。数据集可用于训练和评估多轮对话系统、代理行为分析、模型验证等任务。
This dataset contains 9,839 training samples, each recording a complete dialogue process and associated metadata. The dialogue content is stored in a multi-turn format, with each message containing a role and content. Additionally, each sample includes fields such as the agent executing the dialogue, the model used and its provider, date, task, episode, run ID, trial name, result, verifier output, and trace source. The dataset can be used for training and evaluating multi-turn dialogue systems, agent behavior analysis, model validation, etc.
数据集概述
该数据集名为 laion/swebench_verified_random_100_folders_a1_stack_rust_20260818_162727,托管于 Hugging Face 平台。
数据集内容
该数据集主要包含与代码生成或软件工程任务相关的对话和多源追踪信息。每条数据记录包含以下字段:
- conversations:一组对话记录,每条记录包含
role(角色)和content(内容)两个字段。 - agent:执行任务的智能体名称。
- model:所使用的模型名称。
- model_provider:模型提供方。
- date:数据生成或记录的日期。
- task:具体任务描述。
- episode:任务会话编号。
- run_id:运行标识符。
- trial_name:试验名称。
- result:任务执行结果。
- verifier_output:验证器的输出内容。
- trace_source:追踪信息来源。
数据规模与划分
- 该数据集仅包含一个划分:train(训练集)。
- 训练集包含 9,839 个样本,总字节数约为 1,669,782,570(约 1.56 GB)。
- 数据集的下载大小约为 953,311,640 字节(约 909 MB)。
数据文件
数据文件以 data/train-* 的格式存储,默认配置名为 default。




