swebench_verified_random_100_folders_a1_stack_pytest_withtests_20260818_162725
收藏资源简介:
该数据集包含多轮对话数据,每条记录由多个字段组成:conversations字段为对话列表,每条对话包含角色(role)和内容(content);此外还包括代理(agent)、模型(model)、模型提供商(model_provider)、日期(date)、任务(task)、片段(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。数据集仅包含训练集,共10092个样本,总数据大小约为2.3GB。该数据集可能用于对话系统、代理评估或模型行为分析等任务。
This dataset contains multi-turn conversation data. Each record consists of multiple fields: the conversations field is a list of dialogues, each dialogue contains a role and content; additionally, it includes agent, model, model_provider, date, task, episode, run_id, trial_name, result, verifier_output, and trace_source. The dataset contains only a training set with 10,092 samples, with a total data size of approximately 2.3 GB. This dataset may be used for tasks such as dialogue systems, agent evaluation, or model behavior analysis.
数据集概述
基本信息
- 数据集名称: laion/swebench_verified_random_100_folders_a1_stack_pytest_withtests_20260818_162725
- 数据集地址: https://huggingface.co/datasets/laion/swebench_verified_random_100_folders_a1_stack_pytest_withtests_20260818_162725
- 数据集大小: 2,342,048,547 字节(约2.34 GB)
- 下载大小: 1,151,342,023 字节(约1.15 GB)
数据集划分
- 划分名称: train(训练集)
- 样本数量: 10,092 条
- 数据字节数: 2,342,048,547 字节
数据特征(Features)
对话内容(conversations)
- role(角色): 字符串类型,表示对话中的角色(如用户或助手)
- content(内容): 字符串类型,表示对话的具体内容
其他字段
- agent(代理): 字符串类型,表示执行任务的代理信息
- model(模型): 字符串类型,表示使用的模型名称
- model_provider(模型提供者): 字符串类型,表示模型的提供方
- date(日期): 字符串类型,表示数据记录的日期
- task(任务): 字符串类型,表示具体任务描述
- episode(会话轮次): 字符串类型,表示会话的轮次信息
- run_id(运行ID): 字符串类型,表示运行标识符
- trial_name(试验名称): 字符串类型,表示试验的名称
- result(结果): 字符串类型,表示任务执行的结果
- verifier_output(验证器输出): 字符串类型,表示验证器的输出结果
- trace_source(追踪来源): 字符串类型,表示追踪数据的来源
配置信息
- 配置名称: default
- 数据文件路径: data/train-*(通配符形式,表示包含多个数据文件)
数据集特点
该数据集基于 SWE-bench 验证集构建,从随机选取的 100 个文件夹中采样,涉及使用 pytest 进行测试并包含测试用例的数据,属于软件工程领域的数据集,用于评估模型在代码生成、测试执行等任务上的表现。




