eval-fsr-a1-issue-tasks-swe-r505-traces
收藏资源简介:
该数据集记录了多轮对话实验的执行过程与结果,适用于对话系统评估和代理行为分析。数据集包含1467个训练样本,每个样本包含对话记录(conversations字段,包括每条消息的内容和角色)、执行代理配置(agent、模型名称model、模型提供商model_provider)、实验执行上下文(日期date、任务类型task、回合episode、运行ID run_id、试验名称trial_name)、执行结果(result)以及验证器输出(verifier_output)。此外,trace_source字段标识数据来源。数据集以结构化格式存储,便于分析对话交互质量、代理性能评估和实验过程追溯。
This dataset records the execution processes and results of multi-turn dialogue experiments, suitable for dialogue system evaluation and agent behavior analysis. It contains 1467 training samples, each including dialogue records (conversations field, with message content and roles), execution agent configuration (agent, model name, model provider), experiment execution context (date, task type, episode, run ID, trial name), execution results (result), and verifier output (verifier_output). Additionally, the trace_source field identifies the data source. The dataset is stored in a structured format, facilitating analysis of dialogue interaction quality, agent performance evaluation, and experiment process tracing.
数据集概述
数据集名称:eval-fsr-a1-issue-tasks-swe-r505-traces
来源地址:https://huggingface.co/datasets/laion/eval-fsr-a1-issue-tasks-swe-r505-traces
数据集特征
该数据集共包含 13 个特征字段,具体如下:
- conversations:对话记录,包含两个子字段:
content(字符串类型):对话内容role(字符串类型):对话角色
- agent(字符串类型):智能体名称
- model(字符串类型):模型名称
- model_provider(字符串类型):模型提供方
- date(字符串类型):日期
- task(字符串类型):任务名称
- episode(字符串类型):轮次
- run_id(字符串类型):运行标识符
- trial_name(字符串类型):试验名称
- result(字符串类型):结果
- verifier_output(字符串类型):验证器输出
- trace_source(字符串类型):追踪来源
数据集划分
数据集只有一个划分(split):
- train:训练集
- 示例数量:1467
- 字节大小:224,920,542 字节(约 224.9 MB)
数据文件信息
- 数据集下载大小:164,290,901 字节(约 164.3 MB)
- 数据集总大小:224,920,542 字节(约 224.9 MB)
- 数据文件路径:
data/train-*(默认配置default)




