model2-test-results
收藏资源简介:
该数据集包含3155个训练样本,总大小约20.1MB。每个样本由7个字段组成:system(字符串,系统指令)、user(字符串,用户输入)、gold_response(字符串,标准回答)、generated(字符串,生成内容)以及rouge1/rouge2/rougeL(浮点数,ROUGE评估分数)。数据集仅提供训练集划分,未说明具体应用场景或数据来源,但从字段命名推断可能用于对话系统响应生成的质量评估任务。
This dataset contains 3155 training samples with a total size of approximately 20.1 MB. Each sample consists of 7 fields: system (string, system instruction), user (string, user input), gold_response (string, standard reference response), generated (string, generated content), as well as rouge1, rouge2, and rougeL (floating-point numbers, ROUGE evaluation scores). Only the training split is provided for this dataset, and no specific application scenarios or data sources are specified. However, it can be inferred from the field naming conventions that this dataset may be used for quality assessment tasks of dialogue system response generation.
数据集概述
基本信息
- 数据集名称: model2-test-results
- 托管平台: Hugging Face Datasets
- 数据集地址: https://huggingface.co/datasets/AIforAlly/model2-test-results
数据集结构与内容
- 数据格式: 结构化数据,包含多个特征字段。
- 数据量:
- 训练集样本数量: 3155 个示例。
- 训练集数据大小: 20143818 字节。
- 下载大小: 7121422 字节。
- 数据集总大小: 20143818 字节。
数据特征(Features)
数据集包含以下字段:
- system: 数据类型为字符串 (string)。
- user: 数据类型为字符串 (string)。
- gold_response: 数据类型为字符串 (string)。
- generated: 数据类型为字符串 (string)。
- rouge1: 数据类型为浮点数 (float64)。
- rouge2: 数据类型为浮点数 (float64)。
- rougeL: 数据类型为浮点数 (float64)。
数据划分(Splits)
- 仅包含一个数据划分:
- 划分名称: train
- 文件路径模式:
data/train-*
配置信息
- 默认配置名称: default
- 数据文件关联: 默认配置将上述
train划分与路径data/train-*下的文件相关联。




