steering
收藏资源简介:
该数据集包含两个独立配置:excellent-grades和single-token-steering,每个配置各有50个训练样本,专注于教育领域的任务评估场景。数据集采用结构化格式,每个样本包含以下核心字段:唯一标识符(id)、任务描述(task)、相关科目列表(subjects)、对应成绩列表(grades)、x_minus评估维度(x_minus)、x_plus评估维度(x_plus)以及任务提示文本(task_prompt)。它适用于教育评估、多科目成绩分析、任务导向的语言模型训练等应用场景,通过结构化字段支持对学业表现和任务完成情况的综合分析。
This dataset includes two independent configurations: excellent-grades and single-token-steering, each containing 50 training samples, focusing on task evaluation scenarios in the educational field. The dataset adopts a structured format, with each sample comprising the following core fields: unique identifier (id), task description (task), list of related subjects (subjects), corresponding grades list (grades), x_minus evaluation dimension (x_minus), x_plus evaluation dimension (x_plus), and task prompt text (task_prompt). It is suitable for applications such as educational assessment, multi-subject grade analysis, and task-oriented language model training, supporting comprehensive analysis of academic performance and task completion through structured fields.
数据集概述
该数据集名为 steering,由用户 de-Rodrigo 托管于 Hugging Face,采用 MIT 许可证。
数据集配置
数据集包含两个配置(config),每个配置均仅有一个训练集(train split),各含 50 条样本:
- excellent-grades:训练集大小 44,470 字节,下载大小 25,155 字节。
- single-token-steering:训练集大小 8,071 字节,下载大小 5,963 字节。
数据特征
两个配置共享相同的数据特征结构,具体如下:
| 字段名 | 数据类型 | 描述 |
|---|---|---|
| id | int64 | 样本的唯一标识符 |
| task | string | 任务描述 |
| subjects | list(string) | 学科列表 |
| grades | list(int64) | 对应的成绩列表 |
| x_minus | string | 负向样本(内容未说明) |
| x_plus | string | 正向样本(内容未说明) |
| task_prompt | string | 任务提示文本 |
文件路径
- excellent-grades 配置的训练数据文件路径:
excellent-grades/train-* - single-token-steering 配置的训练数据文件路径:
single-token-steering/train-*
(具体文件列表未在 README 中详细列出)





