llm-aes/asap-8-original
收藏资源简介:
--- dataset_info: features: - name: essay_id dtype: int64 - name: essay_set dtype: int64 - name: essay dtype: string - name: rater1_domain1 dtype: int64 - name: rater2_domain1 dtype: int64 - name: domain1_score dtype: int64 - name: rater1_trait1 dtype: float64 - name: rater1_trait2 dtype: float64 - name: rater1_trait3 dtype: float64 - name: rater1_trait4 dtype: float64 - name: rater1_trait5 dtype: float64 - name: rater1_trait6 dtype: float64 - name: rater2_trait1 dtype: float64 - name: rater2_trait2 dtype: float64 - name: rater2_trait3 dtype: float64 - name: rater2_trait4 dtype: float64 - name: rater2_trait5 dtype: float64 - name: rater2_trait6 dtype: float64 - name: rubrics dtype: string - name: prompt dtype: string - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 2672885 num_examples: 723 download_size: 1352624 dataset_size: 2672885 configs: - config_name: default data_files: - split: train path: data/train-* ---
This dataset is primarily used for essay scoring and analysis, containing detailed information and scoring data of essays, suitable for developing and evaluating essay scoring models.
数据集概述
数据特征
- essay_id: 文章ID,数据类型为
int64 - essay_set: 文章集,数据类型为
int64 - essay: 文章内容,数据类型为
string - rater1_domain1: 评分者1的领域1评分,数据类型为
int64 - rater2_domain1: 评分者2的领域1评分,数据类型为
int64 - domain1_score: 领域1的最终评分,数据类型为
int64 - rater1_trait1 至 rater1_trait6: 评分者1的特征评分,数据类型为
float64 - rater2_trait1 至 rater2_trait6: 评分者2的特征评分,数据类型为
float64 - rubrics: 评分标准,数据类型为
string - prompt: 提示信息,数据类型为
string - index_level_0: 索引级别0,数据类型为
int64
数据分割
- train: 训练集,包含723个样本,占用2672885字节
数据集大小
- 下载大小: 1352624字节
- 数据集大小: 2672885字节
配置
- default: 默认配置,包含训练集数据文件路径为
data/train-*




