CVCODE/big5_essays_ru
收藏资源简介:
--- dataset_info: features: - name: '#AUTHID' dtype: string - name: TEXT dtype: string - name: extroversion dtype: int64 - name: neuroticism dtype: int64 - name: agreeableness dtype: int64 - name: conscientiousness dtype: int64 - name: openness dtype: int64 - name: TEXT_RU dtype: string splits: - name: train num_bytes: 21522844 num_examples: 2467 download_size: 11117157 dataset_size: 21522844 --- # Dataset Card for "big5_essays_ru" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- dataset_info: 特征字段: - 字段名: #AUTHID,数据类型: 字符串(string) - 字段名: TEXT,数据类型: 字符串 - 字段名: 外向性(extroversion),数据类型: 64位整数(int64) - 字段名: 神经质(neuroticism),数据类型: 64位整数(int64) - 字段名: 宜人性(agreeableness),数据类型: 64位整数(int64) - 字段名: 尽责性(conscientiousness),数据类型: 64位整数(int64) - 字段名: 开放性(openness),数据类型: 64位整数(int64) - 字段名: TEXT_RU,数据类型: 字符串 数据划分: - 划分名称: train,字节数: 21522844,样本数量: 2467 下载大小: 11117157字节 数据集总大小: 21522844字节 --- # 「big5_essays_ru」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
- 名称: big5_essays_ru
数据集特征
- 特征列表:
#AUTHID: 数据类型为stringTEXT: 数据类型为stringextroversion: 数据类型为int64neuroticism: 数据类型为int64agreeableness: 数据类型为int64conscientiousness: 数据类型为int64openness: 数据类型为int64TEXT_RU: 数据类型为string
数据集分割
- 分割详情:
train:- 数据量: 21522844 字节
- 示例数量: 2467
数据集大小
- 下载大小: 11117157 字节
- 数据集大小: 21522844 字节




