pysentimiento/emociones_colombia
收藏资源简介:
--- dataset_info: features: - name: text dtype: string - name: tweet_id dtype: int64 - name: alegria dtype: class_label: names: '0': no_alegria '1': alegria - name: miedo dtype: class_label: names: '0': no_miedo '1': miedo - name: asco dtype: class_label: names: '0': no_asco '1': asco - name: tristeza dtype: class_label: names: '0': no_tristeza '1': tristeza - name: gpt-3.5_cot dtype: string splits: - name: train num_bytes: 459521 num_examples: 1199 download_size: 230865 dataset_size: 459521 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征字段: - 文本(text):数据类型为字符串(string) - 推文ID(tweet_id):数据类型为64位整数(int64) - 喜悦(alegria):数据类型为分类标签,标签映射关系为:0代表无喜悦(no_alegria),1代表有喜悦(alegria) - 恐惧(miedo):数据类型为分类标签,标签映射关系为:0代表无恐惧(no_miedo),1代表有恐惧(miedo) - 厌恶(asco):数据类型为分类标签,标签映射关系为:0代表无厌恶(no_asco),1代表有厌恶(asco) - 悲伤(tristeza):数据类型为分类标签,标签映射关系为:0代表无悲伤(no_tristeza),1代表有悲伤(tristeza) - GPT-3.5链式思考结果(gpt-3.5_cot):数据类型为字符串(string) 数据划分: - 训练集(train):数据字节数为459521,样本总数为1199 下载大小:230865字节 数据集总占用大小:459521字节 配置项: - 默认配置(default):数据文件配置如下: - 训练集划分(split: train)对应的数据路径为data/train-*



