github_fetch_huggingface_terminal_9127_a9k2d4_derived_emotion_classifier
收藏资源简介:
该数据集是一个用于训练情感分类模型的派生数据集,通过合并并清洗来自两个上游来源(Wiki Factoid 问答数据集和 Twitter 情感数据集)的样本,并重新标注情感标签,最终得到 8000 条标注记录。数据集的标签涵盖五种情感类别:愤怒、喜悦、悲伤、恐惧、惊讶。该数据集适用于情感分类任务。
This dataset is a derived dataset for training sentiment classification models. It is created by merging and cleaning samples from two upstream sources (Wiki Factoid QA dataset and Twitter sentiment dataset), re-labeling the sentiment labels, resulting in 8000 annotated records. The dataset covers five emotion categories: anger, joy, sadness, fear, and surprise. It is suitable for sentiment classification tasks.
数据集概述:Emotion Classifier Data
该数据集是一个派生数据集,专门用于训练情感分类模型。
核心信息
- 数据集名称:Emotion Classifier Data
- 许可证:未知(待定)—— 当前复用条款仍在审核中,暂未明确
- 语言:英语(en)
数据规模与标签
- 总记录数:8,000 条已标注样本
- 情感类别:愤怒(anger)、喜悦(joy)、悲伤(sadness)、恐惧(fear)、惊讶(surprise)
数据来源与衍生路径
该数据集由以下两个上游来源数据集经过清洗和重新标注后整合而成:
-
TianfuXinqu/github_fetch_huggingface_terminal_9080_m7k2p9_upstream_wiki_factoid
— 维基百科事实类问答数据 -
TianfuXinqu/github_fetch_huggingface_terminal_9080_m7k2p9_upstream_twitter_sentiment
— 推特情感分析数据
用途
该数据集主要用于训练情感分类模型,覆盖上述五种基本情感类别。




