相关数据集
GoodNewsEveryone
GoodNewsEveryone数据集由斯图加特大学机器语言处理研究所创建,包含5000条来自82个不同来源的英文新闻标题。数据集通过众包方式进行了情感类别、情感强度、语义角色(体验者、原因、目标、线索)以及读者视角的标注。该数据集旨在解决情感分析中的细粒度分析问题,支持情感分类、情感强度预测、情感原因检测等研究,并提供了一个两阶段的标注程序和基准模型结果。
arXiv2020-03-03 更新530
LocalDoc/news_azerbaijan_2
该数据集包含来自https://musavat.com/的阿塞拜疆语新闻,创建于2024年,包含753k条新闻(约1100万句子)。数据集以CSV格式提供,每条新闻包含id、date、category、title和text字段。
Hugging Face2024-04-02 更新150
jfecunha/arquivo_news_coco
--- dataset_info: features: - name: image_id dtype: int64 - name: image_path dtype: string - name: image dtype: binary - name: objects list: - name: area dtype: flo
Hugging Face2023-04-20 更新120
denizzhansahin/Turkish_News_News-4-2024
--- dataset_info: features: - name: 'Unnamed: 0' dtype: int64 - name: Baslik dtype: string - name: Ozet dtype: string - name: Kategori dtype: string - name: Link dtype:
Hugging Face2024-04-11 更新160
News Headlines Dataset For Stock Sentiment Analyze
Dataset which can be used to predict stock sentiments
kaggle2021-06-19 更新140



