遇见数据集

基于历史稿件库的新闻推荐排序数据集

收藏
官方服务:

资源简介:

数据集涵盖了从2015年至2022年期间,由新华社编辑(用户)真实编辑过的历史新闻(新闻内容)数据。为了增强新闻特征,提高推荐系统的准确性和多样性,我们在新华社的中文历史稿件数据基础上,增添了新闻类别、新闻实体以及新闻向量表征等特征,可以用于新闻选题推荐、新闻分类等任务的模型训练。

搜集汇总
数据集介绍
基于历史稿件库的新闻推荐排序数据集 数据集图片
背景与挑战
背景概述
该数据集收录了2015年至2022年间新华社编辑真实处理过的历史新闻稿件,并在此基础上补充了新闻类别、实体及向量表征等特征信息,以增强数据对推荐系统的支持。数据总量为3.61GB,共19个文件,可用于新闻选题推荐、分类等任务的模型训练与评估。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务