遇见数据集

全媒体内容场景分类与数据标引知识工厂新闻知识图谱实体库

收藏
官方服务:

资源简介:

数据内容:新闻知识图谱构建的数据成果,知识库标引条目584万件。不涉及个人隐私、社会机构及公共利益等敏感数据。 采集方案:通过收集公开数据、购买数据、通过算法自动提取及人工标注、审核等多种方案进行数据采集。 时间及地点:采集于2022年-2024年,媒体融合生产技术与系统国家实验室智能化视频生产系统研究部,杭州。 设备情况:阿里云ECS云服务器,站点数据采集平台V1.0

搜集汇总
数据集介绍
全媒体内容场景分类与数据标引知识工厂新闻知识图谱实体库 数据集图片
背景与挑战
背景概述
该数据集是面向全媒体内容场景分类与数据标引的新闻知识图谱实体库,包含约584万条标引条目,数据量1.64GB,以csv和docx格式存储。数据采集于2022至2024年间,在杭州通过公开数据收集、购买、算法自动提取及人工标注审核等多种方式获取,不涉及个人隐私及敏感信息。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务