遇见数据集

跨媒体常识表征库

收藏
官方服务:

资源简介:

跨媒体常识表征库主要包括4种数据类型:文本数据、图像数据、音频数据、视频数据。数据规模30.1万节点。文本数据:301020个;图像数据:311293;视频数据:10395个;音频数据10424个。

提供机构:
江西财经大学
搜集汇总
数据集介绍
跨媒体常识表征库 数据集图片
背景与挑战
背景概述
跨媒体常识表征库是一个包含文本、图像、音频和视频四种模态数据的多模态常识资源,总节点数约为30.1万,其中文本数据301020个、图像数据311293个、视频数据10395个、音频数据10424个。该数据集由江西财经大学方玉明、姜文晖创建,数据总量约1.33TB,包含179181个文件,版本为v1.0,旨在为跨媒体常识表征研究提供基础数据支持。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务