遇见数据集

生成图像理解数据集

收藏
官方服务:

资源简介:

生成图像理解数据集(JourneyDB)主要面向生成式多模态大模型理解研究、解决生成式内容理解与多维度评估的实际需求建设。在AIGC技术快速演进的背景下,如何精准理解和评估模型生成的高质量图像成为一项重要挑战。本数据集基于Midjourney及Stable Diffusion等主流文生图模型产生,图像数据主要通过自动化工具从公开渠道采集并结合开源模型生成扩展,其文本标注则基于GPT-4等大语言模型进行智能解析并辅以严格的人工校验。 本数据集主要记录了高分辨率虚拟生成图像、对应的完整文本提示词(Prompt)、提示词成分细粒度解析(包括风格Style、内容Content、氛围Atmosphere)、图像自然语言概括描述(Caption),以及针对图像风格和内容的视觉问答(VQA)等多维度观测值与标注信息。 该数据集的建设为生成式图像的质量评估、提示词特征解析及多模态语义对齐提供了丰富、高精度的数据基准,极大填补了生成式内容细粒度理解领域的空白,具有重要的学术研究与工程应用意义。数据集包含40余万张高质量图像,数据量为307GB

提供机构:
香港中文大学
二维码
社区交流群
二维码
科研交流群
商业服务