GenEval
收藏arXiv2025-09-30 收录
数据链接:
官方服务:
资源简介:
该数据集名为GenEval,它是一个专为评估文本到图像生成模型而设计的基准测试。它对模型的生成能力提出了挑战,所属的任务类别是视觉生成。
This dataset, named GenEval, is a benchmark specifically designed for evaluating text-to-image generation models. It poses challenges to the generative capabilities of models and falls under the task category of visual generation.
搜集汇总
数据集介绍

背景与挑战
背景概述
GenEval是一个专注于对象评估的框架,用于衡量文本到图像生成模型在对象共现、位置、数量和颜色等组合属性上的对齐性能。它利用物体检测模型实现自动化评估,并与人类评估结果具有较高一致性,旨在弥补现有指标在细粒度分析方面的不足。该框架已公开代码,可用于分析模型的生成能力并发现失败模式。
以上内容由遇见数据集搜集并总结生成



