遇见数据集

GenEval

收藏
arXiv2025-09-30 收录
数据链接:
官方服务:

资源简介:

该数据集名为GenEval,它是一个专为评估文本到图像生成模型而设计的基准测试。它对模型的生成能力提出了挑战,所属的任务类别是视觉生成。

This dataset, named GenEval, is a benchmark specifically designed for evaluating text-to-image generation models. It poses challenges to the generative capabilities of models and falls under the task category of visual generation.

搜集汇总
数据集介绍
GenEval 数据集图片
背景与挑战
背景概述
GenEval是一个专注于对象评估的框架,用于衡量文本到图像生成模型在对象共现、位置、数量和颜色等组合属性上的对齐性能。它利用物体检测模型实现自动化评估,并与人类评估结果具有较高一致性,旨在弥补现有指标在细粒度分析方面的不足。该框架已公开代码,可用于分析模型的生成能力并发现失败模式。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务