UCSC-VLAA/Recap-COCO-30K
收藏资源简介:
Llava recaptioned COCO2014 ValSet数据集用于文本到图像生成评估。包含特征:image_id(COCO图像ID),coco_url(COCO图像URL),image(图像),caption(原始COCO描述),recaption(LLaVA重新描述的COCO描述)。数据集大小在10K到100K之间。
The Llava recaptioned COCO2014 ValSet dataset is used for text-to-image generation evaluation. It includes features such as image_id (COCO image ID), coco_url (COCO image URL), image (image), caption (original COCO caption), and recaption (LLaVA recaptioned COCO caption). The dataset size ranges between 10K and 100K.
数据集概述
许可证
- CC BY 4.0
任务类别
- 文本到图像生成
数据集大小
- 10K<n<100K
数据集信息
- 特征列表
image_id(int64): 图像IDcoco_url(string): COCO图像URLimage(Image): 图像数据caption(string): 原始COCO描述recaption(string): LLaVA重新描述的COCO描述
数据集结构
- 字段描述
image_id(str): COCO图像IDcoco_url(image): COCO图像URLcaption(str): 原始COCO描述recaption(str): LLaVA重新描述的COCO描述
引用
-
BibTeX:
@article{li2024recapdatacomp, title={What If We Recaption Billions of Web Images with LLaMA-3?}, author={Li, Xianhang and Tu, Haoqin and Hui, Mude and Wang, Zeyu and Zhao, Bingchen and Xiao, Junfei and Ren, Sucheng and Mei, Jieru and Liu, Qing and Zheng, Huangjie and Zhou, Yuyin and Xie, Cihang}, journal={arXiv preprint arXiv:2406.12345}, year={2024} }




