VLM2Vec/B3-7b
收藏官方服务:
资源简介:
该数据集包含多个不同类型的视觉问答和图像相关任务,如A-OKVQA、CIRR、ChartQA等。每个数据集都包含训练集分割,且提供了示例数量和文件大小等信息。具体包括:
The dataset contains multiple types of visual question answering and image-related tasks such as A-OKVQA, CIRR, ChartQA, etc. Each dataset includes a training set split, and provides information such as the number of examples and file size. Specific details include:
提供机构:
VLM2Vec搜集汇总
数据集介绍

背景与挑战
背景概述
VLM2Vec/B3-7b是一个大规模文本嵌入数据集,包含超过100万行数据,以Parquet格式存储,大小约为140 MB。数据集由多个视觉问答(VQA)子集组成,如A-OKVQA、MSCOCO等,用于支持视觉语言模型的嵌入任务,通过查询、图像路径和正负文本对来训练或评估模型性能。
以上内容由遇见数据集搜集并总结生成



