遇见数据集

VLM2Vec/B3-7b

收藏
Hugging Face2025-08-29 更新2025-09-13 收录
官方服务:

资源简介:

该数据集包含多个不同类型的视觉问答和图像相关任务,如A-OKVQA、CIRR、ChartQA等。每个数据集都包含训练集分割,且提供了示例数量和文件大小等信息。具体包括:

The dataset contains multiple types of visual question answering and image-related tasks such as A-OKVQA, CIRR, ChartQA, etc. Each dataset includes a training set split, and provides information such as the number of examples and file size. Specific details include:

提供机构:
VLM2Vec
搜集汇总
数据集介绍
VLM2Vec/B3-7b 数据集图片
背景与挑战
背景概述
VLM2Vec/B3-7b是一个大规模文本嵌入数据集,包含超过100万行数据,以Parquet格式存储,大小约为140 MB。数据集由多个视觉问答(VQA)子集组成,如A-OKVQA、MSCOCO等,用于支持视觉语言模型的嵌入任务,通过查询、图像路径和正负文本对来训练或评估模型性能。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务