遇见数据集

VLM2Vec/B3-2b

收藏
Hugging Face2025-08-29 更新2025-09-13 收录
官方服务:

资源简介:

该数据集包含多个不同类型的视觉问答和图像处理相关的子数据集,例如A-OKVQA、CIRR、ChartQA等。每个子数据集都包含训练集信息,包括数据集的字节数和示例数量。这些数据集可能用于训练机器学习模型以理解和生成有关图像和图表的问答。

The dataset consists of multiple sub-datasets related to visual question answering and image processing tasks, such as A-OKVQA, CIRR, ChartQA, etc. Each sub-dataset contains training set information, including the number of bytes and examples. These datasets may be used to train machine learning models to understand and generate questions and answers about images and charts.

提供机构:
VLM2Vec
搜集汇总
数据集介绍
VLM2Vec/B3-2b 数据集图片
背景与挑战
背景概述
VLM2Vec/B3-2b是一个文本模态的嵌入数据集,采用parquet格式,规模在百万到千万行级别,总行数超过100万。该数据集包含多个视觉问答(VQA)子集,如A-OKVQA、MSCOCO等,用于训练和评估视觉语言模型的表示学习能力,支持图像和文本的联合嵌入任务。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务