遇见数据集

nielsr/wit_300m

收藏
Hugging Face2024-10-07 更新2024-12-14 收录
官方服务:

资源简介:

该数据集包含图像的URL和对应的描述文本。数据集分为一个训练集,包含300,655,193个样本,总大小为88,721,125,605字节。下载大小为56,916,934,372字节。

This dataset contains URLs of images and their corresponding captions. The dataset is divided into a training set with 300,655,193 samples, totaling 88,721,125,605 bytes. The download size is 56,916,934,372 bytes.

提供机构:
nielsr
搜集汇总
数据集介绍
nielsr/wit_300m 数据集图片
背景与挑战
背景概述
wit_300m是一个大规模多模态数据集,包含约3.01亿条图像-文本对,每条数据由图像URL和对应的详细英文描述文本组成。该数据集源自论文《From Scarcity to Efficiency: Improving CLIP Training via Visual-enriched Captions》,主要用于训练视觉-语言模型(如CLIP),以提升多模态表示学习效率。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务