登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Contrastive Language Image Pretraining by openai
Contrastive Language Image Pretraining by openai
收藏
kaggle
2026-06-11 更新
2024-03-08 收录
图像与文本
预训练模型
数据链接:
https://www.kaggle.com/datasets/codenamekash/contrastive-language-image-pretraining-by-openai
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
CLIP: Connecting Text and Images
CLIP:连接文本与图像
应用场景:
创建时间:
2021-01-07
相关数据集
PeaTMOSS
预训练模型
开源软件
PeaTMOSS数据集由普渡大学等研究机构创建,包含281,638个预训练模型(PTMs)的元数据,以及28,575个使用这些模型的开源软件仓库。数据集不仅记录了模型的元数据,还包括了模型在下游应用中的使用情况。通过自动提取模型元数据,如训练数据集、参数和评估指标,增强了数据集的全面性。该数据集为研究PTM供应链提供了基础,有助于理解PTM的开发趋势和文档中的常见不足,以及在软件许可方面的不一致性
arXiv
2024-02-01 更新
17
0
ih138/my_awesome_eli5_mlm_model
自然语言处理
预训练模型
该数据集包含两个主要特征:input_ids和attention_mask,分别表示为int32和int8类型的序列。数据集分为训练集和测试集,训练集包含4000个样本,测试集包含1000个样本。数据集的下载大小为3587573字节,总大小为8464880字节。数据文件路径分别为data/train-*和data/test-*。
Hugging Face
2024-07-10 更新
12
0
fineweb-edu-10BT-shuffled-for-gpt2
自然语言处理
预训练模型
Tokenized Fineweb-edu (10BT, shuffled version) for pre-training GPT2 model.
kaggle
2024-07-26 更新
10
0
neoneye/simon-arc-rle-row-v1
抽象推理
图像与文本
该数据集名为simons ARC (抽象与推理语料库) RLE (游程编码) 行版本 1,主要涉及图像到文本和文本到图像的任务,使用英语作为主要语言。数据集的大小在10,000到100,000之间,包含一个默认配置,其中训练数据存储在data.jsonl文件中。
Hugging Face
2024-07-10 更新
15
0
Doub7e/SD-CLIP-alignment-composition-T5
图像与文本
深度学习
--- dataset_info: features: - name: image dtype: image - name: prompt dtype: string - name: clip_pred dtype: string - name: T5_last_hidden_states sequence: sequence:
Hugging Face
2023-10-06 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广