登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Experimental results of image-text retrieval on ECCV Caption.
Experimental results of image-text retrieval on ECCV Caption.
收藏
Figshare
2025-10-10 更新
2026-04-28 收录
跨模态检索
图像文本匹配
数据链接:
https://figshare.com/articles/dataset/Experimental_results_of_image-text_retrieval_on_ECCV_Caption_/30333152
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Experimental results of image-text retrieval on ECCV Caption.
应用场景:
创建时间:
2025-10-10
相关数据集
SVTA (Synthetic Video-Text Anomaly benchmark)
异常检测
跨模态检索
The first large-scale dataset for cross-modal anomaly retrieval
kaggle
2025-09-14 更新
35
0
mair-lab/vismin
视觉语言
图像文本匹配
VisMin数据集由四种类型的最小变化组成——对象、属性、计数和空间关系——这些变化存在于两个图像-描述对之间。评估任务要求模型在给定两种情况下预测正确的图像-描述匹配:1)两张图片和一个描述,2)两个描述和一张图片。VisMin基准包含2,084个样本,分为579个对象、294个属性、589个计数和622个关系。
Hugging Face
2024-11-28 更新
19
0
document-visual-retrieval-test
视觉检索
跨模态检索
该数据集旨在通过测试其将查询与相关图像匹配的能力来评估视觉检索器的性能。每个示例包含一个文本查询和一个关联的图像,该图像是从基础论文“Attention is All You Need”中扫描的页面。数据集的目的是促进视觉检索器的评估,其中检索模型应准确地将每个查询与其对应的页面链接起来。数据集包含3个示例,图像类型为学术论文页面,适用于测试检索模型,特别是那些专注于跨模态检索的模型。数据集的预期
Hugging Face
2024-10-31 更新
11
0
CAViR Benchmark
异常检测
跨模态检索
The first large-scale dataset for cross-modal anomaly retrieval
kaggle
2026-03-30 更新
24
0
qwenemb_cirr
多模态检索
图像文本匹配
该数据集包含多个配置,主要用于图像和文本检索任务。每个配置具有特定的特征、数据划分和大小。核心特征包括查询文本('qry')、查询图像路径('qry_image_path')、正例文本('pos_text')和正例图像路径('pos_image_path')。部分配置还包含环境标签('env_label')和实例标识符('qry_inst', 'tgt_inst')。数据集划分为原始集('orig
Hugging Face
2026-03-14 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广