登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
AUT-NLP/Persian-Visual-Abstraction-Reasoning
AUT-NLP/Persian-Visual-Abstraction-Reasoning
收藏
Hugging Face
2024-12-11 更新
2024-12-14 收录
视觉推理
波斯语处理
数据链接:
https://hf-mirror.com/datasets/AUT-NLP/Persian-Visual-Abstraction-Reasoning
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
许可证:MIT许可证(MIT License)
应用场景:
提供机构:
AUT-NLP
相关数据集
VisualSphinx
视觉推理
逻辑谜题
VisualSphinx是最大的全合成开源视觉逻辑谜题数据集,包含超过66万个自动生成的逻辑视觉谜题。每个逻辑谜题都基于可解释的规则,并配有正确答案和合理的干扰项。
github
2025-06-03 更新
54
0
FaMTEB
波斯语处理
文本嵌入
FaMTEB是一个大规模的波斯语文本嵌入基准,由Sharif University of Technology创建。该数据集包含63个数据集,涵盖7个任务,包括分类、聚类、成对分类、重排、检索、摘要检索和语义文本相似度。数据集由现有数据、翻译数据和通过大型语言模型生成的新合成数据组合而成,为波斯语语言模型提供了多样化的评估框架。
arXiv
2025-02-17 更新
34
0
CLEVR (Compositional Language and Elementary Visual Reasoning)
视觉推理
人工智能测试
我们提出了一个诊断数据集,用于测试一系列视觉推理能力。它包含最小的偏差,并有详细的注释描述每个问题所需的推理类型。我们使用这个数据集来分析各种现代视觉推理系统,提供对其能力和局限性的新见解。
OpenDataLab
2026-07-12 更新
16
0
ClockBench
视觉推理
AI基准测试
ClockBench是一个视觉推理AI基准测试数据集,包含10个时钟(完整私有数据集包含180个时钟)。该数据集专门设计用于评估AI模型的视觉推理能力,通过OpenRouter API对选定模型进行评估和评分。
github
2025-09-04 更新
42
0
Sellopale/VisuLogic
视觉推理
多语言大语言模型
VisuLogic是一个新设计的基准数据集,旨在评估多模态大型语言模型(MLLMs)的视觉推理能力,独立于文本推理过程。它包含精心构建的视觉推理任务,涵盖多个类别,并根据所需的推理技能分为六种类型(例如,定量推理,涉及理解和推断图像中元素数量的变化)。与现有基准不同,VisuLogic是一个具有挑战性的视觉推理基准,难以用语言描述,从而更严格地评估MLLMs的视觉推理能力。大多数模型的准确率低于3
Hugging Face
2025-12-15 更新
25
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广