登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
AI Rankings 2026 | The Best Value for Your Logic
AI Rankings 2026 | The Best Value for Your Logic
收藏
kaggle
2026-03-12 更新
2026-03-21 收录
AI基准测试
AI定价
数据链接:
https://www.kaggle.com/datasets/sohaibdevv/which-ai-is-best-benchmark-and-pricing-dataset-2026
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
188+ models compared by price and performance.
对188款及以上模型进行了价格与性能两方面的对比
应用场景:
创建时间:
2026-03-12
相关数据集
MIMIC-III
AI基准测试
互联网服务
MIMIC-III数据集是由中国科学院计算技术研究所用于ICU患者监测场景的重要数据资源。该数据集包含了多种患者数据,如生命体征和液体平衡等,用于支持心脏衰竭预测和终点预测等AI基准测试。数据集的创建过程涉及从虚拟客户端设备收集数据,通过云服务器进行训练,并在边缘计算层进行预测。MIMIC-III数据集的应用领域主要集中在医疗健康领域,旨在通过AI技术提高ICU患者的监测效率和准确性。
arXiv
2019-08-06 更新
168
0
nasa-impact/WxC-Bench
气象预测
AI基准测试
--- license: mit --- # Dataset Card for WxC-Bench **WxC-Bench** primary goal is to provide a standardized benchmark for evaluating the performance of AI models in Atmospheric and Earth Sciences acr
Hugging Face
2026-02-02 更新
29
0
asingh15/arc-barc-processed-direct-max4k-gpt5.2abstractions-test-qwensols-5of16
推理评估
AI基准测试
--- dataset_info: features: - name: prompt dtype: string - name: responses list: string - name: abstractions list: string - name: train dtype: string - name: test dtype
Hugging Face
2025-12-14 更新
5
0
OmniaBench
通用AI代理评估
AI基准测试
OmniaBench是一个用于评估通用AI代理的广泛诊断基准,其场景知识来源于应用商店、产品文档、行业资源和网络检索,涵盖90个一级和354个二级领域。它通过四种互补的构建路线合成任务,包含1,431个任务,并提供一个644个任务的挑战子集用于高效评估。数据集支持十维能力分类和八个难度因素的细粒度分析。
github
2026-07-17 更新
35
0
math-ai-bench-sources-final
数学问题求解
AI基准测试
'math-ai-bench-pro' 是一个基于 'haowu89/math-ai-bench-sources-latest' 的按来源划分的数据集。该数据集包含多个配置(如 aime25、aime26、apex_2025、arxivmath、cmimc_2025、gpqa_diamond、hmmt_feb_2026、hmmt_nov_2025、imobench、olympiadbench、th
Hugging Face
2026-04-14 更新
14
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广