登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Hyperparameters for Atari Games 100K.
Hyperparameters for Atari Games 100K.
收藏
Figshare
2022-03-18 更新
2026-04-28 收录
强化学习超参数优化
AI基准测试
数据链接:
https://figshare.com/articles/dataset/Hyperparameters_for_Atari_Games_100K_/19384239
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Hyperparameters for Atari Games 100K.
应用场景:
创建时间:
2022-03-18
相关数据集
ClockBench
视觉推理
AI基准测试
ClockBench是一个视觉推理AI基准测试数据集,包含10个时钟(完整私有数据集包含180个时钟)。该数据集专门设计用于评估AI模型的视觉推理能力,通过OpenRouter API对选定模型进行评估和评分。
github
2025-09-04 更新
42
0
OmniaBench
通用AI代理评估
AI基准测试
OmniaBench是一个用于评估通用AI代理的广泛诊断基准,其场景知识来源于应用商店、产品文档、行业资源和网络检索,涵盖90个一级和354个二级领域。它通过四种互补的构建路线合成任务,包含1,431个任务,并提供一个644个任务的挑战子集用于高效评估。数据集支持十维能力分类和八个难度因素的细粒度分析。
github
2026-07-17 更新
33
0
Leading AI model score in HLE 2025
AI基准测试
通用智能评估
Leading artificial intelligence (AI) models in humanity's last exam (HLE) in 2025
Statista
14
0
ALL Bench Leaderboard 2026
AI基准测试
多模态AI
ALL Bench Leaderboard 2026是一个聚合并交叉验证了6种模态下91个AI模型的基准分数的数据集。每个数值分数都标记有置信级别(交叉验证、单一来源或自我报告)及其原始来源。该数据集专为需要可信、统一AI模型景观视图的研究人员、开发人员和决策者设计。
github
2026-03-08 更新
37
0
BackX
后门攻击
AI基准测试
BackX是一个基于后门攻击的解释性AI基准数据集,用于评估深度模型预测的归属方法。该数据集由西澳大学创建,旨在通过理论分析确保归属评估的可靠性。BackX通过控制特定的触发模式来系统地建立模型的归属真相,从而在不同底层方法中实现归属方法的一致和公平基准。该数据集的应用领域包括解释模型预测和建立模型信任,特别是在高风险任务中。
arXiv
2024-05-02 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广