登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
ICPM 2024 Paper Stack Code [phduc207]
ICPM 2024 Paper Stack Code [phduc207]
收藏
kaggle
2026-04-23 更新
2026-05-09 收录
过程挖掘算法
基准测试
数据链接:
https://www.kaggle.com/datasets/phduc207/icpm2024-paper-stack-code
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Paper stack code payload for same-sample benchmark notebooks
用于同样本基准测试笔记本的论文代码栈有效载荷
应用场景:
创建时间:
2026-04-19
相关数据集
decompile-bench-raw
软件逆向工程
基准测试
这是一个包含100M条目的原始数据集,用于decompile-bench。具体的数据集内容没有详细说明。
Hugging Face
2025-06-05 更新
27
0
Agent安全评估数据集
LLM安全
基准测试
Agent Security Bench (ASB) 是一个面向LLM代理安全性的综合性基准框架,涵盖电子商务、自动驾驶、金融等10个场景,涉及10类代理、400余种工具与任务,集成23种攻击/防御方法及7项评估指标。数据集系统评估代理在多场景下的安全脆弱性与防御效能,支撑对提示注入、越权访问等典型攻击的测试。其主要应用于LLM代理的安全性基准评测,助力研发更鲁棒、可靠的智能代理系统。
库帕思
2025-12-22 更新
15
0
open-llm-leaderboard/details_chlee10__T3Q-Platypus-Mistral7B
大型语言模型评估
基准测试
该数据集是在评估模型chlee10/T3Q-Platypus-Mistral7B时自动生成的,包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行的结果作为一个特定的分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,results配置存储了所有运行的聚合结果,用于计算和展示在Open LLM Leaderboard上的聚合指标。
Hugging Face
2024-03-12 更新
9
0
RL Unplugged
离线强化学习
基准测试
RL Unplugged是由DeepMind创建的一套用于离线强化学习方法评估的基准套件。该数据集涵盖了从Atari游戏到模拟运动控制问题等多个领域的数据,包括部分或完全可观察的领域、连续或离散的动作空间以及随机与确定性的动态。数据集旨在通过详细的评估协议,促进离线RL方法的研究和比较,提高实验的可重复性,并使RL研究对更广泛的社区更加系统和可访问。
arXiv
2021-02-13 更新
22
0
International land Model Benchmarking (ILAMB) Package v001.00
陆地模型
基准测试
As a contribution to International Land Model Benchmarking (ILAMB) Project, we are providing new analysis approaches, benchmarking tools, and science leadership. The goal of ILAMB is to assess and imp
DataCite Commons
2021-07-15 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广