登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Benchmark Results: DBpedia 100%
Benchmark Results: DBpedia 100%
收藏
Figshare
2017-04-28 更新
2026-04-08 收录
知识图谱评估
基准测试
数据链接:
https://figshare.com/articles/dataset/Benchmark_Results_DBpedia_100_/3205432/1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Results of the IGUANA Benchmark in 2015/16 for the initial 100% DBpedia dataset.
应用场景:
提供机构:
Axel-Cyrille Ngonga Ngomo
创建时间:
2016-04-29
相关数据集
ShareRobot-Bench
机器人共享
基准测试
ShareRobot测试集
Hugging Face
2025-08-04 更新
45
0
Agent安全评估数据集
LLM安全
基准测试
Agent Security Bench (ASB) 是一个面向LLM代理安全性的综合性基准框架,涵盖电子商务、自动驾驶、金融等10个场景,涉及10类代理、400余种工具与任务,集成23种攻击/防御方法及7项评估指标。数据集系统评估代理在多场景下的安全脆弱性与防御效能,支撑对提示注入、越权访问等典型攻击的测试。其主要应用于LLM代理的安全性基准评测,助力研发更鲁棒、可靠的智能代理系统。
库帕思
2025-12-22 更新
15
0
zizyphus/Edit3D-Bench
3D编辑
基准测试
该存储库包含Edit3D-Bench,这是一个3D编辑基准测试集,由论文《Feedforward 3D Editing via Text-Steerable Image-to-3D》提出。`metadata/`目录存储了纹理、移除和添加操作的元数据信息(源和目标对象的guid以及编辑文本),每个操作分别存储在一个单独的`.csv`文件中。`data/`目录包含未编辑对象的源图像、源和目标对象的gl
Hugging Face
2025-12-14 更新
10
0
open-llm-leaderboard/details_huggyllama__llama-30b
大型语言模型评估
基准测试
该数据集是在Open LLM Leaderboard上评估模型huggyllama/llama-30b时自动生成的。数据集由122个配置组成,每个配置对应一个评估任务。数据集由4次运行生成,每次运行在每个配置中表示为特定的分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。一个名为results的额外配置存储了所有运行的聚合结果,这些结果用于计算和显示Open LLM Leaderb
Hugging Face
2023-09-16 更新
17
0
karakuri-ai/OSWorld-JP-task-resources
计算机代理
基准测试
This repository provides resource files used in [OSWorld-JP](https://github.com/karakuri-ai/OSWorld-JP), a computer-using agent benchmark.
Hugging Face
2025-12-14 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广