数据链接:
官方服务:
资源简介:
Benchmarking results supporting Manni et al. 2021
应用场景:
创建时间:
2021-06-18
相关数据集
karakuri-ai/OSWorld-JP-task-resources
This repository provides resource files used in [OSWorld-JP](https://github.com/karakuri-ai/OSWorld-JP), a computer-using agent benchmark.
Hugging Face2025-12-14 更新130
Cardicola forsteri assembly statistics.
Comparison between the assembly statistics of Cardicola forsteri and related digeneans. Scaffold statistics are not applicable to the C. forsteri assembly, which is contig-level. Benchmarking Universa
NIAID Data Ecosystem30
open-llm-leaderboard/details_huggyllama__llama-30b
该数据集是在Open LLM Leaderboard上评估模型huggyllama/llama-30b时自动生成的。数据集由122个配置组成,每个配置对应一个评估任务。数据集由4次运行生成,每次运行在每个配置中表示为特定的分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。一个名为results的额外配置存储了所有运行的聚合结果,这些结果用于计算和显示Open LLM Leaderb
Hugging Face2023-09-16 更新170
open-llm-leaderboard/details_chlee10__T3Q-Platypus-Mistral7B
该数据集是在评估模型chlee10/T3Q-Platypus-Mistral7B时自动生成的,包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行的结果作为一个特定的分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,results配置存储了所有运行的聚合结果,用于计算和展示在Open LLM Leaderboard上的聚合指标。
Hugging Face2024-03-12 更新90



