登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
hyperparameters selection and performance evaluation
hyperparameters selection and performance evaluation
收藏
科学数据银行
2025-04-17 更新
2026-04-23 收录
参数优化
模型评估
数据链接:
https://www.scidb.cn/detail?dataSetId=a6da0f5bf3a84f6e88d996d834df9f50
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
每个模型的最佳超参数和每个模型的评估结果
应用场景:
提供机构:
Shuailong Wang
创建时间:
2025-04-11
相关数据集
open-llm-leaderboard-old/details_Steelskull__Umbra-MoE-4x10.7
模型评估
自然语言处理
该数据集是在Open LLM Leaderboard上对模型Steelskull/Umbra-MoE-4x10.7进行评估时自动创建的。数据集包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行的结果存储为特定配置中的一个分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置,存储了所有运行的聚合结果,用于在Open LLM L
Hugging Face
2024-01-21 更新
21
0
Appendix D. The parameter estimates from the model fits with their AICc's.
统计建模
模型评估
The parameter estimates from the model fits with their AICc's.
DataCite Commons
2020-09-04 更新
9
0
Aratako/gemma-2-27b-evol-instruct-88k-dpo-judged
机器学习
模型评估
该数据集包含多个特征,如id、prompt、evol_history、evol_model、evol_generation、original_id、chosen_model、rejected_model、chosen、rejected、judge、raw_judge_prompt、raw_judge_output和judge_model。数据集分为一个训练集,包含88455个样本,总大小为1666
Hugging Face
2024-11-28 更新
8
0
open-llm-leaderboard-old/details_mosaicml__mpt-30b-instruct
模型评估
自然语言处理
该数据集是在模型mosaicml/mpt-30b-instruct在Open LLM Leaderboard上的评估运行期间自动创建的。数据集由64个配置组成,每个配置对应一个特定的评估任务。数据集是从2次运行中生成的,每次运行在每个配置中表示为特定的分割,使用运行的时间戳命名。train分割始终指向最新的结果。一个名为results的额外配置存储了所有运行的聚合结果,用于计算和显示Open LL
Hugging Face
2023-10-14 更新
12
0
tartuNLP/ifeval_et
自然语言处理
模型评估
ifeval_et是IFEval数据集的爱沙尼亚语版本,用于测量语言模型的指令遵循能力。每个示例都由专业翻译手动翻译并适应爱沙尼亚的文化背景。指令被修改以去除请求输出语言不是英语或爱沙尼亚语的情况。
Hugging Face
2025-12-30 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广