登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Performance of ensemble method with different top n and threshold T.
Performance of ensemble method with different top n and threshold T.
收藏
Figshare
2018-04-11 更新
2026-04-29 收录
模型评估
参数优化
数据链接:
https://figshare.com/articles/dataset/Performance_of_ensemble_method_with_different_top_i_n_i_and_threshold_i_T_i_/6123251
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Performance of ensemble method with different top n and threshold T.
应用场景:
创建时间:
2018-04-11
相关数据集
open-llm-leaderboard-old/details_Kiddyz__testlm2
模型评估
自然语言处理
该数据集是在模型Kiddyz/testlm2的评估运行中自动创建的,包含了61个配置,每个配置对应一个评估任务。数据集从1次运行中创建,每次运行都可以在特定配置中找到,分割名称使用运行的时间戳命名。train分割始终指向最新的结果。此外,还有一个名为results的配置存储了所有运行的聚合结果,用于计算和显示在Open LLM Leaderboard上的聚合指标。
Hugging Face
2023-08-27 更新
30
0
open-llm-leaderboard-old/details_Josephgflowers__Cinder-Phi-2-STEM-2.94B-Test
模型评估
自然语言处理
该数据集是在评估模型Josephgflowers/Cinder-Phi-2-STEM-2.94B-Test时自动创建的,用于在Open LLM Leaderboard上进行评估。数据集包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行的结果作为一个特定的分割存储,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,results配置存储了所有运行的聚合结果,用于
Hugging Face
2024-02-18 更新
11
0
tartuNLP/ifeval_et
自然语言处理
模型评估
ifeval_et是IFEval数据集的爱沙尼亚语版本,用于测量语言模型的指令遵循能力。每个示例都由专业翻译手动翻译并适应爱沙尼亚的文化背景。指令被修改以去除请求输出语言不是英语或爱沙尼亚语的情况。
Hugging Face
2025-12-30 更新
9
0
open-llm-leaderboard-old/details_w601sxs__b1ade-1b
模型评估
自然语言处理
--- pretty_name: Evaluation run of w601sxs/b1ade-1b dataset_summary: "Dataset automatically created during the evaluation run of model\ \ [w601sxs/b1ade-1b](https://huggingface.co/w601sxs/b1ade-1b)
Hugging Face
2023-09-17 更新
19
0
Appendix D. The parameter estimates from the model fits with their AICc's.
统计建模
模型评估
The parameter estimates from the model fits with their AICc's.
DataCite Commons
2020-09-04 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广