登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Exploring LSR & WWA Datasets
Exploring LSR & WWA Datasets
收藏
DataONE
2025-06-17 更新
2025-06-28 收录
气象预报
模型评估
数据链接:
https://search.dataone.org/view/sha256:d37263c19c317bc88783ca6a00893047e55813827ca90638178aab9bff3c1eac
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Leveraging Operational Datasets to Evaluate Forecast Lead Time and Model Performance
应用场景:
创建时间:
2025-06-21
相关数据集
open-llm-leaderboard-old/details_Steelskull__Umbra-MoE-4x10.7
模型评估
自然语言处理
该数据集是在Open LLM Leaderboard上对模型Steelskull/Umbra-MoE-4x10.7进行评估时自动创建的。数据集包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行的结果存储为特定配置中的一个分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置,存储了所有运行的聚合结果,用于在Open LLM L
Hugging Face
2024-01-21 更新
21
0
Appendix D. The parameter estimates from the model fits with their AICc's.
统计建模
模型评估
The parameter estimates from the model fits with their AICc's.
DataCite Commons
2020-09-04 更新
9
0
tartuNLP/ifeval_et
自然语言处理
模型评估
ifeval_et是IFEval数据集的爱沙尼亚语版本,用于测量语言模型的指令遵循能力。每个示例都由专业翻译手动翻译并适应爱沙尼亚的文化背景。指令被修改以去除请求输出语言不是英语或爱沙尼亚语的情况。
Hugging Face
2025-12-30 更新
9
0
open-llm-leaderboard-old/details_jsfs11__WildMBXMarconi-SLERP-7B
自然语言处理
模型评估
该数据集是在模型 jsfs11/WildMBXMarconi-SLERP-7B 在 Open LLM Leaderboard 上的评估运行期间自动创建的。数据集由 63 个配置组成,每个配置对应一个评估任务。它包含 1 次运行的结果,每次运行都作为每个配置中的一个特定分割存储。train 分割始终指向最新的结果。一个名为 results 的额外配置存储了所有运行的聚合结果,这些结果用于计算和显示
Hugging Face
2024-01-24 更新
14
0
HWERI/openorca-multiplechoice-5k-comparisons
模型评估
多选题生成
该数据集是beaugogh/openorca-multiplechoice-10k的一个子集,其中添加了模型生成的响应作为被拒绝的响应。使用的模型是beaugogh/Llama2-7b-openorca-mc-v2。
Hugging Face
2023-09-09 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广