登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Machine learning metrics.
Machine learning metrics.
收藏
Figshare
2022-08-24 更新
2026-04-28 收录
情感分析
模型评估
数据链接:
https://figshare.com/articles/dataset/Machine_learning_metrics_/20605272
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Different metrics of the sentiment analysis model.
应用场景:
创建时间:
2022-08-24
相关数据集
open-llm-leaderboard-old/details_Steelskull__Umbra-MoE-4x10.7
模型评估
自然语言处理
该数据集是在Open LLM Leaderboard上对模型Steelskull/Umbra-MoE-4x10.7进行评估时自动创建的。数据集包含63个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行的结果存储为特定配置中的一个分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,还有一个名为results的配置,存储了所有运行的聚合结果,用于在Open LLM L
Hugging Face
2024-01-21 更新
21
0
Appendix D. The parameter estimates from the model fits with their AICc's.
统计建模
模型评估
The parameter estimates from the model fits with their AICc's.
DataCite Commons
2020-09-04 更新
9
0
arjun3103/haystack_faithfulness_evaluation
模型评估
自然语言处理
--- dataset_info: features: - name: questions dtype: string - name: contexts sequence: string - name: answers dtype: string - name: ans_type dtype: string - name: faithfuln
Hugging Face
2024-06-06 更新
8
0
open-llm-leaderboard-old/details_jsfs11__WildMBXMarconi-SLERP-7B
自然语言处理
模型评估
该数据集是在模型 jsfs11/WildMBXMarconi-SLERP-7B 在 Open LLM Leaderboard 上的评估运行期间自动创建的。数据集由 63 个配置组成,每个配置对应一个评估任务。它包含 1 次运行的结果,每次运行都作为每个配置中的一个特定分割存储。train 分割始终指向最新的结果。一个名为 results 的额外配置存储了所有运行的聚合结果,这些结果用于计算和显示
Hugging Face
2024-01-24 更新
14
0
tartuNLP/ifeval_et
自然语言处理
模型评估
ifeval_et是IFEval数据集的爱沙尼亚语版本,用于测量语言模型的指令遵循能力。每个示例都由专业翻译手动翻译并适应爱沙尼亚的文化背景。指令被修改以去除请求输出语言不是英语或爱沙尼亚语的情况。
Hugging Face
2025-12-30 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广