登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Model fit indices for the 2- to 10- class models.
Model fit indices for the 2- to 10- class models.
收藏
Figshare
2018-02-15 更新
2026-04-29 收录
潜在类别分析
模型评估
数据链接:
https://figshare.com/articles/dataset/Model_fit_indices_for_the_2-_to_10-_class_models_/5888791
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Model fit indices for the 2- to 10- class models.
应用场景:
创建时间:
2018-02-15
相关数据集
GRACE
自然语言处理
模型评估
GRACE数据集是由马里兰大学、伯克利加州大学和孟买印度理工学院的研究人员创建的,用于评估语言模型校准的细粒度基准。该数据集包含由专家编写的问题,每个问题至少有五个逐渐变简单的线索,这些问题在实时的人类与模型竞赛中收集。数据集旨在通过将人类的表现作为参考点,来测量模型的校准性能。
arXiv
2025-02-27 更新
27
0
open-llm-leaderboard-old/details_qblocks__codellama_7b_DolphinCoder
模型评估
自然语言处理
该数据集是在模型[qblocks/codellama_7b_DolphinCoder](https://huggingface.co/qblocks/codellama_7b_DolphinCoder)在[Open LLM Leaderboard](https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard)上的评估运行期间自动
Hugging Face
2024-01-05 更新
14
0
EpistemeAI2__Fireball-Alpaca-Llama3.1.08-8B-C-R1-KTO-Reflection
人工智能
模型评估
该数据集包含多个特征字段,如问题、正确答案、目标、预测、子集等,并包含多个评分和提取的答案字段,可能用于评估模型性能。数据集分为一个训练集,包含1324个样本,总大小为2796313字节。
Hugging Face
2025-01-08 更新
11
0
open-llm-leaderboard-old/details_bn22__Nous-Hermes-2-SOLAR-10.7B-MISALIGNED
模型评估
自然语言处理
该数据集是在评估模型bn22/Nous-Hermes-2-SOLAR-10.7B-MISALIGNED在Open LLM Leaderboard上的表现时自动创建的。数据集由63个配置组成,每个配置对应一个评估任务。数据集从1次运行中创建,每次运行可以在每个配置中找到特定的分割,分割名称使用运行的时间戳。train分割始终指向最新的结果。此外,results配置存储了所有运行的聚合结果,并用于计算
Hugging Face
2024-01-04 更新
14
0
open-llm-leaderboard/details_ashercn97__manatee-7b
模型评估
学科知识
该数据集是在模型 ashercn97/manatee-7b 在 Open LLM Leaderboard 上的评估运行期间自动创建的。数据集由 64 个配置组成,每个配置对应一个被评估的任务。数据集是从 2 次运行中生成的,每次运行在每个配置中表示为特定的分割,分割名称使用运行的时间戳。train 分割始终指向最新的结果。一个名为 results 的额外配置存储了所有运行的聚合结果,这些结果用于计
Hugging Face
2023-09-17 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广