登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
The mean AUROC of all algorithms on all datasets using independent holdout data.
The mean AUROC of all algorithms on all datasets using independent holdout data.
收藏
Figshare
2015-12-02 更新
2026-04-29 收录
机器学习模型评估
算法基准测试
数据链接:
https://figshare.com/articles/dataset/_The_mean_AUROC_of_all_algorithms_on_all_datasets_using_independent_holdout_data_/216616
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This validation is unbiased.
应用场景:
创建时间:
2015-12-02
相关数据集
trollek/Panoia-v01
自然语言处理
机器学习模型评估
这是一个小型的Ultrachat样本数据集,正在进行中,使用了提示评估作为蒸馏方法,并使用了多个高质量的开源模型来回答这些评估过的提示。数据集的质量不高,有些指令只是从一个更大的提示中提取的一行(可能是一个食谱),并建议未来的改进应该包括对部分指令的响应,而不是假设这些部分指令是可操作的。
Hugging Face
2024-07-18 更新
18
0
open-vdb/gist-960-euclidean
近似最近邻搜索
算法基准测试
该数据集名为gist-960-euclidean,用于基准测试和研究目的。数据集包括训练集和测试集,其中包含GIST特征向量嵌入,以及一个邻居集,包含关于最近邻居的信息。数据集的地标部分(包括但不限于注释、标签和评估指标)遵循Apache 2.0许可证。用户必须遵守原始数据源的相应许可证。
Hugging Face
2025-01-07 更新
14
0
Benchmarks for the speed of the dissimilarity metric.
相异度度量
算法基准测试
Benchmarks for the speed of the dissimilarity metric.
NIAID Data Ecosystem
6
0
RussianNLP/repa
自然语言处理
机器学习模型评估
REPA是一个俄语语言数据集,包含1003个经过分类的用户查询和六个开源指令微调的LLMs的回答。数据集提供了针对10种错误类型和总体印象的细粒度人工偏好标注。
Hugging Face
2025-03-18 更新
14
0
Quantitative comparisons between our proposed method and other models on the GML(B) benchmark dataset.
机器学习模型评估
分类任务
The first four columns are the F1 scores for different classes, and the last two columns are the AvgF1 and compute time.
Figshare
2023-02-10 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广