登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
The test patterns.
The test patterns.
收藏
Figshare
2021-07-06 更新
2026-04-28 收录
编码评估
图像测试模式
数据链接:
https://figshare.com/articles/dataset/The_test_patterns_/14917202
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
ZIP file containing archived black and white patterns used for autoencoder testing. (ZIP)
应用场景:
创建时间:
2021-07-06
相关数据集
BaxBench
软件安全
编码评估
BaxBench是一个编码基准测试,用于评估LLM在生成正确和安全代码的能力,特别是在现实世界的安全关键设置中。
github
2025-02-26 更新
52
0
MSR2022 Encoding Study Data
软件性能学习
编码评估
该数据集是从一次实证研究中收集的,该研究比较了在多个系统和模型中用于软件性能学习的编码方案的性能。数据集涵盖了105个不同模型与编码方案组合的案例结果。任务是对用于软件性能学习的编码方案进行评估。
arXiv
12
0
Pixel-Linguist/rendered-sts17
多语言文本理解
编码评估
--- annotations_creators: - crowdsourced language_creators: - crowdsourced - found - machine-generated license: - other multilinguality: - multilingual size_categories: - 10K<n<100K task_ids: - text-s
Hugging Face
2024-09-13 更新
11
0
Scoring-Verifiers
编码评估
合成验证
# Scoring Verifiers Scoring Verifiers is a set of 4 benchmarks that evaluate the scoring and ranking capabilities of synthetic verifiers such as test case generation and reward modelling. You can fi
魔搭社区
2025-10-09 更新
14
0
llama-duo/llama3-3b-coding-eval-by-gemini15flash
编码评估
模型评估
这是一个包含机器学习模型响应评估的数据集,它包括了指令、目标响应、候选响应、模型ID、模型SHA、评估提示、相似度评分、精确度评分和评估者信息等字段。数据集包含了一个split,名为llama3_3b_coding_gpt4o_100k_by_gemini1_5flash,共有64个示例,大小为737,522字节。数据集的总大小为737,522字节,下载大小为220,357字节。
Hugging Face
2025-04-02 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广