登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
TypeZilla
TypeZilla
收藏
NIAID Data Ecosystem
2026-03-12 收录
软件类型系统
错误检测
数据链接:
https://zenodo.org/record/5417063
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This is the replication package of TypeZilla (ICSE'22 submission)
应用场景:
创建时间:
2021-09-04
相关数据集
red_ace_asr_error_detection_and_correction
自动语音识别
错误检测
# **RED-ACE** ## Dataset Summary This dataset can be used to train and evaluate **ASR Error Detection or Correction** models. It was introduced in the [RED-ACE paper (Gekhman et al, 2022)](https:/
魔搭社区
2026-04-28 更新
20
0
github-typo-corpus
自然语言处理
错误检测
GitHub Typo Corpus: 大规模多语言拼写错误和语法错误数据集。这是一个用于研究和改进拼写错误和语法错误检测的多语言大规模数据集。
OpenCSG
2024-06-04 更新
16
0
ProJudgeBench, ProJudge-173k
多模态模型评估
错误检测
ProJudgeBench是第一个专门设计用于评估基于多模态大语言模型的过程判断能力的综合基准测试。它包含2,400个测试案例和50,118个步骤级标签,涵盖四个科学学科,具有不同的难度级别和多模态内容。每个步骤都由人类专家精心注释,以评估判断者检测、分类和诊断错误的能力。ProJudge-173k是一个大规模指令调优数据集,旨在通过动态双阶段微调策略增强开源模型的过程评估能力。
github
2025-03-11 更新
11
0
MMRefine
多模态语言模型
错误检测
该数据集是一个旨在评估多模态大型语言模型(MLLMs)在六种不同错误场景下的错误修正能力的基准测试。它将错误分为六类,并提供了关于MLLMs修正性能的深入见解。该基准测试涵盖了多种MLLMs,包括闭源和开源模型,其任务重点是MLLMs中的错误检测与纠正。
arXiv
20
0
bigbench_mistake_eval_z_DeepSeek-R1-Distill-Llama-70B
代码生成
错误检测
这是一个包含输入文本、步骤、答案以及多个完成选项的数据集,用于评估特定模型在dyck语言相关任务上的表现。数据集共有280个示例,适用于代码生成和错误检测等场景。
Hugging Face
2025-06-17 更新
14
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广