登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Ablation study of pycorrector on AISHELL-1 test sets.
Ablation study of pycorrector on AISHELL-1 test sets.
收藏
Figshare
2025-07-07 更新
2026-04-28 收录
中文语法纠错
语音识别后处理
数据链接:
https://figshare.com/articles/dataset/Ablation_study_of_pycorrector_on_AISHELL-1_test_sets_/29495370
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Ablation study of pycorrector on AISHELL-1 test sets.
应用场景:
创建时间:
2025-07-07
相关数据集
SIGHAN
中文语法纠错
拼写检查
SIGHAN数据集由学者公开提供,是用于中文文本纠错的资源。目前,它包括三个版本:SIGHAN2013、SIGHAN2014和SIGHAN2015。该任务的目标是评估模型在中文拼写检查方面的熟练程度,涉及不同的子任务,例如检测错误位置和执行错误纠正。
ir.itc.ntnu.edu.tw
337
0
FCGEC 中文语法检错纠错数据集
中文语法纠错
自然语言处理
FCGEC 全称 Fine-Grained Corpus for Chinese Grammatical Error Correction,是一个大规模母语使用者的多参考文本纠检错语料, 用于训练以及评估纠检错模型系统,数据来源主要是小初高中学生的病句试题以及新闻聚合网站。
超神经
2023-12-27 更新
26
0
LLMs’ Overuse of linguistic devices.
中文语法纠错
语言模型错误分析
Large language models (LLMs) have recently exhibited significant capabilities in various English NLP tasks. However, their performance in Chinese grammatical error correction (CGEC) remains unexplored
Figshare
2024-10-30 更新
7
0
中文文本纠错语料
中文语法纠错
该数据集包含从中文文字版PDF文档中自动化提取的文本纠错语料,用于训练和评估中文文本纠错系统。
github
2024-08-17 更新
114
0
MuCGEC
中文语法纠错
评估方法
MuCGEC是由苏州大学人工智能研究院和阿里巴巴达摩院合作创建的中文语法错误修正评估数据集,包含7063个来自三个不同中文作为第二语言学习者来源的句子。每个句子由三位注释者独立修正,并由一位资深注释者进行最终审查,平均每个句子有2.3个参考修正。数据集旨在支持中文语法错误修正(CGEC)的研究,通过提供多参考和多来源的数据,增强模型的评估可靠性。此外,数据集还探讨了CGEC评估方法,包括多参考的影
arXiv
2022-05-04 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广