登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
pyspellchecker
pyspellchecker
收藏
OpenCSG
2024-06-04 更新
2026-01-19 收录
拼写检查
文本纠错
数据链接:
https://opencsg.com/datasets/MagicAI/pyspellchecker?tab=summary
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
使用纯Python进行拼写检查
应用场景:
提供机构:
MagicAI
创建时间:
2024-06-04
相关数据集
ai-forever/spellcheck_punctuation_benchmark
拼写检查
俄语
该数据集名为Russian Spellcheck Punctuation Benchmark,主要用于俄语拼写和标点校正任务。数据集包含四个子数据集,每个子数据集由包含拼写和标点错误的俄语句子及其校正后的句子对组成。数据来源多样,包括社交媒体、博客、GitHub提交、医学记录、文学作品、新闻和评论等。数据集经过两阶段的人工标注流程,确保校正的准确性。标注过程中,标注者被要求在不改变文本风格的前提下
Hugging Face
2024-04-03 更新
36
0
Chinese-Word-Vectors
自然语言处理
词向量
本项目提供超过100种中文词向量,其中包括不同的表示方式(稠密和稀疏)、不同的上下文特征(词、N元组、字等等)、以及不同的训练语料。获取预训练词向量非常方便,下载后即可用于下游任务。 此外,我们还提供了中文词类比任务数据集CA8和配套的评测工具,以便对中文词向量进行评估。
OpenCSG
2024-04-30 更新
14
0
Nikita88/spell_dataset_partial
拼写检查
机器学习
该数据集包含两个字符串类型的特征:错误(wrong)和正确(correct)。它有一个训练集,共有2039个示例。数据集的总大小为410213字节,下载大小为130384字节。
Hugging Face
2025-10-12 更新
9
0
智能文本纠错
文本纠错
自然语言处理
智能文本纠错模型结合海量的人工纠错文本数据和先进的语言生成模型,智能识别出人工输入文本中的错词错字、不规范表达、拼写错误、标点符号错误、顺序混乱等各种输入错误,并自动给出纠正建议。该模型可用于政策公文、法律法规、新闻通告、演讲致辞等对文本规范性要求较高的写作场景,通过模型自动纠正文本中的错误,极大提高文本写作的规范性,显著减少人工审核校订的成本。
华东江苏大数据交易中心
2024-12-04 更新
20
0
GPT2-chitchat
自然语言处理
闲聊对话
用于中文闲聊的GPT2模型(实现了DialoGPT的MMI思想)
OpenCSG
2024-06-03 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广