登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
dura-garage/nep-spell-100k
dura-garage/nep-spell-100k
收藏
Hugging Face
2024-02-17 更新
2024-03-04 收录
拼写校正
尼泊尔语
数据链接:
https://hf-mirror.com/datasets/dura-garage/nep-spell-100k
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
这是一个包含10万句对的尼泊尔语拼写校正数据集。
这是一个包含10万句对的尼泊尔语拼写校正数据集。
应用场景:
提供机构:
dura-garage
原始信息汇总
数据集概述
数据集名称
100k Sentence Pairs for Nepali Spelling Correction
许可证
MIT
相关数据集
Sakonii/nepalitext-language-model-dataset
自然语言处理
尼泊尔语
NepaliText语言建模数据集是一个包含超过1300万条尼泊尔语文本序列(短语/句子/段落)的集合,这些序列是通过结合OSCAR、cc100数据集以及从维基百科抓取的尼泊尔语文章提取而成的。该数据集主要用于预训练尼泊尔语的语言模型和词表示。数据集中可能包含其他语言的实例。
Hugging Face
2022-10-25 更新
15
0
dura-garage/nep-spell-50k
--- license: mit ---
Hugging Face
2024-02-18 更新
10
0
Nepali Text Corpus
自然语言处理
尼泊尔语
Considering the ongoing works in Natural Language Processing (NLP) with the Nepali language, it is evident that the use of Artificial Intelligence and NLP on this Devanagari script has still a long wa
Mendeley Data
2024-01-31 更新
9
0
ArchiRad/russian-spell-correction-dataset
自然语言处理
拼写校正
该数据集包含两个字符串类型的字段:corrupted和correct,表示损坏的文本和正确的文本。数据集仅包含一个训练集split,共有1376个示例。
Hugging Face
2025-10-19 更新
12
0
LocalDoc/azerbaijani_spell_corrector_dataset
自然语言处理
拼写校正
阿塞拜疆语拼写纠正数据集,主要用于文本到文本生成任务,特别是拼写纠正。数据集包含两个主要特征:incorrect_sentence和correct_sentence,分别表示错误的句子和纠正后的句子。数据集分为一个训练集,包含1,350,991个例子,总大小为308,737,084字节。数据集的语言为阿塞拜疆语(az),许可证为cc-by-nc-4.0。
Hugging Face
2024-12-04 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广