登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
FAspell
FAspell
收藏
kaggle
2017-07-14 更新
2024-03-08 收录
波斯语
拼写错误
数据链接:
https://www.kaggle.com/datasets/rtatman/faspell
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Naturally-occurring Persian (Farsi) spelling mistakes
自然发生的波斯语(法尔西语)拼写错误
应用场景:
创建时间:
2017-07-14
相关数据集
Hoda Farsi Digit Dataset
手写识别
波斯语
Hoda数据集是第一个手写波斯数字数据集,由Tarbiat Modarres大学的一个硕士项目开发,该项目名为:识别SANJESH注册表格中的波斯数字和字符。该项目与Hoda系统公司合作完成,于2005年夏季在Ehsanollah Kabir教授的监督下完成。数据集样本是从伊朗大学入学考试的约12000份注册表格中提取的手写字符。数据集规格如下:样本分辨率:200 dpi;总样本数:102,352
github
2024-04-17 更新
94
0
Persian_words_phonetics_dataset
波斯语
语音学
这是一个包含超过40,000个波斯语单词及其语音信息的数据集。每个单词都在单独的一行,并通过制表符与其语音信息分隔。
github
2021-11-27 更新
17
0
xmanii/Persian-Math-SFT
波斯语
数学教育
这是一个以数学概念为主的波斯语问题数据集,用于监督微调(SFT)语言模型。数据集包含高质量的问题、详细的子主题分类、关注数学概念以及每个对话的字符计数。适用于波斯语数学问答的微调、创建教育AI助手和发展波斯语辅导系统。
Hugging Face
2025-02-14 更新
12
0
farsi-asr/farsi-asr-dataset
波斯语
自动语音识别
Farsi ASR Dataset是最大的开源波斯语自动语音识别(ASR)数据集,从各种来源收集而成。该数据集包含了大量的波斯语音频转录数据,用于自动语音识别研究。
Hugging Face
2025-03-13 更新
19
0
David-ger/Persian-tts-finglish
文本到语音
波斯语
该数据集包含音频、文本和手动标注数据,适用于机器学习模型的训练。数据集分为训练集,包含19458个示例,总大小约为3.76GB。数据集支持音频特征的解码,并提供文本和文本GPT5迷你版的数据类型。
Hugging Face
2025-10-24 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广