登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
suvradeepp/English-Gujrati-OCR-Images
suvradeepp/English-Gujrati-OCR-Images
收藏
Hugging Face
2025-04-03 更新
2025-04-12 收录
光学字符识别
多语言处理
数据链接:
https://hf-mirror.com/datasets/suvradeepp/English-Gujrati-OCR-Images
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
许可证:MIT许可证(MIT License)
应用场景:
提供机构:
suvradeepp
相关数据集
jhu-clsp/seamless-align-expressive
语音翻译
多语言处理
Seamless-Align-Expressive数据集是一个用于翻译和音频到音频任务的多语言数据集,支持德语、英语、西班牙语、法语、意大利语和中文。数据集基于Meta AI发布的表达性语音到语音(S2S)数据,包含5种语言对的数据,压缩后约为228GB。数据集未进行分割,且数据可能包含个人身份信息、敏感内容或互联网上公开的有毒内容。数据集的创建过程中使用了SONAR Expressive编码器来
Hugging Face
2024-02-22 更新
50
0
benhachem/KHATT
光学字符识别
阿拉伯文手稿
KFUPM手写阿拉伯文本(KHATT)数据库包含阿拉伯手写文本图像及其真实标注,用于阿拉伯手写文本研究。该数据库包含行图像及其真实标注,并用于初步实验,如相关论文所述。
Hugging Face
2023-09-12 更新
16
0
Helsinki-NLP/fineweb-edu-translated
机器翻译
多语言处理
基于OPUS-MT和HPLT-MT模型自动翻译的fineweb-edu文档翻译集合,适用于文本生成任务,包含28种语言的翻译。
Hugging Face
2026-04-22 更新
7
0
WenWW/KD_multilingual_dataset
多语言处理
文本数据
该数据集包含多种语言的文本数据,每种语言的数据集都有不同的字节大小和样本数量。数据集的特征包括文本内容(text)和唯一标识符(id)。数据集涵盖了德语(de)、法语(fr)、西班牙语(es)、意大利语(it)、波兰语(pl)、罗马尼亚语(ro)、荷兰语(nl)、希腊语(el)、匈牙利语(hu)、葡萄牙语(pt)、捷克语(cs)、瑞典语(sv)、保加利亚语(bg)、丹麦语(da)、芬兰语(fi)、
Hugging Face
2024-12-04 更新
18
0
sproos/wikipedia-title-text-pairs
多语言处理
自然语言处理
--- dataset_info: - config_name: ab features: - name: title dtype: string - name: text dtype: string splits: - name: train num_bytes: 1644341 num_examples: 1576 download_si
Hugging Face
2024-01-03 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广