登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
suvradeepp/English-Gujrati-OCR-Images
suvradeepp/English-Gujrati-OCR-Images
收藏
Hugging Face
2025-04-03 更新
2025-04-12 收录
光学字符识别
多语言处理
数据链接:
https://hf-mirror.com/datasets/suvradeepp/English-Gujrati-OCR-Images
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
许可证:MIT许可证(MIT License)
应用场景:
提供机构:
suvradeepp
相关数据集
britllm/TransWebEdu
多语言处理
教育科技
TransWebEdu是一个预训练规模的多语言平行语料库,支持十种语言:阿拉伯语、威尔士语、德语、英语、西班牙语、法语、印度尼西亚语、意大利语、俄语和斯瓦希里语。它专门用于从零开始预训练TransWebLLM模型,聚焦于多语言网络教育内容。
Hugging Face
2025-04-22 更新
21
0
benhachem/KHATT
光学字符识别
阿拉伯文手稿
KFUPM手写阿拉伯文本(KHATT)数据库包含阿拉伯手写文本图像及其真实标注,用于阿拉伯手写文本研究。该数据库包含行图像及其真实标注,并用于初步实验,如相关论文所述。
Hugging Face
2023-09-12 更新
16
0
Parliamentary corpus of first Yugoslavia (1919-1939) yu1Parl 1.0
历史议会记录
多语言处理
This historical parliamentary corpus contains meeting proceedings of the National Representation of the Kingdom of Yugoslavia from 191 to 1939. The corpus comprises 714 sessions. The source data (scan
SSH Open MarketPlace
2023-10-17 更新
8
0
WenWW/KD_multilingual_dataset
多语言处理
文本数据
该数据集包含多种语言的文本数据,每种语言的数据集都有不同的字节大小和样本数量。数据集的特征包括文本内容(text)和唯一标识符(id)。数据集涵盖了德语(de)、法语(fr)、西班牙语(es)、意大利语(it)、波兰语(pl)、罗马尼亚语(ro)、荷兰语(nl)、希腊语(el)、匈牙利语(hu)、葡萄牙语(pt)、捷克语(cs)、瑞典语(sv)、保加利亚语(bg)、丹麦语(da)、芬兰语(fi)、
Hugging Face
2024-12-04 更新
18
0
fleurs_yo_en
语音翻译
多语言处理
这是一个从Google FLEURS数据集中提取的Yoruba-to-English翻译数据集。数据集包含训练集、验证集和测试集中的音频记录,分别对应13小时48分钟32秒、44分钟32秒和45分钟27秒的音频数据。所有音频都以16kHz采样。数据集的特征包括音频、Yoruba语言的转录和相应的英语翻译。
Hugging Face
2024-12-10 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广