遇见数据集

HTR_Based_中世纪拉丁及法语手稿文档识别模型数据集

收藏
海数据2026-06-02 收录
官方服务:

资源简介:

本数据集用于训练和评估适用于拉丁及法语中世纪文档手稿的手写文本识别(HTR)模型,包含12-15世纪的宪章、登记簿等手稿数据,涉及1855页、12万行文本及近100万字符,整合了Alcar-HOME、e-NDP、Himanis三个开源真实语料库,支持多语言多字体识别,可用于中世纪文献的数字化处理。 论文“Sergio Torres Aguilar, Vincent Jolivet. Handwritten Text Recognition for Documentary Medieval Manuscripts. 2022. https://hal.science/hal-03892163”

提供机构:
公开数据
创建时间:
2026-01-30
二维码
社区交流群
二维码
科研交流群
商业服务