awesome-ocr-resources
收藏资源简介:
该合集是一个关于OCR(光学字符识别)和文档AI的资源集合,主要收录了多个数据集,并涵盖了相关论文和API。它旨在整理和索引OCR领域的公开数据集,帮助研究人员和开发者快速找到所需资源。合集按主题组织,包括OCR数据集,覆盖了文本检测、识别等子领域。
This collection is a resource repository focused on OCR (Optical Character Recognition) and Document AI, primarily compiling multiple datasets along with relevant academic papers and APIs. It aims to systematically organize and index public datasets within the OCR field, enabling researchers and developers to quickly locate the resources they need. The collection is categorized by themes, with its OCR dataset section covering sub-domains such as text detection and text recognition.
数据集详情概述
该页面是一个关于 OCR(光学字符识别)与文档人工智能(Document AI) 的综合资源集合,托管于 GitHub。它收录了相关论文、数据集及API等资源,并持续更新至2025年。
主要内容结构
-
最新动态:页面说明已包含2023年和2024年发表的论文(更新于2025年1月5日)。
-
论文分类:按年份整理:
- 2023年至今
- 2019-2022年
- 2015-2018年
- 2011-2014年
- 2010年之前
-
数据集:专门针对OCR的数据集,可通过
datasets/README.md进一步查看。 -
API:仍在规划中(标记为“TODO”)。
参考资料
页面提供了多个相关资源链接,包括场景文本检测、识别、端到端方法,以及深度学习文本检测/识别、OCR 项目等领域的精选清单,此外还引用了一篇关于多模态模型扩展的研究论文。
注意:本总结仅提取页面中与数据集及OCR资源直接相关的结构化信息,不涉及网站本身或无关内容。




