PubLayNet
收藏资源简介:
PubLayNet是一个用于文档布局分析的数据集。它包含研究论文和文章的图像以及这些研究论文图像中各种元素(如“文本”、“列表”、“图形”等)的注释。该数据集是通过自动匹配公开可用的PubMed Central上超过100万篇PDF文章的XML表示和内容获得的。
PubLayNet is a dataset designed for document layout analysis. It comprises images of research papers and articles, along with annotations for various elements within these images, such as 'text', 'lists', 'figures', and more. This dataset was acquired by automatically matching the XML representations and contents of over a million PDF articles available on PubMed Central.
数据集概述
数据集名称
- 名称: PubLayNet
数据集属性
- 语言: 英语(en)
- 语言来源: 已发现(found)
- 多语言性: 单语(monolingual)
- 许可证: CDLA-Permissive-1.0
数据集任务
- 任务类别:
- 图像分类
- 图像分割
- 图像到文本
- 问答
- 其他
- 多选
- 令牌分类
- 表格到文本
- 对象检测
- 表格问答
- 文本分类
- 表格到文本
- 任务ID:
- 多标签图像分类
- 多类图像分类
- 语义分割
- 图像标题生成
- 抽取式问答
- 封闭领域问答
- 多选问答
- 命名实体识别
数据集描述
- 概述: PubLayNet是一个用于文档布局分析的数据集,包含研究论文和文章的图像,以及页面中各种元素(如“文本”、“列表”、“图形”等)的标注。该数据集通过自动匹配PubMed Central上公开可用的超过100万篇PDF文章的XML表示和内容获得。
数据集创建
- 标注创建者: 机器生成
数据集使用注意事项
-
许可证信息: 遵循CDLA-Permissive-1.0许可证
-
引用信息: bibtex @inproceedings{zhong2019publaynet, title={Publaynet: largest dataset ever for document layout analysis}, author={Zhong, Xu and Tang, Jianbin and Yepes, Antonio Jimeno}, booktitle={2019 International Conference on Document Analysis and Recognition (ICDAR)}, pages={1015--1022}, year={2019}, organization={IEEE} }
-
贡献者: 感谢ibm-aur-nlp/PubLayNet为创建此数据集所做的贡献。




