遇见数据集

复杂场景标准印刷品藏文图像测试集

收藏
官方服务:

资源简介:

该测试集主要面向复杂场景藏文多风格字体文字识别研究与现代印刷文档识别需求建设,用于评估复杂场景下标准印刷品藏文识别综合准确率技术指标。数据基于PDF电子文档、现代书籍、杂志等的扫描件或照片产生,字体为标准乌金体,覆盖Himalaya-A、Himalaya-B、藏研白体、藏研黑体、藏研乌坚体等多种乌金体字体,文字规整、背景相对干净。样本注重字体风格多样性,确保识别方法不局限于特定字体、具备良好泛化能力,全面反映现实印刷环境中藏文文字的分布特征。数据量为600张图像。

提供机构:
西藏大学
二维码
社区交流群
二维码
科研交流群
商业服务