书脊实例分割数据集 (Book Spine Instance Segmentation Dataset)
收藏官方服务:
资源简介:
本书脊实例分割数据集包含442张书脊图片及其对应的LabelMe标注文件,可用于图像分割、目标检测等模型的训练与评估。
This book spine instance segmentation dataset contains 442 book spine images and their corresponding LabelMe annotation files, which can be used for training and evaluating models such as image segmentation and object detection.
创建时间:
2026-07-08
原始信息汇总
数据集名称
书脊实例分割数据集 (Book Spine Instance Segmentation Dataset)
数据集简介
- 包含 442张 书脊图片及其对应的LabelMe标注文件。
- 可用于图像分割、目标检测等模型的训练与评估。
标注信息
- 标注工具:LabelMe v6.3.1
- 辅助标注:部分图片使用了 LabelMe 内置的 SAM2 (Segment Anything Model 2) 模型进行辅助标注
- 数据集规模:442张图片 / 11,751个标注实例
- 标注类别:
book(书脊) - 标注形状:
- 多边形 (polygon):6,380个
- 定向矩形 (oriented_rectangle):5,358个
- 矩形 (rectangle):13个
标注者
| 姓名 | 学号 |
|---|---|
| 张天童 | 23101120 |
| 陈学礼 | 23101102 |
| 高喜鹏 | 23101103 |
| 边巴顿珠 | 23101101 |
目录结构
├── origin_images/ # 442张原始图片 (.jpg) │ ├── 001.jpg │ ├── 002.jpg │ └── ... └── labelme_jsons/ # 442个LabelMe标注文件 (.json) ├── 001.json ├── 002.json └── ...
使用方式
用 LabelMe 打开
bash pip install labelme labelme
打开后通过 File → Open Dir 选择 origin_images/ 目录,LabelMe 会自动加载同名标注文件。
格式转换
bash
转 COCO 格式
labelme2coco labelme_jsons/ dataset_coco.json
转 YOLO 格式
labelme2yolo labelme_jsons/ yolo_dataset/
适用场景
- 实例分割 (Instance Segmentation)
- 目标检测 (Object Detection)
- 旋转框检测 (Rotated Object Detection)
- 语义分割 (Semantic Segmentation)
标注日期
2026年6月
搜集汇总
数据集介绍

构建方式
书脊实例分割数据集由四位标注者共同构建,包含442张书脊图片及对应的LabelMe标注文件,总计涵盖11,751个标注实例。标注过程采用LabelMe v6.3.1工具,并借助其内置的SAM2模型对部分图片进行辅助标注,以提升效率与精度。所有实例均统一标注为“book”类别,标注形状包括多边形6,380个、定向矩形5,358个及矩形13个,形成了多样化的几何表示。
特点
该数据集在书脊识别领域具有显著特色:首先,其标注形式丰富,同时包含多边形、定向矩形和矩形三种形状,兼顾了精确边界与方向性需求;其次,数据规模适中,442张图片对应万余个实例,平衡了覆盖度与标注成本;此外,定向矩形的引入为旋转框检测任务提供了独特支持,使得数据集不仅适用于常规实例分割与目标检测,还能服务于旋转目标检测等前沿应用。
使用方法
数据集的使用方式灵活便捷:通过LabelMe工具可直接加载原始图片目录,自动关联同名标注文件进行可视化检查或编辑;如需适配不同模型框架,可利用labelme2coco和labelme2yolo命令行工具将标注格式转换为COCO或YOLO格式,便于接入主流深度学习流水线。该数据集适用于实例分割、目标检测、旋转框检测及语义分割等多种计算机视觉任务的研究与评估。
背景与挑战
背景概述
书脊实例分割数据集(Book Spine Instance Segmentation Dataset)于2026年由张天童、陈学礼、高喜鹏、边巴顿珠等研究者构建,主要针对图书馆自动化管理、智能书架盘点及书籍检索等应用场景中的书脊识别问题。该数据集包含442张高质量书脊图像及11,751个标注实例,涵盖多边形、定向矩形和矩形等多种标注形状,为实例分割、目标检测及旋转框检测等计算机视觉任务提供了精细化的训练与评估基准。其研究核心在于推动书脊这一细粒度目标在密集排列与遮挡挑战下的精准分割,对提升智慧图书馆和零售场景的自动化水平具有显著影响力。
当前挑战
该数据集面临的核心挑战包括:领域问题方面,书脊在真实场景中常呈现密集堆叠、角度倾斜、光照不均及局部遮挡等复杂特性,需解决实例分割模型在密集小目标与旋转框检测中的精度瓶颈,克服类内高度相似性与边界模糊带来的误分割问题。构建过程中,标注复杂性尤为突出:由于书脊形状多样且边缘易与背景混淆,采用LabelMe结合SAM2辅助标注虽提升效率,但多边形与定向矩形的高精度标注仍依赖人工大量修正;此外,442张图像规模有限,远未覆盖不同书架结构、书脊纹理及光照条件的多样性,导致模型泛化能力受限,需通过数据增强或迁移学习弥补样本稀缺性。
常用场景
经典使用场景
在智能图书馆管理与数字典藏领域,书脊的精准识别是自动化盘点与检索的关键环节。本书脊实例分割数据集最经典的使用场景是训练基于深度学习的实例分割模型,如Mask R-CNN、YOLACT等,以实现对书架图像中每本书书脊区域的像素级精确提取。由于标注包含多边形与定向矩形,该数据集尤其适合模型学习处理书脊因倾斜、堆叠而产生的形变与旋转,从而在复杂书脊排列场景下完成高精度的分割与定位。
实际应用
在实际应用中,该数据集支撑的模型可部署于图书馆智能盘点机器人或移动盘点系统,通过相机捕获书架图像后自动识别每本书的书脊轮廓,实现图书的实时定位与状态监控。其输出结果可对接图书管理数据库,完成缺失图书检测、错架图书告警及借还自动化处理,极大降低人工盘点成本与差错率。此外,在数字图书馆建设过程中,该技术也能辅助从扫描图像中自动分割书脊,提升电子化录入效率。
衍生相关工作
基于该数据集,研究者已开展了多项衍生的经典工作。例如,有人利用其多边形标注训练轻量化实例分割网络,并引入知识蒸馏策略以适配边缘计算设备;另有工作将其注释转换为旋转框格式,专用于训练旋转目标检测器,进而拓展至货架商品、档案盒等相似视觉对象的检测。此外,该数据集也被用作无监督域适应方法的下游评测任务,验证了从仿真数据向真实书架场景迁移学习的可行性,为类内密集场景的域适应研究提供了新基准。
以上内容由遇见数据集搜集并总结生成




