HCSU
收藏资源简介:
HCSU是由同济大学研究团队构建的首个面向细粒度历史书法风格理解的大规模数据集,旨在解决文化遗产保护中书法风格自动感知的难题。该数据集包含39,307张精心筛选的字符图像,涵盖10个历史朝代、49位著名书法家的作品,并系统性地将墨迹真迹与碑刻拓片分离以消除模态混合问题。数据集通过专家撰写的层次化美学描述,将抽象风格分解为墨色风格、笔触风格和字形结构等视觉属性,支持风格判别与可解释美学推理任务。该基准主要应用于书法艺术分析、多模态人工智能模型评估及数字人文研究,致力于推动具备专家级视觉推理能力的文化遗产保护技术发展。
HCSU is the first large-scale dataset for fine-grained historical calligraphy style understanding, constructed by the research team from Tongji University, aiming to address the challenge of automatic perception of calligraphy styles in cultural heritage preservation. This dataset contains 39,307 carefully screened character images, covering works from 10 historical dynasties and 49 renowned calligraphers. It systematically separates original ink handwritten works from stele rubbings to eliminate modality mixing problems. Through hierarchical aesthetic descriptions authored by experts, the dataset decomposes abstract calligraphy styles into visual attributes such as ink tone style, brushstroke style and character structure, supporting style discrimination and interpretable aesthetic reasoning tasks. This benchmark is mainly applied to calligraphy art analysis, multimodal AI model evaluation and digital humanities research, and is committed to promoting the development of cultural heritage preservation technologies with expert-level visual reasoning capabilities.
数据集概览:HCSU(精细历史书法风格理解数据集)
- 名称:HCSU: Fine-Grained Historical Calligraphy Style Understanding Dataset (V1.0)
- 发布者:Yinsheng Yao, Yan Liu, Chen Ye(同济大学,ECCV 2026)
- 语言:中文、英文
- 许可协议:
- 数据集(图像、标注等):CC BY-NC 4.0(仅限非商业研究)
- 代码与文档:Apache 2.0
- 任务类型:图像分类、图像到文本生成
- 标签:图像、书法、中国书法、历史文档、细粒度识别、文化遗产、风格理解
- 数据规模:39,307张(10K < n < 100K)
核心特点与创新
- 解决大型视觉语言模型(LVLMs)“有知识但缺乏细粒度书法风格感知”的困境。
- 首次推出针对历史书法风格细粒度理解的大规模数据集与评估基准。
- 成功解耦墨迹(Tie)与碑拓(Bei),解决“模态混叠”问题。
数据集统计详情
| 维度 | 具体内容 |
|---|---|
| 总规模 | 39,307张高分辨率汉字图像(归一化至256×256),经严格人工验证 |
| 历史跨度 | 覆盖10个主要朝代(三国至现代),涉及49位书法名家 |
| 字体覆盖 | 5大书体全涵盖:篆书、隶书、楷书、行书、草书 |
| 三个子域 | 墨迹(Tie, 3,780张)、碑拓(Bei, 3,240张)、原始作品图(Wild, 32,287张) |
多维层次化标注框架
每个实例提供以下丰富的元数据:
- 语义与上下文真实信息:
- 字符ID(char)、书法家(author)、朝代(dynasty)、介质类型(source_type)、保存质量(quality)
- 细粒度视觉属性分解:
- 笔墨风格(ink_style):墨色浓度、湿度、渗透、飞白等
- 笔法风格(stroke_style):中锋、藏锋、方折等微观笔触特征
- 字体结构(character_structure):空间布局、几何比例(如“中宫紧收”“欹正动态平衡”)
- 专家自然语言描述:由书法鉴赏家撰写的专业美学评语(不超过50字),作为生成任务的真值
数据处理管线
为消除复杂背景干扰(如纸张老化、装裱边界、石裂纹),设计多阶段严格管线:
- 领域自适应极性归一化与视觉启发式校正:
- 碑拓(Bei)统一反色为“黑字白底”
- 通过角区域像素强度检查,自动修正元数据错误,确保极性准确
- 几何无损归一化:
- 将原图嵌入最大边长画布,采用Lanczos插值缩放到256×256,保持原始长宽比和笔画锐度
- 形态学去噪与“真墨”外观重建:
- 对二值掩码进行8连通域分析,滤除小于50像素的噪声
- 清洁掩码重新映射回原始高分辨率RGB图像,背景替换为纯白色,保留100%墨色、笔触纹理和书写压力变化
评估协议
基于处理后的高质量数据,提出两项严格评估任务(测试集采用严格反泄漏采样规则,确保目标与参考图像不包含相同字符):
- 细粒度风格辨别(8选1):从1个正确风格和7个强干扰项中,仅凭微观笔法与结构特征配对风格
- 可解释美学推理(风格描述生成):给定2-shot提示,模型需用专业术语生成50字以内的书法评论,采用BERTScore和LLM-as-a-Judge双轨评估(术语准确性与细节丰富度)




