zju-eye-pretrain
收藏资源简介:
ZJU Eye-Pretrain是一个为医学基础模型预训练及下游任务设计的大规模、统一多源眼科影像数据集。它整合了来自私人采集和25个公开数据集的资源,总计包含超过110万张图像,涵盖26个不同的队列。数据集主要由三部分构成:1) 私人采集的上海Topcon DRI OCT Triton扫频源OCT数据,约41.9万张图像,包含OCT B扫描、彩色眼底图和灰度扫描激光检眼镜图像;2) 公共眼底数据集,约19.9万张彩色眼底图像,部分包含GAMMA OCT数据;3) 公共OCT数据集,约48.9万张OCT B扫描图像。所有数据遵循一个严格的41列统一数据清单模式,确保了跨源数据的一致性。该模式包含了图像标识符、研究/患者信息(匿名哈希)、采集设备信息(厂商、型号)、临床信息(诊断分组、病变标签、严重程度)、图像元数据(模态、解剖部位、分辨率、质量评分)以及技术参数(扫描协议、B扫描索引)等。部分队列还提供了像素级的分割掩码,用于血管、视盘/视杯、视网膜层、病变区域等。此外,每张图像都配有5个文本描述。数据集适用于多种计算机视觉任务,包括图像分类、图像分割、图像到图像转换、文本到图像生成以及无条件图像生成,是进行眼科医学影像分析、模型预训练和迁移学习的宝贵资源。数据集采用混合许可证,使用者需遵守各原始数据源的许可条款,其中私人数据仅限于研究用途。
数据集概述:ZJU Eye-Pretrain
这是一个统一的多源眼科影像数据集,专为基础模型预训练及下游任务设计。
核心规模
- 总图像数量:约 110.6万张
- 总队列数:整合 26个 独立队列
- 总数据量:约 287 GB
数据组成
数据集由三大部分构成:
| 来源 | 图像数量 | 影像模态 | 队列数 |
|---|---|---|---|
| 私有上海Topcon DRI OCT Triton (SS-OCT) | 419,042 | OCT B-scan, 彩色眼底, SLO灰度 | 1 |
| 公开眼底图像 | 198,629 | 彩色眼底, GAMMA OCT | 6 |
| 公开OCT图像 | 488,705 | OCT B-scan | 19 |
| 总计 | 1,106,376 | 26 |
影像模态
数据集包含多种眼科影像模态:
- OCT B-scan (光学相干断层扫描B扫描)
- Fundus Color (彩色眼底照相)
- SLO Gray (扫描激光检眼镜灰度图)
主要任务
页面元数据定义的task_categories表明该数据集可用于以下任务:
- 图像分类
- 图像分割
- 图像到图像转换
- 文本到图像生成
- 无条件图像生成
数据配置
数据集提供 28个 可加载的配置(config),包括按来源划分的大批次和单一队列。主要配置如下:
大批次配置
| 配置名称 | 包含数据 |
|---|---|
private_topcon |
私有上海Topcon数据 |
public_fundus |
所有公开眼底数据 |
public_oct |
所有公开OCT数据 |
单队列配置(部分列举)
- 公开眼底队列:
drive_vessel,eyepacs_combo_dr_aug,gamma_multimodal,idrid,messidor2_dr,refuge2_disc_cup - 公开OCT队列:
kermany,octa500,amd_sd,areds2,aroi,c8,chiu_dme_2015,glaucoma,neh_ut_2021,nyu_poag,octdl,octid,oimhs,olives,retouch,sparsity_sdoct_2012,srinivasan_2014,thoct1800,uestc - 私有队列:
private
数据模式 (Schema)
所有批次共享一个严格的 41列统一清单模式,关键字段包括:
- 样本信息:
cohort,study_id,patient_hash,eye,visit_date - 设备信息:
device_vendor,device_model,device_serial_hash,device_software_version - 临床信息:
diagnosis_group,lesion_tags,severity,crt_um,choroid_thickness_um - 影像信息:
image_id,file_path,modality,anatomy,scan_protocol,image_height_px,image_width_px,axial_resolution_um - 分割信息:
has_segmentation,n_layers_visible,fovea_x_norm, 以及每个队列特有的mask列(如vessel_mask,disc_cup_mask等)
标注与字幕
- 分割标注:部分队列(如DRIVE, IDRiD, REFUGE2, AROI等)提供相应的分割掩码。
- 字幕:每张图像提供 5条字幕(4个L1变体 + 1个L3衍生),总计约 550万条 字幕,可在
captions配置中加载。
许可协议
- 许可:该数据集整合了多种来源,采用混合许可。详细许可条款见LICENSE文件。
- 私有数据:私有的上海Topcon数据仅供研究使用,禁止商业用途。
语言
支持英语和中文。




