KBSMC_gastric_cancer_grading_dataset|胃癌研究数据集|医学图像分析数据集
收藏数据集概述
数据集名称
- KBSMC_gastric_cancer_grading_dataset
数据来源
- 数据由韩国首尔的Kangbuk Samsung Hospital提供。
数据内容
- 包含98名患者的98张全切片图像(WSIs),采集时间为2016至2020年。
- 图像通过Aperio数字切片扫描仪(Leica Biosystems)以40倍放大率扫描。
- 图像分为良性(BN)和三种癌症区域(TW, TM, TP)。
数据结构
- 训练、验证和测试集包含的图像数量如下:
- 良性(BN):训练20,883张,验证8,398张,测试7,955张。
- 管状高分化腺癌(TW):训练14,251张,验证2,239张,测试1,795张。
- 管状中分化腺癌(TM):训练20,815张,验证2,370张,测试2,458张。
- 管状低分化腺癌(TP):训练27,689张,验证2,374张,测试3,579张。
数据下载
- 数据集可通过Google Drive下载,链接为:Google Drive Link。
数据处理
- 原始图像大小约为270微米x 0.270微米,后调整为512x512像素。
- 图像名称中的最后一位数字决定其类别,其中1和2代表良性,3代表TW,4代表TM,5代表TP。
数据加载
- 提供了一个Python脚本
dataset.py
用于加载和处理数据集。
数据集使用说明
- 数据集的类别标签通过图像名称的最后一位数字确定,具体分类如下:
- 1和2:良性(BN)
- 3:管状高分化腺癌(TW)
- 4:管状中分化腺癌(TM)
- 5:管状低分化腺癌(TP)
- 数据集的加载和处理可通过提供的Python脚本进行。

China Health and Nutrition Survey (CHNS)
China Health and Nutrition Survey(CHNS)是一项由美国北卡罗来纳大学人口中心与中国疾病预防控制中心营养与健康所合作开展的长期开放性队列研究项目,旨在评估国家和地方政府的健康、营养与家庭计划政策对人群健康和营养状况的影响,以及社会经济转型对居民健康行为和健康结果的作用。该调查覆盖中国15个省份和直辖市的约7200户家庭、超过30000名个体,采用多阶段随机抽样方法,收集了家庭、个体以及社区层面的详细数据,包括饮食、健康、经济和社会因素等信息。自2011年起,CHNS不断扩展,新增多个城市和省份,并持续完善纵向数据链接,为研究中国社会经济变化与健康营养的动态关系提供了重要的数据支持。
www.cpc.unc.edu 收录
中国1km分辨率逐月降水量数据集(1901-2024)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2024.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
EcoInvent
EcoInvent是一个生命周期评估(LCA)数据库,包含了大量产品的环境影响数据。它提供了详细的产品生命周期数据,包括原材料提取、生产、使用和废弃处理等各个阶段的环境影响信息。
www.ecoinvent.org 收录
GVJahnavi/Crops_set
该数据集包含图像和标签两个主要特征。图像特征的数据类型为图像,标签特征的数据类型为类标签,具体包括20种不同的植物病害和健康状态,如玉米的灰斑病、普通锈病、北方叶枯病,以及番茄的细菌性斑点病、早疫病、晚疫病等。数据集分为训练集和测试集,训练集包含25384个样本,测试集包含6346个样本。数据集的下载大小为514893426字节,总大小为474216412.07000005字节。
hugging_face 收录
中国1km分辨率逐月NDVI数据集(2001-2023年)
中国1km分辨率逐月NDVI数据集(2001-2023年)根据MODIS MOD13A2数据进行月度最大值合成、镶嵌和裁剪后制作而成,包含多个TIF文件,每个TIF文件对应该月最大值NDVI数据,文件以时间命名。数据值域改为-0.2~1,不再需要除以一万,另外范围扩大到中国及周边地区,可以自行裁剪。数据分为两个文件夹,MVC文件夹中为MOD13A2 NDVI逐月最大值合成结果,mod1k_SGfilter为MVC中数据S-G滤波后的结果。
国家地球系统科学数据中心 收录