Morphological Heterogeneity (MH) dataset|红细胞形态分析数据集|生物医学成像数据集
收藏数据集概述
数据集名称
"Morphological Heterogeneity" (MH) 数据集
数据集内容
- 图像
- 二值掩码
- 边界框
- 形态学标签
- 其他红细胞(RBCs)相关指标
数据集来源
数据集包含的红细胞图像和相关数据是通过微流控设备获取的。
数据集生成方法
使用MATLAB脚本和训练好的神经网络处理原始显微镜数据,生成图像、掩码、边界框等。
数据集使用教程
系统要求
- MATLAB 2021b或更高版本
- Image Processing Toolbox (11.4)
- Statistics and Machine Learning Toolbox (12.2)
- Computer Vision Toolbox (10.1)
测试运行
- 下载并解压代码库。
- 删除 U0W0_0_Output 文件夹。
- 在MATLAB中打开 Routt_Austin_Segmenter_Classifier_ME_Main.m 脚本。
- 运行脚本,检查输出是否正确。
重现MH数据集
- 从 MH dataverse 下载并解压所需的Unit-Week-Run图像。
- 在MATLAB脚本中设置输入和输出路径。
- 运行脚本,生成数据集中的其他数据。
重现平均直径数据和高分辨率RBC图像
- 在 MH Data Analysis 子文件夹中打开 Routt_Austin_MH_Data_Analysis_Main.m 脚本。
- 设置脚本中的基础目录路径。
- 分段运行脚本,生成所需数据。
数据集分析
使用特定的MATLAB脚本进行数据分析,包括生成平均直径数据和高分辨率RBC图像。

China Health and Nutrition Survey (CHNS)
China Health and Nutrition Survey(CHNS)是一项由美国北卡罗来纳大学人口中心与中国疾病预防控制中心营养与健康所合作开展的长期开放性队列研究项目,旨在评估国家和地方政府的健康、营养与家庭计划政策对人群健康和营养状况的影响,以及社会经济转型对居民健康行为和健康结果的作用。该调查覆盖中国15个省份和直辖市的约7200户家庭、超过30000名个体,采用多阶段随机抽样方法,收集了家庭、个体以及社区层面的详细数据,包括饮食、健康、经济和社会因素等信息。自2011年起,CHNS不断扩展,新增多个城市和省份,并持续完善纵向数据链接,为研究中国社会经济变化与健康营养的动态关系提供了重要的数据支持。
www.cpc.unc.edu 收录
中国1km分辨率逐月降水量数据集(1901-2024)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2024.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
giovannidemuri__sharegpt-ex50000-seed5_llama8b-er-v573-seed2-hx_256_ngt0.7_tp0.9
该数据集包含了用户与助手之间的对话,其中包含两个字段:用户发言和助手回应,均为字符串类型。训练集大小为38646852字节,共有44096条对话记录。
huggingface 收录
中国交通事故深度调查(CIDAS)数据集
交通事故深度调查数据通过采用科学系统方法现场调查中国道路上实际发生交通事故相关的道路环境、道路交通行为、车辆损坏、人员损伤信息,以探究碰撞事故中车损和人伤机理。目前已积累深度调查事故10000余例,单个案例信息包含人、车 、路和环境多维信息组成的3000多个字段。该数据集可作为深入分析中国道路交通事故工况特征,探索事故预防和损伤防护措施的关键数据源,为制定汽车安全法规和标准、完善汽车测评试验规程、
北方大数据交易中心 收录
Photovoltaic power plant data
包括经纬度、电源板模型、NWP等信息。
github 收录