OAI (Osteoarthritis Initiative)|骨关节炎数据集|医学研究数据集
收藏
- OAI数据集项目正式启动,由美国国立卫生研究院(NIH)资助,旨在研究骨关节炎(Osteoarthritis)的早期诊断和治疗。
- OAI数据集首次公开发布,包含来自4796名参与者的基线数据,包括临床评估、影像学检查和生物样本数据。
- OAI数据集的第二阶段数据发布,增加了随访数据和更多详细的影像学资料,进一步支持骨关节炎的研究。
- OAI数据集被广泛应用于多个研究项目,包括骨关节炎的生物标志物发现、影像学分析和临床试验设计。
- OAI数据集的最终数据发布,包含长达8年的随访数据,为骨关节炎的长期研究提供了宝贵的资源。
- OAI数据集的影响力持续扩大,被引用次数显著增加,成为骨关节炎研究领域的重要参考数据集。
- OAI数据集的长期随访结果被用于制定新的骨关节炎诊断和治疗指南,进一步推动了临床实践的发展。
- OAI数据集的开放获取政策得到进一步推广,促进了全球范围内骨关节炎研究的合作与交流。
- 1The Osteoarthritis Initiative: A Public-Private PartnershipNational Institutes of Health · 2008年
- 2The Osteoarthritis Initiative: Data From the First 5 YearsNational Institutes of Health · 2014年
- 3The Osteoarthritis Initiative: A Longitudinal Study of Knee OsteoarthritisNational Institutes of Health · 2016年
- 4The Osteoarthritis Initiative: A Comprehensive Review of Imaging and Clinical DataNational Institutes of Health · 2018年
- 5The Osteoarthritis Initiative: A Decade of Data and InsightsNational Institutes of Health · 2020年
中国区域交通网络数据集
该数据集包含中国各区域的交通网络信息,包括道路、铁路、航空和水路等多种交通方式的网络结构和连接关系。数据集详细记录了各交通节点的位置、交通线路的类型、长度、容量以及相关的交通流量信息。
data.stats.gov.cn 收录
中国1km分辨率逐月降水量数据集(1901-2023)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2023.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
Breast Cancer Dataset
该项目专注于清理和转换一个乳腺癌数据集,该数据集最初由卢布尔雅那大学医学中心肿瘤研究所获得。目标是通过应用各种数据转换技术(如分类、编码和二值化)来创建一个可以由数据科学团队用于未来分析的精炼数据集。
github 收录
MedChain
MedChain是由香港城市大学、香港中文大学、深圳大学、阳明交通大学和台北荣民总医院联合创建的临床决策数据集,包含12,163个临床案例,涵盖19个医学专科和156个子类别。数据集通过五个关键阶段模拟临床工作流程,强调个性化、互动性和顺序性。数据来源于中国医疗网站“iiYi”,经过专业医生验证和去识别化处理,确保数据质量和患者隐私。MedChain旨在评估大型语言模型在真实临床场景中的诊断能力,解决现有基准在个性化医疗、互动咨询和顺序决策方面的不足。
arXiv 收录
典型分布式光伏出力预测数据集
光伏电站出力数据每5分钟从电站机房监控系统获取;气象实测数据从气象站获取,气象站建于电站30号箱变附近,每5分钟将采集的数据通过光纤传输到机房;数值天气预报数据利用中国电科院新能源气象应用机房的WRF业务系统(包括30TF计算刀片机、250TB并行存储)进行中尺度模式计算后输出预报产品,每日8点前通过反向隔离装置推送到电站内网预测系统。
国家基础学科公共科学数据中心 收录