brain-cancer-dataset|医学影像分析数据集|癌症诊断数据集
收藏Brain Tumors MRI Images - 2,000,000+ MRI studies
概述
该数据集包含MRI扫描的人脑图像和医学报告,旨在用于肿瘤的检测、分类和分割。数据集包括多种脑肿瘤,如胶质瘤、良性肿瘤、恶性肿瘤和脑转移,以及每位患者的临床信息。
内容
- ST000001: 包含10个研究的子文件夹,每个研究包括**.dcm和.jpg**格式的MRI扫描图像。
- DICOMDIR: 包含患者状况信息和文件访问链接。
- Brain_MRI_tumor.pdf: 包含放射科医生提供的医学报告。
- .csv文件: 包含按条件和研究方法分类的研究数量。
医学报告内容
- 研究类型
- MRI机器(主要是Philips Intera 1.5T)
- 患者人口统计信息(年龄、性别、种族)
- 疾病简要病史(主诉)
- 病例描述
- 初步诊断
- 进一步行动的建议
数据使用
所有患者已同意数据发布,数据已去识别化。研究人员可以利用该数据集进行多种深度学习任务,包括肿瘤检测、分类和分割,重点是提高现实临床诊断场景中的验证准确性。该数据集还支持开发用于自动检测和肿瘤分型的训练模型,这对临床诊断和治疗至关重要。

中国气象数据
本数据集包含了中国2023年1月至11月的气象数据,包括日照时间、降雨量、温度、风速等关键数据。通过这些数据,可以深入了解气象现象对不同地区的影响,并通过可视化工具揭示中国的气温分布、降水情况、风速趋势等。
github 收录
中国1km分辨率逐月降水量数据集(1901-2023)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2023.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
典型分布式光伏出力预测数据集
光伏电站出力数据每5分钟从电站机房监控系统获取;气象实测数据从气象站获取,气象站建于电站30号箱变附近,每5分钟将采集的数据通过光纤传输到机房;数值天气预报数据利用中国电科院新能源气象应用机房的WRF业务系统(包括30TF计算刀片机、250TB并行存储)进行中尺度模式计算后输出预报产品,每日8点前通过反向隔离装置推送到电站内网预测系统。
国家基础学科公共科学数据中心 收录
THUCNews
THUCNews是根据新浪新闻RSS订阅频道2005~2011年间的历史数据筛选过滤生成,包含74万篇新闻文档(2.19 GB),均为UTF-8纯文本格式。本次比赛数据集在原始新浪新闻分类体系的基础上,重新整合划分出14个候选分类类别:财经、彩票、房产、股票、家居、教育、科技、社会、时尚、时政、体育、星座、游戏、娱乐。提供训练数据共832471条。
github 收录
OECD - Education at a Glance
该数据集提供了关于教育系统在不同国家和地区的详细统计数据,包括教育支出、教育参与率、教育成果、教师资源等多个方面。数据涵盖了OECD成员国以及部分非成员国。
www.oecd.org 收录