Attack-Technique-Dataset|网络安全数据集|攻击技术数据集
收藏Attack-Technique-Dataset 概述
数据集组成
MitreEnterprise.json
- 包含从 https://attack.mitre.org/techniques/enterprise/ 收集的攻击技术概要。
- 每项技术均包含描述和完整描述。
APTgroupMitre.json
- 包含APT组织的概要及其使用的攻击技术和相关文章(参考资料)。
- 数据收集自 https://attack.mitre.org/groups/。
tech_refer.json
- 包含威胁相关文章的概要。
- 每篇文章的URL可在APTgroupMitre.json中找到,并与MitreEnterprise.json中的多项技术相关联。
_id.txt
- 为tech_refer.json中的每个URL分配一个ID。
references
- 包含_id.txt中描述的文章(URL),文件名与_id.txt中描述的ID完全对应。
- 文件类型为HTML,用户可使用deal_raw_file.py脚本进行分类。
- 由于Github的限制,未上传所有文件,用户需使用get_file.py脚本下载文件。
references_processed
- 提供一些预处理文件供用户使用。

中国1km分辨率逐月降水量数据集(1901-2024)
该数据集为中国逐月降水量数据,空间分辨率为0.0083333°(约1km),时间为1901.1-2024.12。数据格式为NETCDF,即.nc格式。该数据集是根据CRU发布的全球0.5°气候数据集以及WorldClim发布的全球高分辨率气候数据集,通过Delta空间降尺度方案在中国降尺度生成的。并且,使用496个独立气象观测点数据进行验证,验证结果可信。本数据集包含的地理空间范围是全国主要陆地(包含港澳台地区),不含南海岛礁等区域。为了便于存储,数据均为int16型存于nc文件中,降水单位为0.1mm。 nc数据可使用ArcMAP软件打开制图; 并可用Matlab软件进行提取处理,Matlab发布了读入与存储nc文件的函数,读取函数为ncread,切换到nc文件存储文件夹,语句表达为:ncread (‘XXX.nc’,‘var’, [i j t],[leni lenj lent]),其中XXX.nc为文件名,为字符串需要’’;var是从XXX.nc中读取的变量名,为字符串需要’’;i、j、t分别为读取数据的起始行、列、时间,leni、lenj、lent i分别为在行、列、时间维度上读取的长度。这样,研究区内任何地区、任何时间段均可用此函数读取。Matlab的help里面有很多关于nc数据的命令,可查看。数据坐标系统建议使用WGS84。
国家青藏高原科学数据中心 收录
PadChest-GR dataset
<div> <div>PadChest-GR is a manually annotated, bilingual chest X-ray dataset designed to train and evaluate models for grounded radiology report generation. It includes bounding boxes and comprehensive annotations of all clinically relevant findings.</div> </div>
微软开源数据集 收录
全国医院名录
数据表格中的信息包含省、市、医院名称、医院地址、医院等级、日门诊量和特色专科。统计范围为全国34个省级行政区,统计时间为2019年。
国家基础学科公共科学数据中心 收录
OECD - Education at a Glance
该数据集提供了关于教育系统在不同国家和地区的详细统计数据,包括教育支出、教育参与率、教育成果、教师资源等多个方面。数据涵盖了OECD成员国以及部分非成员国。
www.oecd.org 收录
NUS-WIDE
NUS-WIDE 数据集包含从 Flickr 收集的 269,648 张图像,总共 5,018 个标签。这些图像是用 81 个概念手动注释的,包括对象和场景。
OpenDataLab 收录