Phishing-Dataset|网络安全数据集|数据分析数据集
收藏数据集概述
数据集名称
- Datasets for Phishing Websites Detection
数据集变体
-
dataset_full.csv
- 总实例数: 88,647
- 合法网站实例数 (标签为0): 58,000
- 钓鱼网站实例数 (标签为1): 30,647
- 总特征数: 111 (不含目标)
- 总实例数: 88,647
-
dataset_small.csv
- 总实例数: 58,645
- 合法网站实例数 (标签为0): 27,998
- 钓鱼网站实例数 (标签为1): 30,647
- 总特征数: 111 (不含目标)
- 总实例数: 58,645
特征描述
-
URL相关特征
- 如URL中的字符计数(例如
.
、-
、_
、/
、?
、=
、@
、&
、!
、~
、,
、+
、*
、#
、$
、%
) - 顶级域名长度
- URL长度
- 如URL中的字符计数(例如
-
域名相关特征
- 域名字符计数(同上)
- 域名长度
- 域名是否为IP格式
- 域名是否包含“server”或“client”
-
目录相关特征
- 目录字符计数(同上)
- 目录长度
-
文件相关特征
- 文件字符计数(同上)
- 文件长度
-
参数相关特征
- 参数字符计数(同上)
- 参数长度
- 参数中顶级域名的存在
- 参数数量
-
其他特征
- 电子邮件在URL中的存在
- 搜索时间(响应)
- 域名是否有SPF记录
- AS号(ASN)
- 域名激活时间
- 域名到期时间
- 解析的IP数量
- 解析的名称服务器数量
- MX服务器数量
- 与主机名关联的TTL值
- 有效的TLS/SSL证书
- 重定向数量
- URL和域名在Google的索引状态
- URL是否被缩短
- 是否为钓鱼网站
引用信息
- G. Vrbančič, I. Jr. Fister, V. Podgorelec. Datasets for Phishing Websites Detection. Data in Brief, Vol. 33, 2020, DOI: 10.1016/j.dib.2020.106438

中国气象数据
本数据集包含了中国2023年1月至11月的气象数据,包括日照时间、降雨量、温度、风速等关键数据。通过这些数据,可以深入了解气象现象对不同地区的影响,并通过可视化工具揭示中国的气温分布、降水情况、风速趋势等。
github 收录
FER2013
FER2013数据集是一个广泛用于面部表情识别领域的数据集,包含28,709个训练样本和7,178个测试样本。图像属性为48x48像素,标签包括愤怒、厌恶、恐惧、快乐、悲伤、惊讶和中性。
github 收录
CE-CSL
CE-CSL数据集是由哈尔滨工程大学智能科学与工程学院创建的中文连续手语数据集,旨在解决现有数据集在复杂环境下的局限性。该数据集包含5,988个从日常生活场景中收集的连续手语视频片段,涵盖超过70种不同的复杂背景,确保了数据集的代表性和泛化能力。数据集的创建过程严格遵循实际应用导向,通过收集大量真实场景下的手语视频材料,覆盖了广泛的情境变化和环境复杂性。CE-CSL数据集主要应用于连续手语识别领域,旨在提高手语识别技术在复杂环境中的准确性和效率,促进聋人与听人社区之间的无障碍沟通。
arXiv 收录
HazyDet
HazyDet是由解放军工程大学等机构创建的一个大规模数据集,专门用于雾霾场景下的无人机视角物体检测。该数据集包含383,000个真实世界实例,收集自自然雾霾环境和正常场景中人工添加的雾霾效果,以模拟恶劣天气条件。数据集的创建过程结合了深度估计和大气散射模型,确保了数据的真实性和多样性。HazyDet主要应用于无人机在恶劣天气条件下的物体检测,旨在提高无人机在复杂环境中的感知能力。
arXiv 收录
LEVIR-CD
LEVIR-CD 是一个新的大规模遥感建筑变化检测数据集。引入的数据集将成为评估变化检测 (CD) 算法的新基准,尤其是基于深度学习的算法。 LEVIR-CD 由 637 个非常高分辨率(VHR,0.5m/像素)Google Earth (GE) 图像块对组成,大小为 1024 × 1024 像素。这些时间跨度为 5 到 14 年的双时相图像具有显着的土地利用变化,尤其是建筑增长。 LEVIR-CD涵盖别墅住宅、高层公寓、小型车库和大型仓库等各类建筑。在这里,我们关注与建筑相关的变化,包括建筑增长(从土壤/草地/硬化地面或在建建筑到新建筑区域的变化)和建筑衰退。这些双时相图像由遥感图像解释专家使用二进制标签(1 表示变化,0 表示不变)进行注释。我们数据集中的每个样本都由一个注释器进行注释,然后由另一个注释器进行双重检查以产生高质量的注释。完整注释的 LEVIR-CD 总共包含 31,333 个单独的变更构建实例。
OpenDataLab 收录