遇见数据集

RedKamgami

收藏
github2026-07-16 更新2026-07-18 收录
官方服务:

资源简介:

RedKamgami 是一个大规模密码词表,用于安全研究、授权审计和教育目的。它包括一个去重后的密码数据集,以及基于Rust的高性能密码生成器和基于Go的轻量级启动器。数据集经过精心策划,包含合并、去重、验证和压缩等处理步骤。

RedKamgami is a large-scale password wordlist designed for security research, authorized auditing and educational purposes. It includes a deduplicated password dataset, a Rust-based high-performance password generator, and a Go-based lightweight launcher. This dataset has been carefully curated, with processing steps including merging, deduplication, validation and compression applied.

创建时间:
2026-07-15
原始信息汇总

数据集概述

RedKamgami 是一个大规模密码字典数据集,专为安全研究、授权渗透测试、密码审计、学术研究和防御性网络安全活动而设计。

核心特性

  • 大规模密码集合:包含大量经过整理的密码数据。
  • 无重复数据集:通过去重处理确保数据唯一性。
  • 高性能密码生成器:使用 Rust 语言开发,支持流式输出、缓冲写入、最小内存分配及多核CPU优化。
  • 自动启动器/更新器:使用 Go 语言开发,支持自动版本检查、镜像选择、下载管理(支持断点续传)、SHA-256完整性验证和自动解压。
  • 多个下载镜像:提供 Google Drive、MEGA、MediaFire、OneDrive、TeraBox 等镜像源。
  • 压缩分发:使用 Zstandard (.zst) 压缩格式,压缩后文件约 2GB。
  • 开源:采用 CC0 1.0(Creative Commons Zero 1.0 Universal)许可证,允许自由使用、修改、重新分发和整合。

数据集内容

  • 数据集为纯文本格式(.txt),解压后可直接使用。
  • 构建流程包括数据集合并、去重、验证、统计生成和压缩。

使用要求

  • 通过启动器下载压缩文件(约 2GB),并放置于启动器相同目录下。
  • 支持 Windows、Linux 和 macOS 操作系统。
  • 无需额外运行时或依赖项。

法律声明

数据集仅供合法授权用途,禁止用于未授权的系统、网络或账户访问。用户须自行确保使用符合所有适用法律。

其他信息

  • 启动器会自动检查新版本,提供更新功能。
  • 每个发布版本均附带 SHA-256 校验和,自动验证文件完整性。
  • 该仓库不接受 Pull Request,且禁用 Issue 报告。
搜集汇总
数据集介绍
RedKamgami 数据集图片
构建方式
RedKamgami数据集是一个专注于密码安全研究领域的大规模密码词库。其构建过程采用了一套精密且自动化的流水线:首先通过多源数据采集,将不同来源的密码数据合并,随后进行严格的去重操作以确保每条密码条目唯一,再通过验证与统计生成高质量的最终数据集,最终采用Zstandard算法压缩为.zst格式以便分发。
使用方法
使用RedKamgami简单直接,完全通过自动化启动器管理。用户仅需从Releases页面下载对应操作系统(Windows/Linux/macOS)的可执行文件,赋予执行权限后运行,在菜单中选择下载镜像。下载完成后将压缩包置于启动器同目录,启动器将自动完成SHA-256校验与Zstandard解压。最终得到的纯文本词库RedKamgami.txt即可直接用于密码审计、渗透测试或学术研究等场景。
背景与挑战
背景概述
RedKamgami数据集由一位匿名开发者创建于2024年,旨在为密码安全研究领域提供一个大规模、去重且经过校验的密码语料库。该数据集的诞生源于学术界与工业界对现代密码强度评估、口令猜测攻击防御以及用户密码行为分析的迫切需求。通过整合海量真实密码样本,RedKamgami为安全研究人员提供了攻克密码脆弱性这一核心问题的关键资源,其影响力辐射至渗透测试、数字取证及安全审计等多个分支,成为推动密码安全实证研究的重要基石。
当前挑战
数据集所解决的领域问题在于,现有公开密码词库普遍存在体积庞大、重复率高、来源混杂的缺陷,难以支撑高效且准确的安全评估。在构建过程中,开发者面临了多重挑战:首先,需要从分布各异的公开来源中汇聚密码数据,并设计冗余消除算法以剔除重复条目,保证数据纯净度;其次,需在压缩与完整性之间取得平衡,采用Zstandard压缩算法将体积缩减至约2GB的同时,集成SHA-256校验机制防止数据损坏;此外,跨平台启动器(Go语言编写)的镜像选择、断点续传与自动解压功能,亦对分布式下载的稳定性提出了严苛要求。
常用场景
经典使用场景
RedKamgami数据集是一个大规模、去重后的密码词库,在网络安全与密码学领域中,它最经典的使用场景是作为密码强度评估与口令安全审计的基础资源。研究人员通过将该词库与哈希函数结合,模拟暴力破解或字典攻击,从而量化现实世界中用户口令的脆弱性分布。具体而言,它可以用于评估各类哈希算法(如MD5、SHA-256、bcrypt等)在实际暴破场景下的抗性,或者为学术论文中的实验部分提供标准化测试数据。该数据集因其规模庞大且无重复条目,能够更真实地反映真实密码空间的熵值,使得安全实验的可信度和泛化能力显著提升。
解决学术问题
RedKamgami数据集有效解决了口令安全研究中长期存在的两大痛点:数据规模不足与样本污染问题。传统小型密码集合难以满足现代深度学习模型对海量训练样本的需求,而公开网络爬取的数据常包含大量重复或异常条目,影响模型泛化能力。该数据集通过严格的去重与验证流程,为研究者提供了高质量的密码分布统计基准,进而得以深入探索用户密码创建行为的内在规律,例如密码长度偏好、字符组合模式、前后缀使用习惯等。此外,它有力支撑了口令猜测模型(如基于RNN或Transformer的生成式模型)的评估,推动了学术界对密码强度度量理论的修正与完善。
实际应用
在实际应用中,RedKamgami数据集主要服务于企业级安全团队的渗透测试授权与防御性安全检查。安全工程师可将其作为字典攻击的核心词库,在得到授权的情况下测试内部系统的账户锁定策略、多因素认证机制的有效性,以及身份管理系统的抗暴破能力。同时,该数据集被广泛应用于密码管理器的漏洞评估:通过模拟大规模定向破解,判断加密存储方案(如主密码的迭代哈希次数)是否达标。此外,在数字取证领域,调查人员借助该词库可以加速对加密容器或硬盘的解锁尝试,为案件调查争取关键时间。众多安全工具和框架已经将RedKamgami集成进默认字典包中,使其成为工业级安全评估的标配语言。
数据集最近研究
最新研究方向
RedKamgami数据集聚焦于大规模密码安全研究的前沿领域,尤其是在密码审计与防御性安全测试中的实际应用。随着数据泄露事件的频繁发生,密码脆弱性分析成为网络安全攻防的关键环节。该数据集通过整合去重后的海量密码库,为学术研究提供了权威的基准测试资源,支持密码强度评估、模式挖掘以及暴力破解防御优化。其采用Zstandard压缩与SHA-256完整性验证,确保数据分发的高效性与可靠性,与当前业界对自动化安全工具和开源资源的需求高度契合。RedKamgami的发布进一步推动了密码安全领域的数据驱动研究,强化了对抗性安全演习的实证基础,对提升整体网络环境的韧性具有重要意义。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务