saas-vendor-status-pages-outages-incidents-daily
收藏资源简介:
该数据集是 SaaS 厂商状态页面的事件与厂商映射集合,每天自动重建。它跟踪1127个厂商的公共状态页面,记录每个厂商发布的事件(标题、影响、开始/解决时间、永久链接),并维护厂商列表及其使用的状态页面平台信息。数据集包含两个表格:incidents(事件表)和vendors(厂商表)。数据集每天更新,适用于时间序列预测、表格分类和文本分类等任务,可用于监控第三方服务可靠性、SRE/DevOps运维、厂商管理、事件分析等场景。
This dataset is a collection of incidents from SaaS vendor status pages and their vendor mappings, rebuilt daily. It tracks the public status pages of 1,127 vendors, recording each vendors published incidents (title, impact, start/resolution time, permalink), and maintains a list of vendors along with the status page platform they use. The dataset contains two tables: incidents (incident table) and vendors (vendor table). It is updated daily and is suitable for tasks such as time series forecasting, tabular classification, and text classification, as well as applications like monitoring third-party service reliability, SRE/DevOps operations, vendor management, and incident analysis.
数据集概述
该数据集记录了SaaS供应商公开状态页面上的故障与事件信息,每日自动重建,提供实时监控数据及历史事件记录。
- 许可协议: CC BY 4.0
- 语言: 英语
- 任务类别: 时间序列预测、表格分类、文本分类
- 标签: 状态页、故障、中断、SaaS、云计算、可靠性、SRE、DevOps、供应商管理、第三方风险、时间序列、每日更新等
- 数据规模: 10K < n < 100K
数据内容
数据集包含两个配置表(Config):
| 配置名称 | 路径 | 内容 |
|---|---|---|
incidents |
data/incidents.csv |
供应商状态页上发布的事件记录,共14,738条,覆盖618家供应商 |
vendors |
data/vendors.csv |
供应商映射表,共1,127家供应商,记录其使用的状态页平台、可解析性等 |
incidents 表结构
| 列名 | 含义 |
|---|---|
vendor_slug |
稳定ID,对应供应商页面 |
vendor |
供应商显示名称 |
platform |
状态页平台(如statuspage、statusio、instatus、betterstack等) |
incident_id |
供应商自己的事件ID |
title |
事件标题 |
impact |
影响标签(无/轻微/重大/严重/维护) |
state |
事件状态(调查中/已识别/监控中/已解决等) |
started_at |
事件开始时间 |
resolved_at |
事件解决时间(若未解决则为空) |
resolved_inferred |
结束时间是否为推断值(事件消失而非正式发布) |
updated_at |
供应商最后更新时间戳 |
url |
供应商状态页上事件的永久链接 |
first_seen |
管道首次记录该事件的时间 |
vendors 表结构
| 列名 | 含义 |
|---|---|
slug, name |
ID及显示名称 |
platform |
检测到的状态页平台,或标记为不支持/已失效 |
base |
机器可读的状态API基础URL |
supported |
每日轮询是否能解析该页面 |
last_state |
上次轮询的状态(正常/降级/部分/严重/维护/未知) |
last_checked |
轮询时间戳 |
派生数据
同一管道还生成另一个数据集,记录每次事件持续时间(resolved_at - started_at)及每家供应商的中位解决时间(MTTR):SaaS供应商故障持续时间/解决时间/MTTR数据集
更新频率与覆盖范围
- 更新频率: 每日自动重建,最后更新时间:2026-09-06 15:32 UTC
- 覆盖范围: 1,127家供应商中,805家可被自动解析;其余(如Apple、Microsoft 365、Notion等定制HTML页面或没有公共JSON提要的平台)标记为
supported=false,不作猜测 - 特殊说明: AWS、Azure、Google Cloud/Firebase/Workspace/Play、Slack、Stripe等平台从其官方公共数据源解析,平台类型标记为
bespoke - 数据限制: 状态页是供应商选择公开的内容,空记录不代表未发生事件;管道不会合成“正常”状态
活跃事件最多的供应商(90天内)
以下供应商在90天内公开事件数量最高(排名与数量仅供参考,不代表可靠性排名):
| 供应商 | 90天事件数 | 记录总数 |
|---|---|---|
| Twilio | ≥65 | 65 |
| Cloudflare | ≥57 | 57 |
| Zoom | ≥56 | 56 |
| Datto | ≥56 | 56 |
| GitHub | ≥52 | 52 |
| Anthropic | ≥50 | 50 |
| Supabase | ≥50 | 50 |
| Vercel | 33 | 51 |
说明: 部分条目带“≥”符号,表示供应商状态页API最多返回50条记录,而该供应商的归档起始时间在90天窗口之内,因此显示为下限值,而非实际总数。
数据使用
可通过Hugging Face datasets 库加载数据:
python from datasets import load_dataset inc = load_dataset("APProjects/saas-vendor-status-pages-outages-incidents-daily", "incidents", split="train") vendors = load_dataset("APProjects/saas-vendor-status-pages-outages-incidents-daily", "vendors", split="train")
或直接读取CSV文件:
python import pandas as pd df = pd.read_csv("https://huggingface.co/datasets/APProjects/saas-vendor-status-pages-outages-incidents-daily/resolve/main/data/incidents.csv") df.groupby("vendor").size().sort_values(ascending=False).head(20)
引用方式
引用该数据集时,请注明:“Vendor Status Watch, https://github.com/APVentureEngine/vendor-status-watch”。数据来源为各供应商自己的公开状态页面。




