工单关联度与复发问题识别数据
收藏资源简介:
本数据集适用于运维知识库建设团队、产品改进部门及质量管理人员。外部企业可直接利用“相似工单数量”快速了解某类问题历史上出现了多少次,判断是否属于老问题复现;利用“复发等级”识别高频复发的问题类型,将其纳入月度整改专项,推动根源性修复;利用“典型解决方案”直接复用历史经验,减少重复分析和沟通成本;利用“问题类型标签”发现哪些类型占总工单比例较高,从而反思分类规则是否足够细化。企业可将该数据集作为知识库的基础资产,缩短问题解决周期,提升运维效率。 1.数据采集:从工单系统导出原始记录,包含工单ID、问题描述、处置方案等字段。问题类型可预先通过关键词规则分类。 2.数据清洗与预处理:剔除工单状态为“已取消”或“无效”的记录;剔除问题描述为空的异常记录;统一文本格式。 3.数据加工规则: 问题类型:根据问题描述关键词分类为前端页面类、SSL证书类、安全类、SEO优化类、随手拍隐患类、巡检任务类、其他七类。 相似工单数量:对每个问题类型,统计该类型的总工单数,减去当前工单自身,得到相似工单数量。该值为固定数值,同一类型的所有行相同。 复发等级:根据相似工单数量判定。若相似工单数量≥5,则标记为“高频复发”;若3≤相似工单数量<5,则标记为“中频复发”;若1≤相似工单数量<3,则标记为“偶发复发”;若相似工单数量=0,则标记为“首次出现”。 典型解决方案:对同一问题类型下所有工单的处置方案进行词频统计,选取出现次数最多的方案(众数)。若该类型下所有处置方案均只出现一次(无众数),则标记为“暂无历史方案”。 问题类型标签:根据该问题类型占总工单数的比例判定。若占比≥20%,则标记为“高频问题类型”;若10%≤占比<20%,则标记为“中频问题类型”;若占比<10%,则标记为“低频问题类型”。 4.数据应用:外部企业可将“高频复发”问题纳入月度整改专项,推动根源性修复;将“典型解决方案”录入知识库供新员工培训使用。




