AIOps 平台的误解,挑战及建议, AIOps背景及所应具备技术能力分析(上)
1126
2022-11-12
本文目录一览:
看告警是否影响正常办公。不影响的话,要调整告警时段和告警阀值·望采纳!谢谢!
由于监控项较多,当一起产生告警时,运维人员会应接不暇。云帮手通过告警信息分类展示,让用户可自行选择查看某一项告警信息,能够减少遗漏,快速找到问题根源并处理;同样,有效的日志分类能够帮助用户及时查看到自己某一项的操作记录,快速追溯到问题根源,提高运维效率。
通常智能运维中的告警收敛场景,以机器学习算法为驱动,对海量的告警事件进行降噪和关联分析,辅助根因定位并可沉淀故障处理的知识,从而提升企业的运维效率,降低运维成本。 告警产生后,AIOps系统通过算法甄别 内容相关性(重复性、相似性)、时序相关性和拓扑相关
性 事件来进行告警事件的自动化抑制。这类收敛抑制,往往能得到99%的告警压缩率,极大地提高了告警有效性。
在一个完整的智能运维告警产品里,除了告警收敛,还可以基于故障传播链及拓扑信息 ( 可选 ), 智能发现突发故障场景;基于告警“熵值”算法,实现告警的动态优先级推荐;通过时序以及拓扑关系定位故障场景根因,并进行根因标记。当这些都可以完成时,由告警事件一步步引导的根因定位和排障,才是真正智能运维发挥了作用。
发表评论
暂时没有评论,来抢沙发吧~