智能洞察支持对不同地域的不同应用进行定时巡检,并且可以针对巡检到的事件给出具体的根因分析和建议。本文介绍如何查看智能洞察巡检结果。
前提条件
已创建应用监控,具体操作,请参见应用监控接入概述。
功能入口
入口一
登录ARMS控制台。
-
在左侧导航栏选择。
在顶部菜单栏,选择地域。
-
在页面右上角的时间选择框,选择需要查看的时间段。
-
在事件列表页面顶部的下拉框选择需要查看的应用。
说明默认查看全部应用。
入口二
登录ARMS控制台。
在左侧导航栏,选择。
在顶部菜单栏,选择地域。
在应用列表页面,单击应用名称。
-
在左侧导航栏,单击智能洞察。
-
在页面右上角的时间选择框,选择需要查看的时间段。
-
在事件列表页面顶部的下拉框选择需要查看的应用。
事件类型
事件类型区域显示了当前巡检到的事件对应的各事件类型的数量。
默认展示的事件类型包括TopN接口错误率突增、流量不均、TopN接口平均响应时间突增、应用服务整体平均响应时间突增、应用服务整体错误率突增,每种类型后的数字表示对应事件的触发次数。
在事件类型区域,您可以执行以下操作:
事件数
事件数区域显示了所有事件类型在各时间点的分布情况。

在事件数区域,您可以执行以下操作:
-
将鼠标悬浮于柱状图上,查看对应时间点上各事件类型的具体事件数。
-
在柱状图上单击某个时间点,可以过滤目标时间点前后一段时间的事件。
-
单击柱状图下方的图例,可以隐藏或显示对应事件类型的数据。
事件列表
事件列表区域显示了所有事件对应的事件类型、描述、严重程度和异常开始时间。
在事件列表区域,您可以执行以下操作:
单击事件右侧操作列的查看详情,查看目标事件的详细信息。更多信息,请参见智能洞察详情。
智能洞察详情
应用服务整体平均响应时间突增
应用服务整体平均响应时间突增类型的事件详情页面显示了事件发生时间点、根因分析和故障传播链。
该详情页面顶部以折线图展示应用HTTP服务平均响应时间的变化趋势,右侧粉色区域标注检测范围;中部根因分析表格列出问题应用(如下游依赖)及疑似根因(如主机CPU利用率趋于饱和);底部调用链拓扑图以节点展示各应用间的调用关系、请求量和响应时间,异常节点以红色高亮标注本地执行耗时异常。
在智能洞察详情页面,您可以执行以下操作:
单击根因分析区域的疑似根因链接,在疑似根因面板可以查看事件产生的具体原因。
Top N接口平均响应时间突增
Top N接口平均响应时间突增类型的事件详情页面显示了事件发生时间点、根因分析和故障传播链。
事件详情页面上方展示接口平均响应时间/每分钟和接口平均请求量/每分钟两个时序折线图,右端以橙色区域标注检测范围。中部根因分析表格包含问题应用和疑似根因两列,列出下游依赖的异常类型(如调用 Redis 耗时突增、调用 MySQL 耗时突增、主机 CPU 利用率过高、本地执行异常耗时突增等)。底部故障传播拓扑图以有向图展示各应用节点间的调用关系,异常节点以红色边框高亮并标注对上游调用突增异常的贡献百分比。
在智能洞察详情页面,您可以执行以下操作:
单击根因分析区域的疑似根因链接,在疑似根因面板可以查看事件产生的具体原因。
应用服务整体错误率突增
应用服务整体错误率突增类型的事件详情页面显示了事件发生时间点、根因列表和问题传播链。
事件详情页面左侧错误数趋势图和右侧请求数趋势图以折线图展示检测范围内的指标变化。根因列表中显示问题应用及疑似根因(如"本地方法执行异常,贡献度为77.44%")。问题传播链以流程图形式展示错误从入口应用节点经接口节点传播至根因节点(本地方法)的路径,连线上标注各路径的贡献度百分比。
在智能洞察详情页面,您可以执行以下操作:
单击根因列表区域的疑似根因链接,在疑似根因面板可以查看事件产生的具体原因。
Top N接口错误率突增
Top N接口错误率突增类型的事件详情页面显示了事件发生时间点、根因列表和问题传播链。

在智能洞察详情页面,您可以执行以下操作:
流量不均
流量不均类型的事件详情页面显示了事件发生时间段、最大流量和最小流量近15分钟流量统计、最大流量和最小流量机器Top5流量接口分布。

在智能洞察详情页面,您可以执行以下操作:
Pod pending突增
Pod pending突增类型的事件详情页面显示了最近30分钟内问题集群的内存和CPU总量、请求总量以及使用总量的趋势图,同时可以查看相应时间段内关联事件以及相应Deployment的配置信息。
