网络态势
值班看板:当前故障、不可达设备、高负载链路、抖动接口,故障时间线,最吵的触发器和最新告警。直接读取 Zabbix,不调用模型。所有版本可用。
网络态势回答「网络此刻哪里在出问题」。数据每次直接从 Zabbix 读取,不调用模型,所有版本可用。页面每 30 秒刷新一次,右上角可以 暂停刷新。时间窗 可选 1 小时、6 小时、24 小时、7 天、30 天,默认 24 小时。可以按 主机组 筛选;启用了主机组白名单时,必须选择一个主机组。

关键指标
| 指标 | 计算方式 |
|---|---|
| 当前故障 | 当前未恢复的问题数,下方显示其中未确认的数量。有严重以上的故障时标记数量 |
| 不可达设备 | 在监控中的主机里,agent、SNMP、IPMI 或 JMX 接口不可用,或 icmpping 最新值为 0 的主机数 |
| 高负载链路 | 当前入或出方向速率达到 net.if.speed 80% 的接口数。阈值由 RST_REPORT_LINK_BUSY_PCT 设置。没有带速率的接口监控项时显示 没有带速率的接口监控项 |
| 抖动接口 | 时间窗内同一接口类触发器触发 2 次及以上的接口数 |
接口类触发器按触发器名称(例如 Link down、Interface、operational status)或标签(interface、ifname、port)识别,覆盖 Zabbix 自带的网络模板。
故障时间线与严重度分布
故障时间线 按时间段统计时间窗内的故障事件数。旁边的 当前故障严重度 是当前未恢复问题的严重度占比。时间窗内的故障事件超过 1 万条时,页面提示时间线和排行只统计了最近的 1 万条。
排行与最新告警
| 列表 | 内容 | 选择一项后 |
|---|---|---|
| 最吵的触发器 | 时间窗内触发次数最多的 10 个触发器 | 打开实时故障并按该触发器筛选 |
| 抖动最多的接口 | 触发 2 次及以上的接口类触发器,前 10 个 | 同上 |
| 不可达设备 | 不可达的设备和原因 | |
| 高负载链路 | 超过阈值的链路 | |
| 最新告警 | 最近的故障,可以用 搜索触发器或设备 过滤 | 打开该告警的详情 |
一个噪声大的触发器常常占去大半队列。可以在触发器与监控配置中重新生成阈值,或在 Zabbix 中调整。高负载链路的长期趋势(P95、预测)见运维报告。