NOC & Control Monitor

在第一通电话之前就掌握情况。

许多故障只有在用户已经受到影响后才会显现。Monitor 周期性检查选定服务与基础设施状态,评估偏差,并保留时间线供后续分析。

Proactive service monitoring

某项服务可能全局健康,却在本地失效。

检查可按站点、AP、SSID 或 VLAN 执行,从而确认 DNS、DHCP、NTP、RADIUS、NAC 或云服务是否在真正需要它们的位置正常工作。

DNS / RADIUS

本地依赖

某个 RADIUS 主机名无法通过单一站点的 DNS 解析器解析。

访客无线网络

访问已过期

SSID 仍处于启用状态,但凭据、Voucher 或限时访问已经失效。

CLOUD / ONBOARDING

被 SSL Inspection 阻断

由于证书改写或防火墙规则,新 AP 无法连接云端。

DHCP / LINK

可以响应,但速度过慢

站点的一部分出现异常 Lease 时长或间歇性故障。

从 Collector、Timeline 与 Findings 到 NOC View 的 Monitor Insight Loop
Collector · Sample · Timeline · Finding · NOC View · 历史排查

The 18:00 question

昨天 18:00 发生了什么?

问题曾被报告,但今天已无法复现。正是在这种情况下,NOC 需要的不只是当前 Snapshot。

  • 当时连接了多少客户端,受影响的是哪个 AP?
  • 是否出现 CPU 或内存峰值?
  • 吞吐量、信道利用率或 Airtime 是否异常升高?
  • RX/TX 重试、错误计数器或噪声底是否上升?
  • 是否存在覆盖不足、远端客户端或 CCI 迹象?
  • DHCP、DNS、RADIUS、NAC 或云服务是否同时异常?
  • 交换机端口是否出现链路、PoE、CRC 或双工问题?
包含历史吞吐量与 RF 证据的 AP 排查
用历史 AP 与 RF 上下文取代单纯的实时 Snapshot。

From world map to radio

从站点概览深入到单个 Radio。

OK、Warning 与 Critical 状态可逐层缩小至站点、楼宇、AP、客户端、SSID、VLAN、Radio 与交换机端口。

包含信道利用率与计数器的吞吐量和 RF 趋势
RX、TX、总吞吐量、Airtime、噪声底、重试、错误与原始计数器。
AP 上的客户端及其 SSID、VLAN、RSSI 与 SNR
按 AP 提供客户端、SSID、VLAN、频段、RSSI 与 SNR 上下文。

AP and building context

从 AP 一直看到它的邻居。

AP Health 汇总 CPU、内存、运行时间、PoE、链路速率、双工与交换机端口数据。楼宇、Peer 与邻居上下文可判断异常源自 AP 本身、楼宇范围,还是本地射频环境。

包含 CPU、内存、运行时间、PoE 与交换机端口的 AP Health
AP Health:CPU、内存、运行时间、PoE、链路速率、双工与交换机端口。
楼宇、Peer、AP 与邻居上下文
用于本地与站点级异常分析的楼宇、Peer 与邻居上下文。

Notification and handoff

将一次状态变化转化为运维事件。

检查与发现项会被评估为 OK、Warning 或 Critical,并可通过 API 或 Webhook 传入告警、报告或 ITSM 流程。下游工作流可以在一开始就获得完整范围与证据。

Operational confidence

可见性,而不是虚假的精确性。

Control 显示数据来源与采集时间。团队可以区分实时值、已保存 Sample 与未采集信号,并以技术上可靠的方式评估历史结论。

Proactive operations

主动发现,理解历史,基于证据行动。