NOC & Control Monitor

รู้ก่อนที่จะมีคนโทรแจ้ง

เหตุขัดข้องจำนวนมากมองเห็นได้เมื่อผู้ใช้กลุ่มแรกได้รับผลกระทบแล้ว Monitor จึงตรวจสอบบริการและสถานะโครงสร้างพื้นฐานที่เลือกตามรอบ ประเมินความผิดปกติ และเก็บลำดับเหตุการณ์ไว้สำหรับการวิเคราะห์ภายหลัง

Proactive service monitoring

บริการอาจเป็นสีเขียวในระดับ Global แต่ล้มเหลวในพื้นที่ได้

สามารถดำเนินการตรวจสอบตามไซต์งาน AP, SSID หรือ VLAN เพื่อยืนยันว่า DNS, DHCP, NTP, RADIUS, NAC หรือ Cloud Services ทำงานจริงในจุดที่ต้องใช้งาน

DNS / RADIUS

องค์ประกอบที่พึ่งพากันภายในพื้นที่

Hostname ของ RADIUS ไม่สามารถ Resolve ผ่าน DNS Resolver ของไซต์งานหนึ่งได้

GUEST WI-FI

สิทธิ์การเข้าถึงหมดอายุ

SSID ยังทำงานอยู่ แต่ Credentials, Voucher หรือสิทธิ์แบบจำกัดเวลาไม่สามารถใช้งานได้แล้ว

CLOUD / ONBOARDING

ถูกบล็อกโดย SSL Inspection

AP ใหม่ไม่สามารถเข้าถึง Cloud เนื่องจากการเปลี่ยนแปลง Certificate หรือกฎ Firewall

DHCP / LINK

ตอบสนอง แต่ช้าเกินไป

บางส่วนของไซต์งานมีเวลา Lease ผิดปกติหรือเกิดการล้มเหลวเป็นช่วง ๆ

Monitor Insight Loop จาก Collector ผ่าน Timeline และข้อค้นพบ ไปยัง NOC View
Collector · Samples · Timeline · Findings · NOC View · การตรวจสอบย้อนหลัง

The 18:00 question

เมื่อวานเวลา 18:00 น. เกิดอะไรขึ้น

มีการแจ้งปัญหา แต่วันนี้ไม่สามารถทำให้เกิดซ้ำได้ ในสถานการณ์เช่นนี้ NOC ต้องการมากกว่า Snapshot ปัจจุบัน

  • มีลูกค้าเชื่อมต่อกี่ราย และ AP ใดได้รับผลกระทบ
  • มีค่า CPU หรือ Memory พุ่งสูงหรือไม่
  • Throughput, Channel Utilization หรือ Airtime สูงผิดปกติหรือไม่
  • RX/TX Retries, Error Counter หรือ Noise Floor เพิ่มขึ้นหรือไม่
  • มีสัญญาณของพื้นที่ครอบคลุมไม่ดี ลูกค้าอยู่ไกล หรือ CCI หรือไม่
  • DHCP, DNS, RADIUS, NAC หรือ Cloud Services ผิดปกติในเวลาเดียวกันหรือไม่
  • พอร์ตสวิตช์มีปัญหา Link, PoE, CRC หรือ Duplex หรือไม่
การตรวจสอบ AP พร้อม Throughput ย้อนหลังและหลักฐาน RF
ใช้บริบท AP และ RF ย้อนหลัง แทน Snapshot แบบเรียลไทม์เพียงอย่างเดียว

From world map to radio

จากภาพรวมไซต์งานลงไปถึง Radio แต่ละตัว

จำกัดขอบเขตสถานะ OK, Warning และ Critical ลงไปถึง Site, Building, AP, ลูกค้า, SSID, VLAN, Radio และพอร์ตสวิตช์

แนวโน้ม Throughput และ RF พร้อม Channel Utilization และ Counters
RX, TX, Total Throughput, Airtime, Noise Floor, Retries, Errors และ Raw Counters
ลูกค้าบน AP พร้อม SSID, VLAN, RSSI และ SNR
บริบทลูกค้า SSID, VLAN, Band, RSSI และ SNR สำหรับ AP แต่ละตัว

AP and building context

จาก AP ไปจนถึงอุปกรณ์ข้างเคียง

AP Health เชื่อม CPU, Memory, Uptime, PoE, Link Speed, Duplex และพอร์ตสวิตช์ บริบท Building, Peer และ ACSP Neighbor ช่วยระบุว่าความผิดปกติเกิดที่ AP โดยตรง ภายในอาคาร หรือในสภาพแวดล้อม RF รอบพื้นที่

AP Health พร้อม CPU, Memory, Uptime, PoE และพอร์ตสวิตช์
AP Health: CPU, Memory, Uptime, PoE, Link Speed, Duplex และพอร์ตสวิตช์
บริบท Building, Peers, AP และ ACSP Neighbor
บริบท Building, Peer และ Neighbor สำหรับความผิดปกติทั้งภายในพื้นที่และทั่วไซต์งาน

Notification and handoff

เปลี่ยนการเปลี่ยนแปลงสถานะให้เป็นเหตุการณ์งานปฏิบัติการ

การตรวจสอบและข้อค้นพบถูกประเมินเป็น OK, Warning หรือ Critical และส่งต่อผ่าน API หรือ Webhook ไปยังกระบวนการ Alerting, Reporting หรือ ITSM ได้ เวิร์กโฟลว์ปลายทางจึงเริ่มต้นพร้อมขอบเขตและหลักฐานได้ทันที

Operational confidence

มองเห็นข้อมูลโดยไม่สร้างความแม่นยำที่เกินจริง

Control แสดงแหล่งข้อมูลและเวลาที่เก็บข้อมูล ทีมจึงแยกได้ระหว่างค่าปัจจุบัน Sample ที่บันทึกไว้ และสัญญาณที่ไม่ได้เก็บ เพื่อประเมินข้อมูลย้อนหลังอย่างมีหลักฐานทางเทคนิค

Proactive operations

ตรวจพบเชิงรุก เข้าใจย้อนหลัง ดำเนินการบนหลักฐาน