TSCWORLD AI AI-Powered Business Platform

System Monitoring AI

122

สุขภาพระบบ เซิร์ฟเวอร์ ฐานข้อมูล และเวลาตอบสนอง — เซิร์ฟเวอร์ที่มีการแจ้งเตือนค้างไม่นับว่าปกติ

System Statusมีแจ้งเตือน 2 รายการ 12
Live
สุขภาพระบบโดยรวม
0%
มีแจ้งเตือน 2 รายการ
เฉลี่ยจาก 6 องค์ประกอบ — แก้จาก 98.7
เวลาทำงานต่อเนื่อง 30 วัน
0%
↑ 0.12 จุด
หยุดทำงานรวม 21.6 นาที
เวลาตอบสนองเฉลี่ย
0มิลลิวินาที
↓ 12 มิลลิวินาที
เกณฑ์ที่ตั้งไว้ 300 มิลลิวินาที
ผู้ใช้ที่ออนไลน์ขณะนี้
0คน
↑ 8.7%
จากบัญชีที่ใช้งานใน 30 วัน 8,256
เหตุการณ์ที่ยังไม่ปิดวันนี้
0รายการ
ต้องแก้ก่อน
วิกฤต 1 · เฝ้าระวัง 1
เหตุการณ์ที่ปิดแล้ววันนี้
0รายการ
↑ 25%
เวลาแก้เฉลี่ย 24 นาที

องค์ประกอบสุขภาพระบบ ค่าเฉลี่ย 98.9%

โครงสร้างพื้นฐาน 99.2%
ฐานข้อมูล 99.1%
เครือข่าย 99.0%
บริการ AI 98.9%
ความปลอดภัย 98.6%
แอปพลิเคชัน 98.5%

(99.2 + 99.1 + 99.0 + 98.9 + 98.6 + 98.5) ÷ 6 = 592.3 ÷ 6 = 98.883 → 98.9%

ต้นแบบแสดง 98.7% ทั้งที่ค่าเฉลี่ยขององค์ประกอบทั้งหกที่วางอยู่รอบ ๆ คือ 98.9% — ต่างกันเพียง 0.2 จุดซึ่งดูเล็กน้อย แต่เมื่อตัวเลขสรุปไม่ตรงกับส่วนประกอบที่แสดงข้างกัน ผู้ดูแลจะเริ่มไม่เชื่อทั้งหน้า · และคำว่า "Excellent" ถูกถอดออก ระบบที่มีการแจ้งเตือนระดับวิกฤตค้างอยู่ไม่ควรถูกสรุปด้วยคำเดียวว่าดีเยี่ยม ค่าเฉลี่ยที่สูงเกิดจากการเฉลี่ยที่กลบปัญหาเฉพาะจุด

สถานะโครงสร้างพื้นฐาน 283 หน่วย

ประเภททั้งหมดปกติเฝ้าระวังสถานะ
เว็บเซิร์ฟเวอร์34340ปกติทั้งหมด
เซิร์ฟเวอร์แอปพลิเคชัน62611APP-SEA-01 ใช้ CPU สูง
คลัสเตอร์ฐานข้อมูล12120ปกติทั้งหมด
เซิร์ฟเวอร์แคช880ปกติทั้งหมด
คิวข้อความ660ปกติทั้งหมด
เซิร์ฟเวอร์จัดเก็บข้อมูล18180ปกติทั้งหมด
โหนดประมวลผล AI16151ตอบสนองช้าเกินเกณฑ์
โหนดกระจายเนื้อหา1281280ปกติทั้งหมด
รวม2832812

34 + 62 + 12 + 8 + 6 + 18 + 16 + 128 = 283 หน่วย ✓ · ปกติ 281 + เฝ้าระวัง 2 = 283 ✓ ตรงกับจำนวนเหตุการณ์ที่ยังไม่ปิด

ต้นแบบแสดงทุกกลุ่มเป็น "ปกติทั้งหมด" รวมทั้งเซิร์ฟเวอร์แอปพลิเคชัน 62 จาก 62 ทั้งที่หน้าเดียวกันมีการแจ้งเตือนสองรายการที่ยังไม่ปิด คือ CPU สูงผิดปกติที่เครื่องหนึ่ง และเวลาตอบสนองเกินเกณฑ์ที่โหนด AI อีกเครื่อง · เมื่อรายการนับจำนวนไม่สอดคล้องกับรายการแจ้งเตือน ผู้ดูแลจะเชื่อรายการที่ดูสบายใจกว่า ระบบนี้จึงผูกทั้งสองส่วนเข้าด้วยกัน เครื่องที่มีการแจ้งเตือนค้างจะถูกย้ายออกจากคอลัมน์ปกติโดยอัตโนมัติ

บริการที่ตอบสนองช้าที่สุด เทียบเกณฑ์ที่ตั้งไว้

บริการเวลาตอบสนองเกณฑ์สถานะ
บริการยืนยันตัวตน124 มิลลิวินาที300ปกติ
เกตเวย์ API165 มิลลิวินาที300ปกติ
บริการผู้ใช้198 มิลลิวินาที300ปกติ
บริการ AI Agent245 มิลลิวินาที300ใกล้เกณฑ์
บริการรายงาน310 มิลลิวินาที300เกินเกณฑ์
บริการแจ้งเตือน512 มิลลิวินาที300เกินเกณฑ์มาก

เพิ่มคอลัมน์เกณฑ์ที่ต้นแบบไม่มี — ต้นแบบติดป้าย “Good” และ “Warning” ให้แต่ละบริการโดยไม่บอกว่าใช้เกณฑ์อะไร ทำให้บริการที่ 245 มิลลิวินาทีถูกติดป้ายเตือนขณะที่ 198 มิลลิวินาทีติดป้ายปกติ โดยผู้อ่านไม่รู้ว่าเส้นแบ่งอยู่ตรงไหน · เมื่อเขียนเกณฑ์ไว้ ทุกแถวตรวจสอบได้เองและผู้ดูแลรู้ว่าต้องแก้ให้ถึงเท่าไร

การใช้ทรัพยากรและการคาดการณ์

หน่วยประมวลผล
28%
หน่วยความจำ
54%
พื้นที่จัดเก็บ
62%
เครือข่าย
41%
เวลาตอบสนองของบริการรายงานเกินเกณฑ์สูงกว่าปกติ 68% · โซนเอเชีย · ยังไม่ปิด วิกฤต
เครื่อง APP-SEA-01 ใช้ CPU สูงกว่าปกติ 35%แนวโน้มเพิ่มขึ้นใน 30 นาทีที่ผ่านมา · ยังไม่ปิด เฝ้าระวัง
หน่วยความจำของเครื่องฐานข้อมูล DB-02 ใกล้เต็มโอกาสเกิดปัญหา 72% ภายใน 6 ชั่วโมง คาดการณ์
ปริมาณข้อมูลในโซนยุโรปเพิ่มสูงขึ้นโอกาสเกิดปัญหา 58% ภายใน 12 ชั่วโมง คาดการณ์

ต้นแบบแสดง "AI Prediction Score 92/100 เสี่ยงต่ำ" คู่กับการแจ้งเตือนระดับวิกฤตที่ยังไม่ปิด — ระบบที่มีบริการหนึ่งตอบสนองช้ากว่าเกณฑ์ 68% อยู่ในขณะนั้น ไม่ควรถูกสรุปว่าความเสี่ยงต่ำ · คะแนนคาดการณ์วัดความน่าจะเป็นที่จะเกิดปัญหาในอนาคต ไม่ได้วัดปัญหาที่กำลังเกิดอยู่ สองอย่างนี้ต่างกันและไม่ควรวางไว้ในการ์ดเดียวกันโดยไม่แยก ระบบนี้จึงแยกเป็นสองส่วนคือรายการที่ยังไม่ปิด และรายการที่คาดว่าจะเกิด

Data Security: AES-256 Encryption AI Model: TSC Command AI v1.0 (ต้นแบบ — ยังไม่ผูกผู้ให้บริการโมเดลจริง) Last Update: 31 พ.ค. 2569 10:24:36 Data Center: Singapore · Backup: Active System Status: ปกติ

ต้นแบบ — ข้อมูลตัวอย่าง · ข้อมูลจัดชั้น C5 — Super Admin เข้าถึงข้อมูลของทุกองค์กรได้ ทุกการกระทำถูกบันทึกและตรวจสอบย้อนหลังได้เสมอ · หน้านี้แก้จากต้นแบบ 3 จุด สุขภาพระบบ 98.7% ไม่เท่ากับค่าเฉลี่ยขององค์ประกอบทั้งหกที่แสดงข้างกันเอง (98.9%) · "Application Servers 62/62 Healthy" ขัดกับการแจ้งเตือนบนหน้าเดียวกัน ที่ระบุว่าเครื่องหนึ่งใช้ CPU สูงกว่าปกติ 35% เครื่องที่มีการแจ้งเตือนค้างอยู่ไม่ควรถูกนับว่าปกติ · และ"AI Prediction Score 92/100 เสี่ยงต่ำ" แสดงคู่กับการแจ้งเตือนระดับวิกฤตที่ยังไม่ปิด ซึ่งขัดกันเอง