Alerting 與異常偵測

把監控訊號轉化為正確團隊能立即處理的警報

觀測雲 Alerting 以閾值、突變、日誌及 DQL 規則評估指標、日誌、Trace、可用性檢查、事件與業務資料。分級、恢復、靜默及路由控制可減少噪音,並由警報直接進入相關證據。

把監控訊號轉化為正確團隊能立即處理的警報

Alerting 解決甚麼問題

識別異常、按影響路由,並保留完整排查脈絡

有效警報應説明哪項訊號改變、由誰負責,以及下一步往哪裏調查。觀測雲把彈性規則、嚴重程度、恢復、靜默、路由和觸發警報的遙測證據連在一起。

先以常用檢查覆蓋主要風險,再為關鍵服務補充規則
啟用主機、容器、應用程式、日誌、連接埠及可用性等常用檢查,再為關鍵服務、介面及業務訊號加入閾值、突變、日誌、DQL 或自訂查詢規則。
查看説明文件
先以常用檢查覆蓋主要風險,再為關鍵服務補充規則
把警報送給負責團隊,而不是吵醒所有人
把警報送給負責團隊,而不是吵醒所有人
以嚴重程度、恢復通知、靜默策略、標籤及通知目標區分緊急使用者影響與可稍後處理的狀況,並按服務、環境、團隊及業務脈絡設定範圍。
查看説明文件
由警報直接調查,毋須重新拼湊時間線
開啟相關事件,查看同一時段的日誌、APM Trace、基礎設施指標、網絡資料及變更記錄;聚合重複訊號,判斷它們是否屬於同一服務或影響範圍。
查看説明文件
由警報直接調查,毋須重新拼湊時間線

常見問題

甚麼是可觀測性 Alerting?

Alerting 評估指標、日誌、Trace、可用性檢查、事件或業務資料,並把符合條件的訊號轉化為可調查的通知與事件。

觀測雲支援哪些警報規則?

觀測雲支援閾值、突變、日誌、DQL、自訂查詢及內置偵測規則,涵蓋基礎設施、應用程式、日誌、網絡、可用性及業務資料。

如何減少警報噪音?

利用嚴重程度、靜默策略、恢復通知、標籤、負責人路由及事件聚合,可避免重複訊號打擾無關團隊。

警報觸發後如何繼續排查?

警報會形成事件,團隊可連接相關日誌、Trace、指標、基礎設施、網絡及變更脈絡繼續調查。

把異常偵測連接至事件及故障處理流程

由警報繼續前往 Event Management、異常追蹤、日誌、SLO、文件或價格資訊。

立即開始 > 查看説明文件 > 查看價格 >