本頁說明如何在 Cloud Monitoring 中建立以 PromQL 為基礎的快訊政策。您可以使用 PromQL 查詢,透過比率、根據不同指標的動態門檻,以及合併指標等功能建立複雜條件。您也可以設定以 PromQL 為基礎的快訊政策,對超過 2 年的資料執行作業。
如果您在外部環境使用 Prometheus,或在 Managed Service for Prometheus 中使用快訊功能,則可將 Prometheus 快訊規則遷移至以 PromQL 為基礎的快訊政策。 Google Cloud這樣一來,您就能在 Cloud Monitoring 中管理所有快訊政策。
您也可以將 Grafana 資訊主頁匯入 Cloud Monitoring。
- 如要瞭解如何在 Monitoring 中使用 PromQL,請參閱「Cloud Monitoring 中的 PromQL」。
- 如要瞭解警告政策的一般資訊,請參閱「以指標為基準的警告政策行為」。
在 Cloud Monitoring 快訊政策中使用 PromQL
您可以透過下列方式建立以 PromQL 為基礎的快訊政策:
如要在 Google Cloud 控制台中建立警告政策,並在程式碼編輯器中定義 PromQL 查詢,請參閱「建立以 PromQL 為基礎的警告政策 (控制台)」。
如要使用 gcloud CLI 或 Monitoring API 中的
AlertPolicy建構函式,建立以 PromQL 為基礎的警告政策,請參閱「建立以 PromQL 為基礎的警告政策 (API)」。如要使用 Google Cloud CLI 將 Prometheus 快訊規則和通知管道遷移至 Cloud Monitoring,請參閱「從 Prometheus 遷移快訊規則和接收者」。
以 PromQL 為準的警告政策所建立的事件,會與其他事件一起顯示在 Google Cloud 控制台中。您可以在 Google Cloud 控制台中與這些事件互動。
以 PromQL 為基礎的警報政策條件可以參照 Cloud Monitoring 中的任何指標,包括系統指標、自訂指標、記錄指標和 Prometheus 指標。 Google Cloud 您必須將非 Prometheus 指標的名稱轉換為 PromQL 指標語法。詳情請參閱「將 Monitoring 指標對應至 PromQL」。
查詢超過 2 年的指標資料
其他快訊政策類型僅支援查詢 25 小時以上的指標資料,但您可以使用 PromQL,針對最多 2 年的指標資料設定快訊。這項功能支援的用途包括:
- 比較過去 5 分鐘與 1 週前相同 5 分鐘期間的資料,偵測異常狀況。
- 執行 7 天的緩慢消耗警告政策。
- 取得上個月的平均值,並在最近一小時的資料與該平均值相差超過 3 個標準差時發出快訊。
- 使用過去一週的資料執行
predict_linear函式,判斷您是否會在次日超出門檻。
如果 PromQL 快訊政策使用最近 25 小時的資料 (由對齊週期和使用 offset 修飾符造成的任何時間偏移量加總定義),則最快每 30 秒就能評估一次。如果政策是根據舊資料運作,評估頻率就會降低,最短時間間隔取決於警告政策回溯的時間範圍:
| 查詢回溯範圍 | 最短 (預設) 評估間隔 |
|---|---|
| 最長 25 小時1 | 30 秒 |
| 25 小時至 8 天 | 5 分鐘 |
| 8 至 16 天 | 1 小時 |
| 16 至 32 天 | 2 小時 |
| 32 天至 93 天 | 6 小時 |
| 93 天至 2 年 | 12 小時 |
1 部分 Google Cloud 服務的指標僅支援 30 秒的評估間隔,最多可達 23 小時 30 分鐘。
請務必將所有 rate 時長設為至少與評估間隔等長,以免警告政策遺漏任何資料。舉例來說,如果評估間隔為 1 小時,查詢應如下所示:rate(metric[1h])。
如果條件的資料時間超過 25 小時,查詢期限為 2 分鐘,與 Metrics Explorer 的期限相同。如果 PromQL 查詢在 Metrics Explorer 中不會逾時,就不會在快訊中逾時。
使用過去 25 小時的資料時,PromQL 警報政策的可靠性會大幅提升。為確保最高可靠性,請確認重新測試時間範圍、對齊時間和使用 offset 修飾符造成的任何時間差加總最多為 25 小時。
如果 PromQL 快訊查詢存取的資料超過 25 小時,系統會停用重試視窗。
您只能針對自訂指標 (前置字元為 custom.googleapis.com) 和使用者定義的記錄型指標 (前置字元為 logging.googleapis.com/user/) 的最新 25 小時資料設定快訊。
限制
請勿在以 PromQL 為基礎的快訊政策中,新增使用系統中繼資料標籤的篩選器。
以 PromQL 為基礎的警告政策,最多可有 24 小時的重新測試時間範圍。如果使用重測時間範圍,重測時間範圍、對齊期和使用 offset 修飾符造成的任何時差加總,不得超過 25 小時。
如果 Prometheus 警告規則參照指標,您必須先在 Cloud Monitoring 中建立對等指標描述元,才能建立以 PromQL 為基礎的警告政策。不過,您可以使用 Cloud Monitoring API 設定以 PromQL 為基礎的警告政策,藉此覆寫這項驗證。詳情請參閱「停用指標存在性檢查」。
如果警告政策監控指標比率,請將時長設為至少兩倍的評估間隔。如果時間過短,可能會導致誤報事件。詳情請參閱「因比率計算異常而出現的錯誤快訊」。
定價
如要瞭解 Cloud Monitoring 的定價,請參閱「Google Cloud Observability 定價」頁面。