在 Error Reporting 中,您可以監控及診斷記錄錯誤訊息 (不含堆疊追蹤) 的服務 Google Cloud 平台故障情形,快速解決基礎架構問題。
舉例來說,如果 Cloud Run 在處理要求時達到容器執行個體數量上限,系統會在記錄項目中記錄失敗情形。Error Reporting 會偵測到這項事件,並將其與類似的服務錯誤歸類在一起,然後通知您。接著,您可以使用控制台中的直接連結,開啟服務專屬的疑難排解說明文件,解決瓶頸問題。
查看服務錯誤群組
前往 Google Cloud 控制台的「Error Reporting」頁面:
您也可以透過搜尋列找到這個頁面。
Error Reporting 判斷發生服務故障時,會將這些錯誤事件歸為同一組,並將錯誤類型設為 Service error。「Error Reporting」總覽會顯示錯誤類型,以及錯誤群組的其他資訊:
如果服務錯誤事件有記錄在案的解決方案,Error Reporting 會提供 Google Cloud 服務的疑難排解指南連結。
服務錯誤事件範例
下表列出部分 (但並非全部) 錯誤事件,這些事件會由 Error Reporting 的「服務錯誤」功能擷取。
| Google Cloud 服務名稱 | 錯誤類型 |
|---|---|
| Dataflow | 工作站記錄節流 記憶體不足 (系統) 缺少自訂子網路 步驟中的作業時間過長 JRE 損毀 工作站 JAR 檔案設定錯誤 |
| Cloud Run | 已超出記憶體上限 沒有可用的執行個體 |
| Google Kubernetes Engine | Pod 健康狀態不良,探測失敗 Pod 無法排程 無法重新啟動容器 (因回溯) 卸載磁碟區 無法提取容器映像檔 無法更新端點 找不到密鑰/ConfigMap |