管理服務錯誤事件

在 Error Reporting 中,您可以監控及診斷記錄錯誤訊息 (不含堆疊追蹤) 的服務 Google Cloud 平台故障情形,快速解決基礎架構問題。

舉例來說,如果 Cloud Run 在處理要求時達到容器執行個體數量上限,系統會在記錄項目中記錄失敗情形。Error Reporting 會偵測到這項事件,並將其與類似的服務錯誤歸類在一起,然後通知您。接著,您可以使用控制台中的直接連結,開啟服務專屬的疑難排解說明文件,解決瓶頸問題。

查看服務錯誤群組

前往 Google Cloud 控制台的「Error Reporting」頁面:

前往Error Reporting

您也可以透過搜尋列找到這個頁面。

Error Reporting 判斷發生服務故障時,會將這些錯誤事件歸為同一組,並將錯誤類型設為 Service error。「Error Reporting」總覽會顯示錯誤類型,以及錯誤群組的其他資訊:

Error Reporting 總覽頁面

如果服務錯誤事件有記錄在案的解決方案,Error Reporting 會提供 Google Cloud 服務的疑難排解指南連結。

服務錯誤事件範例

下表列出部分 (但並非全部) 錯誤事件,這些事件會由 Error Reporting 的「服務錯誤」功能擷取。

Google Cloud 服務名稱 錯誤類型
Dataflow 工作站記錄節流
記憶體不足 (系統)
缺少自訂子網路
步驟中的作業時間過長
JRE 損毀
工作站 JAR 檔案設定錯誤
Cloud Run 已超出記憶體上限
沒有可用的執行個體
Google Kubernetes Engine Pod 健康狀態不良,探測失敗
Pod 無法排程
無法重新啟動容器 (因回溯)
卸載磁碟區
無法提取容器映像檔
無法更新端點
找不到密鑰/ConfigMap