サービスエラー イベントを管理する

Error Reporting を使用すると、スタック トレースなしでエラー メッセージを記録する Google Cloud サービス全体でプラットフォームの障害をモニタリングして診断できます。たとえば、Cloud Run がコンテナ インスタンスの最大上限に達すると、Error Reporting はログイベントをグループ化し、通知を送信して、サービス固有のトラブルシューティング ドキュメントへの直接リンクを提供します。

サービス エラーグループを表示する

Google Cloud コンソールで [Error Reporting] ページに移動します。

Error Reporting に移動

このページは、検索バーを使用して見つけることもできます。

Error Reporting は、サービス障害があると判断すると、これらのエラーイベントをグループ化し、エラーのタイプを Service error に設定します。Error Reporting の概要には、エラーのタイプとエラーグループに関するその他の情報が表示されます。

Error Reporting の概要ページ

解決策が文書化されているサービスエラー イベントの場合、Error Reporting は Google Cloud サービスのトラブルシューティング ガイドへのリンクを提供します。

サービス エラー イベントのサンプル

次の表に、Error Reporting のサービス エラー機能でキャプチャされるエラー イベントの一部を示します。

Google Cloud サービス名 エラーの種類
Dataflow ワーカーログのスロットリング
メモリ不足(システム)
カスタム サブネットがない
ステップでの長時間実行
JRE クラッシュ
ワーカー JAR ファイルの構成ミス
Cloud Run メモリ上限の超過
使用可能なインスタンスがない
Google Kubernetes Engine Pod に異常があり、プローブが失敗しました
Pod のスケジューリングに失敗しました
バックオフでコンテナの再起動に失敗しました
ボリュームがマウント解除されました
コンテナ イメージの pull に失敗しました
エンドポイントの更新に失敗しました
Secret/ConfigMap が見つかりません