Error Reporting を使用すると、スタック トレースなしでエラー メッセージを記録する Google Cloud サービス全体でプラットフォームの障害をモニタリングして診断できます。たとえば、Cloud Run がコンテナ インスタンスの最大上限に達すると、Error Reporting はログイベントをグループ化し、通知を送信して、サービス固有のトラブルシューティング ドキュメントへの直接リンクを提供します。
サービス エラーグループを表示する
Google Cloud コンソールで [Error Reporting] ページに移動します。
このページは、検索バーを使用して見つけることもできます。
Error Reporting は、サービス障害があると判断すると、これらのエラーイベントをグループ化し、エラーのタイプを Service error に設定します。Error Reporting の概要には、エラーのタイプとエラーグループに関するその他の情報が表示されます。
解決策が文書化されているサービスエラー イベントの場合、Error Reporting は Google Cloud サービスのトラブルシューティング ガイドへのリンクを提供します。
サービス エラー イベントのサンプル
次の表に、Error Reporting のサービス エラー機能でキャプチャされるエラー イベントの一部を示します。
| Google Cloud サービス名 | エラーの種類 |
|---|---|
| Dataflow | ワーカーログのスロットリング メモリ不足(システム) カスタム サブネットがない ステップでの長時間実行 JRE クラッシュ ワーカー JAR ファイルの構成ミス |
| Cloud Run | メモリ上限の超過 使用可能なインスタンスがない |
| Google Kubernetes Engine | Pod に異常があり、プローブが失敗しました Pod のスケジューリングに失敗しました バックオフでコンテナの再起動に失敗しました ボリュームがマウント解除されました コンテナ イメージの pull に失敗しました エンドポイントの更新に失敗しました Secret/ConfigMap が見つかりません |