Error Reporting에서는 스택 트레이스 없이 오류 메시지를 기록하는 서비스 전반에서 Google Cloud 플랫폼 오류를 모니터링하고 진단하여 인프라 문제를 신속하게 해결할 수 있습니다.
예를 들어 Cloud Run이 요청 중에 최대 컨테이너 인스턴스 한도에 도달하면 실패가 로그 항목에 기록됩니다. Error Reporting은 이 이벤트를 감지하고 유사한 서비스 오류와 함께 그룹화하여 사용자에게 알립니다. 그런 다음 콘솔의 직접 링크를 사용하여 서비스별 문제 해결 문서를 열고 병목 현상을 해결할 수 있습니다.
서비스 오류 그룹 보기
Google Cloud 콘솔에서 Error Reporting 페이지로 이동합니다.
**Error Reporting** 으로 이동
검색창을 사용하여 이 페이지를 찾을 수도 있습니다.
Error Reporting은 서비스 오류가 있다고 판단되면 이러한 오류 이벤트를 그룹화하고 오류 유형을 Service error로 설정합니다.
Error Reporting 개요에는 오류 그룹에 대한 기타 정보와 함께 오류 유형이 표시됩니다.
문서화된 솔루션이 있는 서비스 오류 이벤트의 경우 Error Reporting 은 서비스 Google Cloud 의 문제 해결 가이드 링크를 제공합니다.
서비스 오류 이벤트 샘플
다음 표에는 Error Reporting의 서비스 오류 기능이 캡처하는 오류 이벤트의 일부만 나와 있습니다.
| Google Cloud 서비스 이름 | 오류 유형 |
|---|---|
| Dataflow | 작업자 로그 제한 메모리 부족 (시스템) 커스텀 서브넷 누락 단계의 긴 작업 JRE 비정상 종료 잘못 구성된 작업자 JAR 파일 |
| Cloud Run | 메모리 한도 초과 사용 가능한 인스턴스 없음 |
| Google Kubernetes Engine | 비정상 pod, 실패한 프로브 Pod 예약 실패 백오프로 실패한 컨테이너 다시 시작 마운트 해제된 볼륨 컨테이너 이미지를 가져오지 못함 엔드포인트를 업데이트할 수 없음 Secrets/ConfigMaps를 찾을 수 없음 |