Compute 안정성 통계 개요

Compute Reliability Insights는 Compute Engine 워크로드 안정성을 개선하는 기능 모음을 제공합니다. 이 도구는 잠재적 위험에 대한 가시성을 제공하여 세부적인 솔루션과 사전 권장사항을 통해 효과적인 위험 관리를 지원합니다.

이 페이지에서는 Compute Reliability Insights에 대한 개념 정보를 제공합니다. 안정성 권장사항을 보고 적용하는 방법에 대한 자세한 내용은 안정성 권장사항 보고 적용을 참고하세요.

안정성 위험 이해

안정성 위험은 Compute Engine 기능 또는 설정의 잘못된 구성으로 인해 인프라의 안정성과 가용성에 부정적인 영향을 미칠 수 있는 상황입니다. 이러한 상황은 다음과 같은 방식으로 발생할 수 있습니다.

  • 예상치 못한 연쇄 장애: Google 인프라의 한 영역 또는 리전에서 장애가 발생하면 다른 영역 또는 리전의 리소스가 예기치 않게 중단될 수 있습니다.
  • 외부 종속 항목: 리소스가 기본 리소스 위치 외부에 있는 특정 Compute Engine 리전의 가용성에 의존할 수 있습니다.

위험 유형

Compute Reliability Insights는 워크로드에서 잠재적 위험의 하위 집합을 식별합니다.

  • 전역 DNS 는 Compute Engine 프로젝트의 내부 DNS 구성Global DNS로 설정되어 있을 때 발생하는 위험입니다.

위험 심각도 및 우선순위

Compute Reliability Insights는 다음 심각도 및 우선순위 정의를 사용하여 위험의 우선순위를 지정합니다.

심각도 우선순위 설명
높음 P1 리전 장애가 발생할 때 자주 사용되는 서비스를 여러 리전에서 중단하는 잘못된 구성 또는 설정입니다 (예: VM 생성).
매체 P2 리전 장애가 발생할 때 여러 리전에서 덜 중요한 서비스 (예: 인스턴스 템플릿 생성)를 중단하는 잘못된 구성 또는 설정입니다.

원격 분석 및 지연 시간

Compute Reliability Insights는 원격 분석 데이터를 사용하여 위험을 식별합니다. 이 기능을 사용할 때는 다음 동작을 고려하세요.

  • 새 프로젝트 및 비활성 리소스: 지난 7 일 이내에 생성된 프로젝트 또는 비활성 VM이 있는 프로젝트의 경우 파이프라인에 더 많은 원격 분석 데이터가 필요하므로 권장사항을 사용할 수 없을 수 있습니다.
  • 완화 지연: 위험을 완화한 후에도 해결된 권장사항을 삭제하기 위해 수집 파이프라인이 24시간마다 실행되므로 Google Cloud 콘솔 및 API에 최대 24시간 동안 권장사항이 계속 표시될 수 있습니다. 이는 해결된 권장사항을 삭제하기 위해 수집 파이프라인이 24시간마다 실행되기 때문입니다.

다음 단계