Ringkasan Compute Reliability Insights

Compute Reliability Insights menawarkan serangkaian fitur untuk meningkatkan keandalan workload Compute Engine Anda. Alat ini memberikan visibilitas ke dalam potensi risiko, sehingga memungkinkan pengelolaan risiko yang efektif melalui solusi mendetail dan rekomendasi proaktif.

Halaman ini memberikan informasi konseptual tentang Compute Reliability Insights. Untuk mengetahui informasi selengkapnya tentang cara melihat dan menerapkan rekomendasi keandalan, lihat Melihat dan menerapkan rekomendasi keandalan.

Memahami risiko keandalan

Risiko keandalan adalah situasi ketika kesalahan konfigurasi fitur atau setelan Compute Engine dapat memengaruhi stabilitas dan ketersediaan infrastruktur Anda secara negatif. Hal ini dapat terjadi dengan cara berikut:

  • Kegagalan beruntun yang tidak terduga: Pemadaman layanan di satu zona atau region infrastruktur Google dapat mengganggu resource Anda di zona atau region lain secara tidak terduga.
  • Dependensi eksternal: Resource Anda mungkin bergantung pada ketersediaan region Compute Engine tertentu yang berada di luar lokasi resource utama Anda.

Jenis risiko

Insight Keandalan Komputasi mengidentifikasi subkumpulan potensi risiko dalam workload Anda:

Tingkat keparahan dan prioritas risiko

Compute Reliability Insights memprioritaskan risiko Anda menggunakan definisi tingkat keparahan dan prioritas berikut.

Keparahan Prioritas Deskripsi
Tinggi P1 Kesalahan konfigurasi atau setelan yang, saat terjadi pemadaman layanan regional, mengganggu layanan yang sering digunakan di beberapa region (misalnya, pembuatan VM).
Sedang P2 Konfigurasi atau setelan yang salah, yang saat terjadi pemadaman layanan regional, mengganggu layanan yang kurang penting di beberapa region (misalnya, pembuatan template instance).

Telemetri dan latensi

Insight Keandalan Compute mengandalkan data telemetri untuk mengidentifikasi risiko. Pertimbangkan perilaku berikut saat menggunakan fitur ini:

  • Project baru dan resource tidak aktif: Untuk project yang dibuat dalam 7 hari terakhir atau project dengan VM yang tidak aktif, rekomendasi mungkin tidak tersedia karena pipeline memerlukan lebih banyak data telemetri.
  • Penundaan mitigasi: Setelah Anda memitigasi risiko, konsol Google Cloud dan API mungkin terus menampilkan rekomendasi hingga 24 jam. Hal ini karena pipeline penyerapan berjalan setiap 24 jam untuk menghapus rekomendasi yang telah diselesaikan.

Langkah berikutnya