Mengamati dan memantau VM

Dokumen ini menjelaskan cara mengakses dan melihat metrik virtual machine (VM). Dokumen ini juga menjelaskan cara meninjau metrik VM untuk mempelajari VM Anda lebih lanjut atau memecahkan masalah tertentu pada VM.

Memantau instance virtual machine (VM) sangat penting untuk mempertahankan resource VM Anda. Compute Engine menawarkan tampilan tingkat tinggi metrik VM Anda menggunakan tab Kemampuan observasi di Google Cloud konsol. Tab ini menyediakan dasbor standar menggunakan data telemetri sehingga Anda dapat memantau VM dan membuat keputusan yang tepat terkait resource Compute Engine Anda. Anda juga dapat menyesuaikan dasbor standar untuk melihat metrik tertentu yang Anda inginkan saja.

Semua VM memiliki data penggunaan proses dasar yang tersedia saat dibuat. Namun, menginstal Agen Operasional memberikan insight yang lebih mendalam tentang perilaku VM.

Untuk mengetahui informasi selengkapnya tentang cara membuat kebijakan pemberitahuan pemantauan, menggunakan Metrics Explorer, atau informasi umum tentang cara kerja pemantauan dan metrik di Google Cloud, lihat dokumen Cloud Monitoring.

Sebelum memulai

Opsional: Instal Agen Operasional untuk mengumpulkan data yang lebih mendetail dari instance Compute Engine Anda.

Untuk memeriksa instance VM mana yang telah menginstal Agen Operasional, lakukan hal berikut:

  1. Di Google Cloud konsol, buka Dasbor Monitoring

    Buka Dasbor Monitoring

  2. Pilih Instance VM dari daftar dasbor.

  3. Klik Daftar untuk melihat VM sebagai daftar.

    Semua VM di project Anda akan ditampilkan. Kolom Agen menampilkan status penginstalan Agen Operasional. Anda dapat menginstal atau mengupdate agen dari halaman ini.

  4. Opsional: Untuk mengupdate dasbor Standar agar menampilkan peristiwa, seperti peristiwa yang menunjukkan update ke grup instance terkelola, klik Pilih Peristiwa, lalu selesaikan dialog.

    Untuk mengetahui informasi selengkapnya tentang peristiwa, lihat Jenis peristiwa.

Mengakses metrik kemampuan observasi VM

Akses informasi untuk satu atau beberapa VM menggunakan tab Kemampuan observasi di Google Cloud konsol. Secara default, dasbor standar menampilkan metrik VM. Jika hanya ingin melihat metrik tertentu yang Anda inginkan, Anda dapat membuat dasbor yang disesuaikan.

Melihat metrik kemampuan observasi untuk satu VM

Metrik VM dasar seperti penggunaan CPU dan traffic jaringan tersedia untuk Anda saat membuat VM. Metrik untuk penggunaan memori dan proses hanya tersedia dengan penginstalan Agen Operasional, yang merupakan agen utama untuk mengumpulkan telemetri dari instance Compute Engine Anda.

Untuk melihat metrik satu VM, lakukan hal berikut:

  1. Di Google Cloud konsol, buka halaman VM instances.

    Buka instance VM

  2. Pilih VM untuk membuka halaman Detail.

  3. Klik tab Kemampuan observasi untuk menampilkan informasi tentang VM.

  4. Opsional: Reset jangka waktu default satu jam ke jangka waktu yang ingin Anda pantau.

  5. Opsional: Untuk mengupdate dasbor Standar agar menampilkan peristiwa, seperti peristiwa yang menunjukkan update ke grup instance terkelola, klik Pilih Peristiwa, lalu selesaikan dialog.

    Untuk mengetahui informasi selengkapnya tentang peristiwa, lihat Jenis peristiwa.

Informasi di Gambar 1 menampilkan detail VM tanpa Agen Operasional yang diinstal di VM. Perhatikan bahwa grafik Penggunaan Memori dan Kapasitas Disk tidak memiliki data.

Tab Observability
 untuk satu VM tanpa Agen Operasional terinstal.
Gambar 1: Tab Kemampuan observasi untuk satu VM tanpa Agen Operasional yang diinstal.

Melihat metrik kemampuan observasi untuk beberapa VM

Kemampuan observasi di tingkat fleet menampilkan metrik untuk lima VM teratas dengan penggunaan proses tertinggi. Lima VM teratas yang tercantum bervariasi menurut metrik. Anda mungkin tidak melihat lima VM yang sama untuk setiap proses. Meskipun ada lebih banyak data yang tersedia di tingkat fleet tanpa menginstal Agen Operasional dibandingkan dengan jumlah data yang tersedia untuk satu VM, menginstal agen akan memberikan lebih banyak data untuk tujuan pemecahan masalah di masa mendatang.

Untuk melihat metrik beberapa VM, lakukan hal berikut:

  1. Di Google Cloud konsol, buka halaman VM instances.

    Buka instance VM

  2. Klik tab Kemampuan observasi.

  3. Opsional: Reset jangka waktu default satu jam ke jangka waktu yang ingin Anda pantau.

  4. Filter hasil menurut satu atau beberapa opsi berikut:

    • ID
    • Nama
    • Machine type
    • Zone
    • Region
    • Instance group
    • Label
    • Negara Bagian

Informasi pada Gambar 2 menampilkan contoh tab Kemampuan observasi saat beberapa VM dalam suatu project telah menginstal Agen Operasional. Perhatikan bahwa ada lebih banyak metrik yang tersedia tentang VM ini.

Beberapa instance VM dengan Agen Operasional terinstal.
Gambar 2: Beberapa instance VM dengan Agen Operasional yang diinstal.

Melihat metrik mendetail untuk VM

Setiap metrik proses VM diwakili oleh garis grafik pada diagram. Dalam contoh berikut, VM uptime-demo telah menginstal Agen Operasional. Data penggunaan memori tersedia untuk tujuan pemecahan masalah. Jika VM tidak tercantum di kartu, filter menurut nama VM untuk menemukan VM tertentu.

Untuk mengambil informasi tentang VM ini atau VM lainnya dari lima VM teratas dari tab Kemampuan observasi, lakukan langkah berikut:

  1. Arahkan kursor ke garis grafik VM mana pun. Kartu akan muncul dengan daftar lima VM teratas yang menggunakan proses ini, masing-masing menampilkan metrik.
  2. Untuk mempelajari perilaku VM lebih lanjut, klik garis grafik VM atau nama VM tertentu dalam daftar.

VM uptime-demo yang ditampilkan di kartu pada Gambar 3 mengungkapkan beberapa metrik yang mungkin memerlukan peninjauan.

Garis grafik
 merepresentasikan VM. Klik untuk mempelajari informasi selengkapnya tentang VM tertentu.
Gambar 3: Garis grafik mewakili VM. Klik untuk mempelajari VM tertentu lebih lanjut.

Klik VM uptime-demo untuk membuka halaman Detail VM yang ditampilkan di Gambar 4, yang memberikan informasi berikut:

  • Status Agen Operasional.
  • Opsi dalam konteks untuk membuat Peringatan, memeriksa Peristiwa, atau membuat Pemeriksaan Waktu Aktif.
  • Opsi untuk melihat detail konfigurasi, metrik, dan log VM.
Halaman Detail VM memberikan informasi tentang VM tertentu.
Gambar 4: Halaman Detail VM memberikan informasi tentang VM tertentu.

Membuat dasbor yang disesuaikan untuk melihat metrik tertentu

Secara default, tab Kemampuan observasi di Compute Engine menyediakan dasbor standar yang menampilkan metrik VM dasar. Untuk melihat metrik tertentu yang ingin Anda lihat saja, Anda dapat mengubah dasbor standar dan menyimpannya sebagai dasbor yang disesuaikan. Anda dapat menyesuaikan dasbor lebih lanjut sesuai keinginan.

Untuk membuat dasbor yang disesuaikan, lakukan hal berikut:

  1. Di Google Cloud konsol, buka halaman VM instances.

    Buka instance VM

  2. Buka tab Kemampuan observasi sebagai berikut:

    • Untuk satu VM: Di halaman VM instances, klik nama VM untuk membuka halaman Details, lalu klik tab Observability untuk VM tersebut.
    • Untuk beberapa VM: Di halaman VM instances, klik tab Observability.
  3. Jika drop-down Dashboard diaktifkan, dasbor yang disesuaikan akan tersedia. Untuk mengubah tampilan kustom, pilih tampilan kustom dari drop-down, lalu, di toolbar dasbor, klik .

  4. Jika tidak, untuk menyesuaikan dasbor standar, di toolbar dasbor, klik .

    Compute Engine membuat salinan dasbor standar, lalu membuka salinan dalam mode edit.

  5. Di editor, Anda dapat menambahkan, mengubah, menghapus, memposisikan ulang, atau mengubah ukuran visualisasi di dasbor. Visualisasi secara kolektif disebut widget. Untuk mengetahui informasi selengkapnya tentang berbagai jenis widget, lihat Ringkasan dasbor.

    • Untuk menambahkan widget, di toolbar dasbor, klik Add widget dan selesaikan konfigurasi.

      Misalnya, untuk melihat log dengan data metrik Anda, klik Add widget, pilih Logs, lalu klik Apply.

    • Untuk mengubah widget, tempatkan kursor pada widget untuk mengaktifkan toolbar, klik Edit widget, lalu gunakan dialog Configure widget. Untuk menerapkan perubahan pada dasbor, di toolbar, klik Apply. Untuk menghapus perubahan, klik Cancel.

    • Untuk menghapus widget, tempatkan kursor pada widget untuk mengaktifkan toolbar, klik Opsi bagan lainnya, lalu pilih Hapus.

    • Untuk memposisikan ulang widget, gunakan kursor untuk menarik widget berdasarkan header-nya ke lokasi baru.

    • Untuk mengubah ukuran widget, gunakan kursor untuk memposisikan ulang sudut kanan widget.

  6. Setelah selesai mengubah dasbor, klik Save.

  7. Dalam dialog yang mengonfirmasi perubahan, klik View customized dashboard untuk membuka tampilan yang disesuaikan.

    Anda dapat beralih kembali ke tampilan standar dengan memilih Predefined dari drop-down Dashboard.

Meninjau metrik resource

Untuk mempelajari lebih lanjut setiap metrik resource, klik setiap proses dalam menu tab Kemampuan observasi:

  • Pelajari penggunaan CPU, Proses, Memori, Akselerator, traffic Jaringan, dan Disk.

  • Lihat data log dengan menelusuri Log untuk mengidentifikasi dan melihat Peristiwa Sistem.

  • Tambahkan Integrasi pihak ketiga dan periksa integrasi yang sudah Dikonfigurasi.

Bagian selanjutnya dari artikel ini menjelaskan contoh bagaimana beberapa proses dapat memengaruhi workload Anda. Informasi ini mengasumsikan bahwa Agen Operasional diinstal di VM Anda.

Pemakaian CPU

Contoh penggunaan CPU ekstrem mungkin terjadi saat server mengalami beban yang sangat berat dan tidak terduga, seperti saat situs mengalami lonjakan traffic yang tiba-tiba atau saat tugas pemrosesan data skala besar sedang berlangsung. Dalam situasi seperti itu, CPU mungkin berjalan dengan kapasitas 100% dalam jangka waktu yang lama, yang dapat menyebabkan server melambat atau menjadi tidak responsif.

Dalam contoh ini, saturasi adalah masalahnya. Jika pemakaian CPU Anda mencapai 100%, mungkin hal tersebut tidak masalah untuk workload Anda. Namun, sebaiknya periksa metrik lain untuk mengetahui apakah hal ini memerlukan intervensi atau tidak. Dalam hal ini, sebaiknya buat kebijakan pemberitahuan agar Anda diberi tahu saat penggunaan CPU VM melonjak.

Dengan izin yang tepat, Anda dapat terhubung menggunakan SSH ke VM untuk menyelidiki masalah ini. Namun, jika Agen Operasional diinstal, Anda dapat melihat lebih banyak data historis untuk membantu memecahkan masalah.

Penggunaan proses

Contoh perilaku proses ekstrem mungkin terjadi saat proses menggunakan resource yang berlebihan seperti CPU, memori, atau I/O disk, hingga menyebabkan penurunan performa atau bahkan VM mengalami error.

Misalnya, jika proses yang berjalan di VM mengalami kebocoran memori, proses tersebut mungkin mulai menggunakan memori dalam jumlah yang semakin besar dari waktu ke waktu, yang pada akhirnya menyebabkan VM kehabisan memori dan mengalami error. Demikian pula, jika proses menggunakan disk secara berlebihan, hal ini dapat menyebabkan I/O disk VM menjadi jenuh, sehingga menyebabkan waktu respons yang lambat untuk proses lainnya.

Pemakaian memori

Database memerlukan memori yang besar untuk melakukan operasi seperti pengindeksan, pengurutan, dan penggabungan tabel.

Contoh penggunaan memori yang tinggi pada VM adalah saat Anda menjalankan server database, seperti Cloud SQL untuk MySQL atau Cloud SQL untuk PostgreSQL, dengan set data yang besar. Jika memori VM yang tersedia terlalu kecil, memuat ulang set data ke dalam memori dapat menyebabkan database berjalan lambat atau mengalami error.

Akselerator

Jika VM Anda memiliki akselerator (GPU atau TPU) yang terpasang, tab Kemampuan observasi akan menyertakan bagian Akselerator yang menampilkan metrik yang relevan dengan jenis akselerator Anda. Dasbor untuk akselerator dapat menampilkan detail seperti performa akselerator, penggunaan, dan pelacakan memori.

Untuk mengetahui informasi tentang metrik GPU, lihat dokumen berikut:

Untuk mengetahui informasi tentang metrik TPU, lihat Memantau TPU di dokumentasi Cloud TPU.

Performa jaringan

Masalah performa jaringan adalah hasil dari berbagai faktor: kemacetan, batasan bandwidth, masalah hardware atau software, dan latensi. Untuk mendiagnosis masalah ini, pantau metrik performa jaringan Anda, pecahkan masalah hardware dan software, serta analisis pola traffic jaringan untuk mengidentifikasi dan menyelesaikan penyebab utama masalah.

Pemanfaatan disk

Penggunaan disk yang tinggi pada VM terjadi saat ada banyak data yang dibaca ke atau ditulis dari disk virtual yang mengakibatkan penundaan akses disk dan kemungkinan efek pada performa VM.

Memantau metrik penggunaan disk seperti operasi I/O disk per detik (IOPS), panjang antrean disk, dan waktu respons disk rata-rata dapat membantu mengidentifikasi dan mendiagnosis masalah penggunaan disk yang tinggi pada VM.

Memeriksa log dan peristiwa sistem

Halaman Semua Log menyediakan data log tentang resource Anda. Urutkan menurut tingkat keparahan untuk mengidentifikasi masalah dan memeriksa payload.

Log audit mencatat peristiwa administratif yang terjadi di resource Anda. Log dapat memberi tahu Anda apa yang terjadi untuk memicu peristiwa tersebut. Beberapa log dicatat dan dipertahankan dalam baris yang sama, sehingga misalnya, jika Anda memiliki 20 log yang identik, informasi tersebut akan disimpan dalam satu baris, bukan 20 baris terpisah.

Anda dapat menganggap Peristiwa Sistem sebagai istilah umum untuk peristiwa yang terjadi di tingkat yang lebih tinggi, tetapi mungkin memengaruhi resource Compute Engine Anda. Peristiwa sistem terjadi saat error yang tidak terkait dengan peristiwa yang direncanakan diaktifkan. Peristiwa sistem dicatat di tingkat fleet.

Menggunakan integrasi pihak ketiga

Monitoring menyediakan integrasi dengan aplikasi pihak ketiga. Integrasi ini memungkinkan Anda mengumpulkan telemetri dari aplikasi seperti Apache Web Server, Cloud SQL untuk MySQL, Memorystore untuk Redis, dan lainnya untuk deployment yang berjalan di Compute Engine dan GKE. Saat Anda menggunakan Compute Engine, telemetri pihak ketiga dikumpulkan oleh Agen Operasional.

Langkah berikutnya