Gunakan Knative serving untuk mengelola infrastruktur yang diperlukan untuk menghosting software di Google Kubernetes Engine (GKE) secara otomatis. Untuk mengelola aplikasi Anda, Knative serving menggunakan struktur organisasi yang disebut model resource. Model resource ini terdiri dari tiga bagian utama: Layanan, Revisi, dan Instance Container.
Diagram berikut mengilustrasikan komponen-komponen ini dan interaksinya: a Google Cloud project berisi dua layanan Knative serving, Layanan A dan Layanan B, masing-masing dengan beberapa revisi. Layanan A memproses permintaan dengan beberapa instance container yang berjalan, sedangkan Layanan B tidak ada aktivitas.
Layanan Knative serving
Layanan adalah resource utama Knative serving. Setiap layanan berada di namespace cluster GKE tertentu.
Project Google Cloud tertentu dapat menjalankan banyak layanan di berbagai region atau cluster GKE.
Setiap layanan mengekspos endpoint unik dan secara otomatis menskalakan infrastruktur yang mendasarinya untuk menangani permintaan masuk.
Revisi Knative serving
Setiap deployment ke layanan membuat revisi. Revisi terdiri dari image container tertentu, bersama dengan setelan lingkungan seperti variabel lingkungan, batas memori, atau nilai konkurensi.
Revisi tidak dapat diubah: setelah revisi dibuat, revisi tidak dapat dimodifikasi. Misalnya, saat Anda men-deploy image container ke layanan Knative serving yang baru, revisi pertama akan dibuat. Jika kemudian Anda men-deploy image container yang berbeda ke layanan yang sama, revisi kedua akan dibuat. Jika selanjutnya Anda menetapkan variabel lingkungan, revisi ketiga akan dibuat. Setiap perubahan konfigurasi berikutnya akan membuat revisi baru.
Permintaan akan diarahkan secara otomatis sesegera mungkin ke revisi layanan responsif terbaru. Anda dapat memisahkan traffic antar-revisi sesuai kebutuhan.
Instance container Knative serving
Setiap revisi yang menerima permintaan akan disesuaikan secara otomatis dengan jumlah instance container yang diperlukan untuk menangani semua permintaan ini. Perhatikan bahwa instance container dapat menerima banyak permintaan secara bersamaan. Dengan setelan konkurensi, Anda dapat menetapkan permintaan maksimum yang dapat dikirim secara paralel ke instance container tertentu.