Ringkasan opsi deployment

Untuk menjalankan workload kecerdasan buatan (AI), machine learning (ML), atau komputasi berperforma tinggi (HPC), Anda dapat men-deploy instance dan cluster Compute Engine yang dioptimalkan AI yang menggunakan mesin A4X, A4, A3 Ultra, A3 Mega, dan A3 High (8 GPU). Untuk mengetahui informasi selengkapnya tentang fitur mesin ini yang memungkinkan Anda menjalankan cluster AI dan ML berskala besar, lihat Ringkasan pengelolaan cluster.

Anda dapat membuat instance A4X, A4, A3 Ultra, A3 Mega, dan A3 High (8 GPU) langsung dari Compute Engine, atau melalui layanan lain yang berjalan di instance Compute Engine seperti Cluster Toolkit atau Google Kubernetes Engine.

Untuk opsi yang paling sesuai untuk membuat instance atau cluster komputasi untuk kasus penggunaan Anda, pilih salah satu opsi berikut:

Opsi Kasus penggunaan
Cluster Director Anda menginginkan layanan terkelola sepenuhnya yang mengotomatiskan penyiapan dan konfigurasi cluster Slurm Anda. Cluster Director membantu Anda mengonfigurasi resource komputasi, jaringan, dan penyimpanan untuk cluster Anda guna memaksimalkan performa dan meminimalkan waktu non-operasional. Untuk mempelajari lebih lanjut, lihat Membuat cluster Slurm terkelola sepenuhnya untuk workload AI.
Cluster Toolkit

Anda ingin menggunakan software open source yang menyederhanakan proses untuk deployment cluster Slurm dan GKE. Cluster Toolkit is dirancang agar sangat dapat disesuaikan dan diperluas. Anda dapat menggunakan blueprint untuk menyediakan resource jaringan dan penyimpanan. Untuk mempelajari lebih lanjut, lihat hal berikut:

GKE

Anda menginginkan fleksibilitas maksimum dalam mengonfigurasi cluster Google Kubernetes Engine berdasarkan kebutuhan workload Anda. Untuk mempelajari lebih lanjut, lihat hal berikut:

Menggunakan Compute Engine

Anda menginginkan kontrol penuh atas lapisan infrastruktur sehingga dapat menyiapkan orchestrator Anda sendiri. Untuk mempelajari lebih lanjut, lihat hal berikut:

Langkah berikutnya