Dokumen ini menjelaskan langkah-langkah untuk membuat instance virtual machine (VM) mandiri yang menggunakan jenis mesin A4X. Untuk mempelajari lebih lanjut jenis mesin ini, lihat A4X.
Untuk mempelajari cara lain dalam membuat VM atau cluster, lihat Ringkasan opsi deployment.
Batasan
Saat Anda membuat VM A4X mandiri, batasan berikut berlaku:
- Anda tidak menerima diskon untuk penggunaan berkelanjutan atau diskon abonemen fleksibel untuk instance yang menggunakan jenis mesin ini.
- Anda hanya dapat membuat instance di region dan zona tertentu.
- Anda tidak dapat menggunakan Persistent Disk (regional atau zonal). Anda hanya dapat menggunakan Google Cloud Hyperdisk.
- Jenis mesin ini hanya tersedia di platform NVIDIA Grace.
- Perubahan jenis mesin tidak didukung untuk A4X. Untuk beralih ke atau dari jenis mesin ini, Anda harus membuat instance baru.
- Anda tidak dapat menjalankan sistem operasi Windows pada jenis mesin ini. Untuk mengetahui daftar sistem operasi Linux yang didukung, tinjau sistem operasi yang didukung untuk instance GPU.
- Untuk instance A4X, saat Anda menggunakan
ethtool -Suntuk memantau jaringan GPU, penghitung port fisik yang berakhiran_phytidak diperbarui. Hal ini adalah perilaku yang diharapkan untuk instance yang menggunakan arsitektur Fungsi Virtual (VF) MRDMA. Untuk mengetahui informasi selengkapnya, lihat Fungsi MRDMA dan alat pemantauan jaringan. - Instance A4X tidak mendukung hal berikut:
- Anda tidak dapat melampirkan disk Hyperdisk ML yang dibuat sebelum 4 Februari 2026 ke jenis mesin A4X.
Sebelum memulai
Sebelum membuat VM, jika Anda belum melakukannya, selesaikan langkah-langkah berikut:
- Pilih opsi pemakaian: pilihan opsi pemakaian menentukan cara Anda mendapatkan dan menggunakan resource GPU. Untuk mempelajari lebih lanjut, lihat Memilih opsi pemakaian.
- Mendapatkan kapasitas: proses untuk mendapatkan kapasitas berbeda untuk setiap opsi penggunaan. Untuk mempelajari proses mendapatkan kapasitas untuk opsi pemakaian yang Anda pilih, lihat Ringkasan kapasitas.
Pilih tab untuk melihat bagaimana Anda berencana menggunakan contoh di halaman ini:
Konsol
Saat menggunakan konsol Google Cloud untuk mengakses layanan Google Cloud dan API, Anda tidak perlu menyiapkan autentikasi.
gcloud
Di konsol Google Cloud , aktifkan Cloud Shell.
Di bagian bawah konsol Google Cloud , sesi Cloud Shell akan dimulai dan menampilkan perintah command line. Cloud Shell adalah lingkungan shell dengan Google Cloud CLI yang sudah terinstal, dan dengan nilai yang sudah ditetapkan untuk project Anda saat ini. Diperlukan waktu beberapa detik untuk melakukan inisialisasi pada sesi.
REST
Untuk menggunakan contoh REST API di halaman ini dalam lingkungan pengembangan lokal, gunakan kredensial yang Anda berikan ke gcloud CLI.
Instal Google Cloud CLI.
Jika Anda menggunakan penyedia identitas (IdP) eksternal, Anda harus login ke gcloud CLI dengan identitas gabungan Anda terlebih dahulu.
Untuk mengetahui informasi selengkapnya, lihat Melakukan autentikasi untuk menggunakan REST dalam dokumentasi autentikasi Google Cloud .
Peran yang diperlukan
Untuk mendapatkan izin yang Anda perlukan untuk membuat VM, minta administrator untuk memberi Anda peran IAM Compute Instance Admin (v1) (roles/compute.instanceAdmin.v1) di project.
Untuk mengetahui informasi selengkapnya tentang cara memberikan peran, lihat Mengelola akses ke project, folder, dan organisasi.
Peran bawaan ini berisi izin yang diperlukan untuk membuat VM. Untuk melihat izin yang benar-benar diperlukan, perluas bagian Izin yang diperlukan:
Izin yang diperlukan
Izin berikut diperlukan untuk membuat VM:
-
compute.instances.createdi project -
Untuk menggunakan image kustom guna membuat VM:
compute.images.useReadOnlypada image -
Untuk menggunakan snapshot guna membuat VM:
compute.snapshots.useReadOnlypada snapshot -
Untuk menggunakan template instance guna membuat VM:
compute.instanceTemplates.useReadOnlypada template instance -
Untuk menentukan subnet bagi VM Anda:
compute.subnetworks.usedi project atau di subnet yang dipilih -
Untuk menentukan alamat IP statis untuk VM:
compute.addresses.usepada project -
Untuk menetapkan alamat IP eksternal ke VM saat menggunakan jaringan VPC:
compute.subnetworks.useExternalIpdi project atau di subnet yang dipilih -
Untuk menetapkan jaringan lama ke VM:
compute.networks.usepada project -
Untuk menetapkan alamat IP eksternal ke VM saat menggunakan jaringan lama:
compute.networks.useExternalIpdi project -
Untuk menetapkan metadata instance VM bagi VM:
compute.instances.setMetadatadi project -
Untuk menyetel tag untuk VM:
compute.instances.setTagsdi VM -
Untuk menetapkan label bagi VM:
compute.instances.setLabelsdi VM -
Untuk menetapkan akun layanan yang akan digunakan VM:
compute.instances.setServiceAccountdi VM -
Untuk membuat disk baru untuk VM:
compute.disks.createpada project -
Untuk memasang disk yang ada dalam mode hanya baca atau baca-tulis:
compute.disks.usepada disk -
Untuk memasang disk yang ada dalam mode hanya baca:
compute.disks.useReadOnlypada disk
Anda mungkin juga bisa mendapatkan izin ini dengan peran khusus atau peran bawaan lainnya.
Dasar-dasar A4X
Cluster A4X disusun dalam hierarki blok dan sub-blok untuk memfasilitasi performa jaringan non-blocking skala besar. Memahami topologi ini sangat penting saat memesan kapasitas dan men-deploy workload.
- Instance A4X
- Instance A4X adalah jenis mesin A4X tunggal yang memiliki 4 GPU yang terpasang.
- Sub-blok
- Sub-blok adalah unit dasar kapasitas A4X. Untuk A4X, sub-blok terdiri dari 18 instance A4X (72 GPU); instance ini membentuk domain NVLink dan terhubung menggunakan sistem NVLink multi-node. Anda membuat sub-blok A4X dengan menerapkan
kebijakan penempatan rapat yang menentukan topologi
1x72. - Blokir
- Blok A4X terdiri dari 25 sub-blok (domain NVLink), dengan total hingga 450 instance A4X (1.800 GPU). Sub-blok disejajarkan dengan rel untuk penskalaan yang efisien. Setiap sub-blok memerlukan kebijakan penempatan rapat. Oleh karena itu, untuk satu blok A4X, Anda dapat membuat 25 kebijakan penempatan rapat.
Tabel berikut menunjukkan opsi topologi yang didukung untuk instance A4X:
Topologi (gpuTopology) |
Jumlah GPU | Jumlah instance |
|---|---|---|
1x72 |
72 | 18 |
Ringkasan
Membuat instance dengan jenis mesin A4X mencakup langkah-langkah berikut:
- Membuat jaringan VPC
- Membuat kebijakan penempatan rapat
- Membuat instance
- Menginstal driver GPU
- Opsional: Aktifkan mode GPU Multi-Instance NVIDIA
Membuat jaringan VPC
Untuk menyiapkan jaringan bagi jenis mesin A4X, buat tiga jaringan VPC untuk antarmuka jaringan berikut:
- 2 jaringan VPC reguler untuk antarmuka jaringan (NIC) gVNIC . NIC kemudian menggunakan jaringan VPC ini untuk komunikasi host-ke-host.
- 1 jaringan VPC dengan profil jaringan RoCE untuk NIC CX-7 saat membuat beberapa subblok A4X. Jaringan VPC RoCE untuk instance VM harus memiliki 4 subnet, satu subnet untuk setiap NIC CX-7. NIC ini menggunakan RDMA over Converged Ethernet (RoCE), yang menyediakan komunikasi berbandwidth tinggi dan berlatensi rendah yang penting untuk menskalakan beberapa subblok A4X.
Untuk mengetahui informasi selengkapnya tentang pengaturan NIC, lihat Meninjau bandwidth jaringan dan pengaturan NIC.
Buat jaringan secara manual dengan mengikuti panduan petunjuk atau secara otomatis menggunakan skrip yang disediakan.
Panduan petunjuk
Untuk membuat jaringan, Anda dapat menggunakan petunjuk berikut:
- Untuk membuat jaringan VPC reguler untuk antarmuka jaringan gVNIC, lihat Membuat dan mengelola jaringan Virtual Private Cloud.
- Untuk membuat jaringan VPC RoCE untuk instance VM (
roce), lihat Membuat jaringan Virtual Private Cloud untuk NIC RDMA.
Untuk jaringan VPC ini, tetapkan
unit transmisi maksimum (MTU) ke nilai yang lebih besar.
Untuk jenis mesin A4X, MTU yang direkomendasikan adalah
8896 byte.
Untuk meninjau setelan MTU yang direkomendasikan untuk jenis mesin GPU lainnya, lihat
Setelan MTU untuk jenis mesin GPU.
Skrip
Untuk membuat jaringan, ikuti langkah-langkah berikut.
Untuk jaringan VPC ini, tetapkan
unit transmisi maksimum (MTU) ke nilai yang lebih besar.
Untuk jenis mesin A4X, MTU yang direkomendasikan adalah
8896 byte.
Untuk meninjau setelan MTU yang direkomendasikan untuk jenis mesin GPU lainnya, lihat
Setelan MTU untuk jenis mesin GPU.
-
Gunakan skrip berikut untuk membuat jaringan VPC reguler untuk gVNIC.
#!/bin/bash # Create regular VPC networks and subnets for the gVNICs for N in $(seq 0 1); do gcloud compute networks create GVNIC_NAME_PREFIX-net-$N \ --subnet-mode=custom \ --mtu=8896 gcloud compute networks subnets create GVNIC_NAME_PREFIX-sub-$N \ --network=GVNIC_NAME_PREFIX-net-$N \ --region=REGION \ --range=192.168.$N.0/24 gcloud compute firewall-rules create GVNIC_NAME_PREFIX-internal-$N \ --network=GVNIC_NAME_PREFIX-net-$N \ --action=ALLOW \ --rules=tcp:0-65535,udp:0-65535,icmp \ --source-ranges=192.168.0.0/16 done # Create SSH firewall rules gcloud compute firewall-rules create GVNIC_NAME_PREFIX-ssh \ --network=GVNIC_NAME_PREFIX-net-0 \ --action=ALLOW \ --rules=tcp:22 \ --source-ranges=IP_RANGE # Assumes that an external IP is only created for vNIC 0 gcloud compute firewall-rules create GVNIC_NAME_PREFIX-allow-ping-net-0 \ --network=GVNIC_NAME_PREFIX-net-0 \ --action=ALLOW \ --rules=icmp \ --source-ranges=IP_RANGE Jika Anda memerlukan beberapa subblok A4X, gunakan skrip berikut untuk membuat jaringan VPC RoCE untuk instance VM (
roce) dan subnet untuk empat NIC CX-7 di setiap instance A4X.#!/bin/bash # List and make sure network profiles exist in the machine type's zone gcloud compute network-profiles list --filter "location.name=ZONE" # Create network for RDMA NICs gcloud compute networks create RDMA_NAME_PREFIX-mrdma \ --network-profile=ZONE-vpc-roce \ --subnet-mode custom \ --mtu=8896 # Create subnets for N in $(seq 0 3); do gcloud compute networks subnets create RDMA_NAME_PREFIX-mrdma-sub-$N \ --network=RDMA_NAME_PREFIX-mrdma \ --region=REGION \ --range=192.168.$((N+2)).0/24 # offset to avoid overlap with gVNICs doneGVNIC_NAME_PREFIX: awalan nama kustom yang akan digunakan untuk jaringan dan subnet VPC reguler untuk gVNIC.-
RDMA_NAME_PREFIX: awalan nama kustom yang akan digunakan untuk jaringan VPC RoCE untuk instance VM (roce) dan subnet untuk NIC CX-7. ZONE: tentukan zona tempat jenis mesin yang ingin Anda gunakan tersedia, sepertius-central1-a. Untuk mengetahui informasi tentang region, lihat Ketersediaan GPU menurut region dan zona.REGION: region tempat Anda ingin membuat subnet. Region ini harus sesuai dengan zona yang ditentukan. Misalnya, jika zona Anda adalahus-central1-a, maka region Anda adalahus-central1.IP_RANGE: rentang IP yang akan digunakan untuk aturan firewall SSH.- Opsional: Untuk memverifikasi bahwa resource jaringan VPC berhasil dibuat, periksa setelan jaringan di konsol Google Cloud :
- Di konsol Google Cloud , buka halaman VPC networks.
- Telusuri daftar untuk menemukan jaringan yang Anda buat di langkah sebelumnya.
- Untuk melihat subnet, aturan firewall, dan setelan jaringan lainnya, klik nama jaringan.
Ganti kode berikut:
Membuat kebijakan penempatan rapat.
Untuk membuat kebijakan penempatan rapat, pilih salah satu opsi berikut:gcloud
Untuk membuat kebijakan penempatan rapat, gunakan
perintah gcloud beta compute resource-policies create group-placement:
gcloud beta compute resource-policies create group-placement POLICY_NAME \
--collocation=collocated \
--gpu-topology=1x72 \
--region=REGION
Ganti kode berikut:
POLICY_NAME: nama kebijakan penempatan rapat.REGION: region tempat Anda ingin membuat kebijakan penempatan rapat. Tentukan region yang berisi zona tempat Anda berencana membuat instance, dan pastikan jenis mesin yang ingin Anda gunakan tersedia di region tersebut. Untuk informasi tentang region, lihat Ketersediaan GPU menurut region dan zona.
REST
Untuk membuat kebijakan penempatan ringkas, buat permintaan POST ke
metode beta
resourcePolicies.insert.
POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
{
"name": "POLICY_NAME",
"groupPlacementPolicy": {
"collocation": "COLLOCATED",
"gpuTopology": "1x72"
}
}
Ganti kode berikut:
PROJECT_ID: project ID Anda.POLICY_NAME: nama kebijakan penempatan rapat.REGION: region tempat Anda ingin membuat kebijakan penempatan rapat. Tentukan region yang berisi zona tempat Anda berencana membuat instance, dan pastikan jenis mesin yang ingin Anda gunakan tersedia di region tersebut. Untuk informasi tentang region, lihat Ketersediaan GPU menurut region dan zona.
Membuat instance A4X
Pilih opsi pembuatan yang sesuai dengan arsitektur workload Anda:
- Membuat instance di domain NVLink 72 GPU (topologi 1x72): Paling cocok untuk pelatihan terdistribusi skala besar, penyesuaian, dan workload inferensi multi-node yang memerlukan komunikasi GPU ber-bandwidth tinggi dan latensi rendah di hingga 18 instance (72 GPU) melalui fabric NVLink multi-node. Anda harus menggunakan kebijakan penempatan rapat.
- Buat instance 4 GPU mandiri (NVL4): Paling cocok untuk workload satu node, inferensi model yang lebih kecil, pemrosesan batch, dan pengembangan interaktif yang sesuai dengan empat GPU dan hanya memerlukan peering NVLink intra-node. Anda harus menargetkan sub-blok pemesanan tertentu untuk memartisi sub-blok tersebut menjadi instance mandiri. Anda tidak memerlukan kebijakan penempatan rapat.
Membuat instance dalam domain NVLink 72 GPU (topologi 1x72)
Untuk mendapatkan topologi GPU 1x72, buat 18 instance A4X. Saat membuat instance, terapkan kebijakan penempatan rapat yang menentukan kolom gpuTopology. Penerapan kebijakan ini memastikan bahwa Compute Engine membuat semua 18 instance A4X dalam satu sub-blok untuk menggunakan domain NVLink.
Jika sub-blok tidak memiliki kapasitas untuk instance A4X, permintaan untuk membuat
instance akan gagal.
Untuk membuat instance A4X yang terhubung dengan 18 instance dalam domain NVLink, terapkan kebijakan penempatan ringkas dan konfigurasi jaringan RDMA multi-NIC.
Untuk membuat instance A4X, pilih salah satu opsi berikut.
Perintah berikut juga menetapkan cakupan akses untuk instance Anda. Untuk menyederhanakan pengelolaan izin, Google merekomendasikan agar Anda menetapkan cakupan akses pada instance ke aksescloud-platform, lalu menggunakan peran IAM untuk menentukan layanan yang dapat diakses instance. Untuk mengetahui informasi selengkapnya, lihat
Praktik terbaik cakupan.
gcloud
Untuk membuat instance A4X, gunakan perintah
gcloud compute instances create.
Instance A4X mendukung jenis reservasi berikut:
- Pemesanan untuk masa mendatang di AI Hypercomputer
- Pemesanan untuk masa mendatang dalam mode kalender
Untuk menggunakan jenis reservasi ini, instance harus menggunakan model penyediaan terikat reservasi. Misalnya, gunakan parameter pembuatan berikut.
gcloud compute instances create INSTANCE_NAME \
--machine-type=a4x-highgpu-4g \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-0,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-1,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-2,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-3,no-address \
--reservation-affinity=specific \
--reservation=RESERVATION \
--provisioning-model=RESERVATION_BOUND \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--restart-on-failure \
--resource-policies=POLICY_NAME
Ganti kode berikut:
INSTANCE_NAME: nama instance A4X.IMAGE_FAMILY: kelompok image dari image OS yang ingin Anda gunakan. Untuk daftar semua sistem operasi yang didukung, lihat Sistem operasi yang didukung.IMAGE_PROJECT: project ID image OS.ZONE: zona tempat jenis mesin yang ingin Anda gunakan tersedia. Anda harus menggunakan zona di region yang sama dengan kebijakan penempatan rapat. Untuk mengetahui informasi tentang region, lihat Ketersediaan GPU menurut region dan zona.DISK_SIZE: ukuran boot disk dalam GB. Untuk mengetahui informasi selengkapnya, lihat Batas ukuran Google Cloud Hyperdisk atau Batas ukuran Persistent Disk berdasarkan jenis disk.GVNIC_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC standar yang menggunakan gVNIC.RDMA_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC yang menggunakan NIC RDMA.-
RESERVATION: nama pemesanan, blok, atau subblok dalam pemesanan. Untuk mendapatkan nama reservasi atau blok yang tersedia, lihat Melihat kapasitas yang dipesan. Berdasarkan persyaratan penempatan instance, pilih salah satu opsi berikut:- Untuk membuat instance A4X di satu blok:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME - Untuk membuat instance A4X pada blok tertentu:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME - Untuk membuat instance A4X di subblok tertentu:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME/reservationSubBlocks/RESERVATION_SUBBLOCK_NAME
- Untuk membuat instance A4X di satu blok:
TERMINATION_ACTION: apakah Compute Engine menghentikan (STOP) atau menghapus (DELETE) instance A4X di akhir periode reservasi.POLICY_NAME: nama kebijakan penempatan rapat.
REST
Untuk membuat instance A4X, buat permintaan POST ke
metode instances.insert.
Instance A4X mendukung jenis reservasi berikut:
- Pemesanan untuk masa mendatang di AI Hypercomputer
- Pemesanan untuk masa mendatang dalam mode kalender
Untuk menggunakan jenis reservasi ini, instance harus menggunakan model penyediaan terikat reservasi. Misalnya, gunakan parameter pembuatan berikut.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
"machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/a4x-highgpu-4g",
"name": "INSTANCE_NAME",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "hyperdisk-balanced",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"networkInterfaces": [
{
"accessConfigs": [
{
"name": "external-nat",
"type": "ONE_TO_ONE_NAT"
}
],
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-2"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-3"
}
],
"reservationAffinity": {
"consumeReservationType": "SPECIFIC_RESERVATION",
"key": "compute.googleapis.com/reservation-name",
"values": [
"RESERVATION"
]
},
"scheduling": {
"provisioningModel": "RESERVATION_BOUND",
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
"automaticRestart": true
},
"resourcePolicies": [
"projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
]
}
Ganti kode berikut:
PROJECT_ID: project ID dari project tempat Anda ingin membuat instance A4X.ZONE: zona tempat jenis mesin yang ingin Anda gunakan tersedia. Anda harus menggunakan zona di region yang sama dengan kebijakan penempatan rapat. Untuk mengetahui informasi tentang region, lihat Ketersediaan GPU menurut region dan zona.INSTANCE_NAME: nama instance A4X.DISK_SIZE: ukuran boot disk dalam GB. Untuk mengetahui informasi selengkapnya, lihat Batas ukuran Google Cloud Hyperdisk atau Batas ukuran Persistent Disk berdasarkan jenis disk.IMAGE_PROJECT: project ID image OS.IMAGE_FAMILY: kelompok image dari image OS yang ingin Anda gunakan. Untuk daftar semua sistem operasi yang didukung, lihat Sistem operasi yang didukung.NETWORK_PROJECT_ID: project ID jaringan.GVNIC_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC standar yang menggunakan gVNIC.REGION: region subnetwork.RDMA_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC yang menggunakan NIC RDMA.-
RESERVATION: nama pemesanan, blok, atau subblok dalam pemesanan. Untuk mendapatkan nama reservasi atau blok yang tersedia, lihat Melihat kapasitas yang dipesan. Berdasarkan persyaratan penempatan instance, pilih salah satu opsi berikut:- Untuk membuat instance A4X di satu blok:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME - Untuk membuat instance A4X pada blok tertentu:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME - Untuk membuat instance A4X di subblok tertentu:
projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME/reservationSubBlocks/RESERVATION_SUBBLOCK_NAME
- Untuk membuat instance A4X di satu blok:
TERMINATION_ACTION: apakah Compute Engine menghentikan (STOP) atau menghapus (DELETE) instance A4X di akhir periode reservasi.PROJECT_ID: project ID kebijakan penempatan ringkas.REGION: region kebijakan penempatan rapat.POLICY_NAME: nama kebijakan penempatan rapat.
Buat instance 4 GPU mandiri (NVL4)
NVL4 mempartisi domain NVLink untuk membuat instance independen di fabric NVLink. Untuk membuat instance NVL4 mandiri, Anda harus menentukan sub-blok dalam reservasi yang akan dipartisi. Karena setiap instance A4X beroperasi secara independen, Anda tidak perlu menggunakan kebijakan penempatan rapat. Komunikasi NVLink empat GPU dalam node didukung sepenuhnya untuk workload dalam instance.
Sebelum Anda membuat instance NVL4 mandiri, perhatikan hal berikut:
- Penargetan kapasitas dan sub-blok: Untuk membuat instance NVL4 mandiri, Anda harus menargetkan sub-blok reservasi tertentu. Unit atom kapasitas yang dicadangkan adalah seluruh sub-blok, yang merupakan domain NVLink dari 18 instance atau 72 GPU. Anda tidak dapat mencadangkan instance NVL4 tunggal secara terpisah. Saat men-deploy instance NVL4, Anda mempartisi sub-blok yang dicadangkan menjadi hingga 18 node independen. Anda juga dapat membagikan pemesanan sub-blok dari project host ke project konsumen.
- Partisi statis dan perubahan konfigurasi: Deployment sub-blok bersifat statis. Untuk mengubah konfigurasi sub-blok, seperti beralih dari domain
multi-node NVLink
1x72ke instance NVL4 mandiri, atau sebaliknya, Anda harus menghapus semua instance yang ada di sub-blok tersebut sebelum membuatnya ulang dengan konfigurasi baru. - Deployment campuran dalam sub-blok: Anda dapat mengalokasikan instance dalam reservasi sub-blok yang sama di seluruh instance Compute Engine mandiri dan node pool GKE, seperti menyediakan 12 instance Compute Engine mandiri untuk pengembangan dan 6 instance di node pool GKE.
- Konfigurasi NCCL dan NVLS: Jika Anda menjalankan workload terdistribusi menggunakan
NCCL di seluruh instance NVL4, nonaktifkan NVLink SHARP dengan menyetel variabel
lingkungan
NCCL_NVLS_ENABLE=0. Google Cloud tidak mengonfigurasi grup multicast CUDA untuk komunikasi multi-node di domain yang dipartisi.
Jika Anda memesan seluruh sub-blok, yang terdiri dari 18 instance atau 72 GPU, dan ingin men-deploy semua 18 instance A4X mandiri, jalankan perintah pembuatan 18 kali, dan pastikan setiap perintah menargetkan sub-blok reservasi yang sama.
Untuk membuat instance A4X mandiri dengan empat GPU, pilih salah satu opsi berikut:
gcloud
Untuk membuat instance A4X, gunakan perintah
gcloud compute instances create.
Instance A4X mendukung jenis reservasi berikut:
- Pemesanan untuk masa mendatang di AI Hypercomputer
- Pemesanan untuk masa mendatang dalam mode kalender
Untuk menggunakan jenis reservasi ini, instance harus menggunakan model penyediaan terikat reservasi. Misalnya, gunakan parameter pembuatan berikut.
gcloud compute instances create INSTANCE_NAME \
--machine-type=a4x-highgpu-4g \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--zone=ZONE \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
--network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-0,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-1,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-2,no-address \
--network-interface=nic-type=MRDMA,network=RDMA_NAME_PREFIX-mrdma,subnet=RDMA_NAME_PREFIX-mrdma-sub-3,no-address \
--reservation-affinity=specific \
--reservation=RESERVATION_NAME/reservationBlocks/BLOCK_NAME/reservationSubBlocks/SUB_BLOCK_NAME \
--provisioning-model=RESERVATION_BOUND \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--restart-on-failure
Ganti kode berikut:
INSTANCE_NAME: nama instance A4X.IMAGE_FAMILY: kelompok image dari image OS yang ingin Anda gunakan. Untuk daftar semua sistem operasi yang didukung, lihat Sistem operasi yang didukung.IMAGE_PROJECT: project ID image OS.ZONE: zona tempat jenis mesin yang ingin Anda gunakan tersedia. Untuk mengetahui informasi tentang region, lihat Ketersediaan GPU menurut region dan zona.DISK_SIZE: ukuran boot disk dalam GB. Untuk mengetahui informasi selengkapnya, lihat Batas ukuran Google Cloud Hyperdisk atau Batas ukuran Persistent Disk berdasarkan jenis disk.GVNIC_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC standar yang menggunakan gVNIC.RDMA_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC yang menggunakan NIC RDMA.RESERVATION_NAME: nama pemesanan Anda.BLOCK_NAME: nama blok tertentu dalam reservasi.SUB_BLOCK_NAME: nama sub-blok tertentu dalam blok.TERMINATION_ACTION: apakah Compute Engine menghentikan (STOP) atau menghapus (DELETE) instance A4X di akhir periode reservasi.
REST
Untuk membuat instance A4X, buat permintaan POST ke
metode instances.insert.
Instance A4X mendukung jenis reservasi berikut:
- Pemesanan untuk masa mendatang di AI Hypercomputer
- Pemesanan untuk masa mendatang dalam mode kalender
Untuk menggunakan jenis reservasi ini, instance harus menggunakan model penyediaan terikat reservasi. Misalnya, gunakan parameter pembuatan berikut.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances
{
"machineType": "projects/PROJECT_ID/zones/ZONE/machineTypes/a4x-highgpu-4g",
"name": "INSTANCE_NAME",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "hyperdisk-balanced",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"networkInterfaces": [
{
"accessConfigs": [
{
"name": "external-nat",
"type": "ONE_TO_ONE_NAT"
}
],
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
"nicType": "GVNIC",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-0"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-1"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-2"
},
{
"network": "projects/NETWORK_PROJECT_ID/global/networks/RDMA_NAME_PREFIX-mrdma",
"nicType": "MRDMA",
"subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/RDMA_NAME_PREFIX-mrdma-sub-3"
}
],
"reservationAffinity": {
"consumeReservationType": "SPECIFIC_RESERVATION",
"key": "compute.googleapis.com/reservation-name",
"values": [
"RESERVATION_NAME/reservationBlocks/BLOCK_NAME/reservationSubBlocks/SUB_BLOCK_NAME"
]
},
"scheduling": {
"provisioningModel": "RESERVATION_BOUND",
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
"automaticRestart": true
}
}
Ganti kode berikut:
PROJECT_ID: project ID dari project tempat Anda ingin membuat instance A4X.ZONE: zona tempat jenis mesin yang ingin Anda gunakan tersedia. Untuk mengetahui informasi tentang region, lihat Ketersediaan GPU menurut region dan zona.INSTANCE_NAME: nama instance A4X.DISK_SIZE: ukuran boot disk dalam GB. Untuk mengetahui informasi selengkapnya, lihat Batas ukuran Google Cloud Hyperdisk atau Batas ukuran Persistent Disk berdasarkan jenis disk.IMAGE_PROJECT: project ID image OS.IMAGE_FAMILY: kelompok image dari image OS yang ingin Anda gunakan. Untuk daftar semua sistem operasi yang didukung, lihat Sistem operasi yang didukung.NETWORK_PROJECT_ID: project ID jaringan.GVNIC_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC standar yang menggunakan gVNIC.REGION: region subnetwork.RDMA_NAME_PREFIX: awalan nama yang Anda tentukan saat membuat jaringan dan subnet VPC yang menggunakan NIC RDMA.RESERVATION_NAME: nama pemesanan Anda.BLOCK_NAME: nama blok tertentu dalam reservasi.SUB_BLOCK_NAME: nama sub-blok tertentu dalam blok.TERMINATION_ACTION: apakah Compute Engine menghentikan (STOP) atau menghapus (DELETE) instance A4X di akhir periode reservasi.
Menginstal driver GPU
Setelah Anda membuat instance, instance tidak dapat menggunakan GPU-nya kecuali jika driver GPU yang benar sudah diinstal. Jika Anda tidak menentukan image OS yang menyertakan driver GPU, lihat Menginstal driver GPU dalam dokumentasi Compute Engine.
Opsional: Mengaktifkan mode GPU Multi-Instance NVIDIA
Mode Multi-Instance GPU (MIG) adalah fitur yang dapat Anda aktifkan untuk GPU NVIDIA yang didukung. Setelah membuat instance, Anda dapat mengaktifkan mode MIG pada satu GPU yang terpasang ke mesin Anda. Dengan mengaktifkan mode MIG, satu GPU dipartisi menjadi hingga tujuh instance GPU independen. Setiap instance berjalan secara bersamaan, masing-masing dengan memori, cache, dan multiprosesor streaming-nya sendiri. Kemudian, Anda dapat menjalankan berbagai workload pada instance GPU ini secara paralel. Untuk mengetahui informasi selengkapnya tentang penggunaan mode MIG, lihat Panduan Pengguna Multi-Instance GPU (MIG) dalam dokumentasi NVIDIA.Langkah berikutnya
- Melihat topologi instance komputasi
- Ringkasan menjalankan beban kerja
- Memecahkan masalah pemakaian pemesanan