本文說明如何大量建立使用 G4 系列機器的虛擬機器 (VM) 執行個體。如要進一步瞭解這些加速器最佳化機器類型,請參閱「G4 系列」。
如要進一步瞭解如何大量建立 VM,請參閱 Compute Engine 說明文件中的「關於大量建立 VM」。
如要瞭解建立 VM 或叢集的其他方式,請參閱「部署選項總覽」。
限制
大量建立 G4 VM 時,會受到下列限制:
- 使用 G4 機型的執行個體不適用續用折扣和彈性承諾使用折扣。
- 您只能在特定區域和可用區使用 G4 機型。
- 您無法在採用 G4 機型 的執行個體上使用Persistent Disk (區域或可用區)。
- G4 機型僅適用於 AMD EPYC Turin 第 5 代平台。
- 您只能在有限的區域和可用區,搭配
g4-standard-48機型使用 Confidential VM。適用於在 G4 機型上執行的 Confidential VM 的所有限制。 - 您無法在單一用戶群節點上建立 G4 執行個體。
g4-standard-384執行個體無法使用 Windows 作業系統。- 您無法將 2026 年 2 月 4 日前建立的 Hyperdisk ML 磁碟連結至 G4 機器類型。
- 建立連接少於一個 GPU 的 G4 執行個體 (部分 GPU) 時,請勿使用
--no-service-account或--no-scopes標記。如要驗證 NVIDIA vGPU 驅動程式,Compute Engine 必須驗證 VM 的身分。這項程序需要啟用服務帳戶。
事前準備
如要大量建立 VM,請先完成下列步驟 (如果尚未完成):
選取這個頁面上您打算如何使用範例的分頁:
控制台
使用 Google Cloud 控制台存取 Google Cloud 服務和 API 時,無須設定驗證。
gcloud
在 Google Cloud 控制台中啟用 Cloud Shell。
控制台底部會開啟 Cloud Shell 工作階段,並顯示指令列提示。 Google Cloud Cloud Shell 是已安裝 Google Cloud CLI 的殼層環境,並已針對您目前的專案設定好相關值。工作階段可能要幾秒鐘的時間才能初始化。
REST
如要在本機開發環境中使用本頁的 REST API 範例,請使用您提供給 gcloud CLI 的憑證。
安裝 Google Cloud CLI。
若您採用的是外部識別資訊提供者 (IdP),請先使用聯合身分登入 gcloud CLI。
詳情請參閱 Google Cloud 驗證說明文件中的「使用 REST 進行驗證」。
必要的角色
如要取得大量建立 VM 的權限,請要求管理員授予您專案的 Compute 執行個體管理員 (v1) (roles/compute.instanceAdmin.v1) IAM 角色。如要進一步瞭解如何授予角色,請參閱「管理專案、資料夾和組織的存取權」。
這個預先定義的角色具備大量建立 VM 的權限。如要查看確切的必要權限,請展開「Required permissions」(必要權限) 部分:
所需權限
如要大量建立 VM,必須具備下列權限:
-
compute.instances.create專案 -
如要使用自訂映像檔建立 VM:
compute.images.useReadOnly在映像檔上 -
如要使用快照建立 VM:
compute.snapshots.useReadOnly在快照上 -
如要使用執行個體範本建立 VM,請按照下列步驟操作:
compute.instanceTemplates.useReadOnly在執行個體範本上 -
如要為 VM 指定子網路:
compute.subnetworks.use專案或所選子網路的 -
如要為 VM 指定靜態 IP 位址:
compute.addresses.use專案的權限 -
使用虛擬私有雲網路時,如要將外部 IP 位址指派給 VM:
compute.subnetworks.useExternalIp專案或所選子網路的權限 -
如要將舊版網路指派給 VM,請按照下列步驟操作:
compute.networks.use專案的 -
使用舊版網路時,如要將外部 IP 位址指派給 VM,請在專案中設定
compute.networks.useExternalIp。 -
如要為 VM 設定 VM 執行個體中繼資料,請按照下列步驟操作:
compute.instances.setMetadata在專案中 -
如要為 VM 設定標記,請按照下列步驟操作:
compute.instances.setTags在 VM 上 -
如要為 VM 設定標籤,請按照下列步驟操作:
compute.instances.setLabels在 VM 上 -
如要設定 VM 使用的服務帳戶,請在 VM 上執行下列操作:
compute.instances.setServiceAccount在 VM 上 -
為 VM 建立新磁碟:
compute.disks.create專案的 -
如要以唯讀或讀寫模式附加現有磁碟:
compute.disks.use磁碟 -
如要以唯讀模式連接現有磁碟:
compute.disks.useReadOnly磁碟
總覽
使用 G4 機型大量建立執行個體時,請按照下列步驟操作:
選用:建立密集配置政策
您可以建立密集配置政策來指定 VM 配置。將密集配置政策套用至 VM 時,Compute Engine 會盡力建立彼此距離最近的 VM。如果您的應用程式對延遲時間很敏感,且需要盡可能精簡,請在建立密集配置政策時,指定 maxDistance 欄位 (預覽版)。maxDistance 值越低,VM 彼此會越靠近,但也會增加無法建立部分 VM 的可能性。
gcloud
如要建立密集配置政策,請使用
gcloud beta compute resource-policies create group-placement 指令:
gcloud beta compute resource-policies create group-placement POLICY_NAME \
--collocation=collocated \
--max-distance=MAX_DISTANCE \
--region=REGION
更改下列內容:
POLICY_NAME:密集配置政策的名稱。MAX_DISTANCE:虛擬機器的最大距離設定,可指定 (預覽版,建議使用) 或不指定 (移除--max-distance標記)。請確認最大距離設定支援您要建立的機器系列和 VM 數量。詳情請參閱 Compute Engine 說明文件中的「關於密集配置政策」。舉例來說,最大距離為3會將 VM 放在相鄰區塊,而2則會將 VM 放在同一個區塊。REGION:要建立密集配置政策的區域。指定要建立執行個體的可用區所屬的區域,並確認您要使用的機型適用於該區域。如要瞭解地區,請參閱「各區域和可用區的 GPU 供應情形」。
REST
如要建立密集配置政策,請對 beta resourcePolicies.insert 方法發出 POST 要求。在要求主體中,加入設為 COLLOCATED 的 collocation 欄位,以及 maxDistance 欄位。
POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
{
"name": "POLICY_NAME",
"groupPlacementPolicy": {
"collocation": "COLLOCATED",
"maxDistance": MAX_DISTANCE
}
}
更改下列內容:
PROJECT_ID:您的專案 ID。POLICY_NAME:密集配置政策的名稱。MAX_DISTANCE:VM 的最大距離設定,可指定 (預覽版,建議使用) 或不指定 (移除maxDistance欄位)。請確認最大距離設定支援您要建立的機器系列和 VM 數量。詳情請參閱 Compute Engine 說明文件中的「關於密集配置政策」。舉例來說,最大距離為3會將 VM 放在相鄰區塊,而2則會將 VM 放在同一個區塊。REGION:要建立密集配置政策的區域。指定要建立執行個體的可用區所屬的區域,並確認您要使用的機型適用於該區域。如要瞭解地區,請參閱「各區域和可用區的 GPU 供應情形」。
大量建立 G4 VM
如要大量建立 G4 VM,請使用下列其中一種方法。
下列指令也會設定執行個體的存取權範圍。為簡化權限管理,Google 建議您將執行個體的存取權範圍設為cloud-platform 存取權,然後使用 IAM 角色定義執行個體可存取的服務。詳情請參閱「範圍最佳做法」。gcloud
如要大量建立執行個體,請使用
gcloud compute instances bulk create 指令。
您需要指定的參數取決於此部署作業使用的消耗選項。選取與計費方案對應的分頁。
預留項目
G4 執行個體支援下列預留類型:
- 隨需預留項目
- 標準未來預留項目
如要使用這類預留項目,執行個體必須採用標準佈建模式。舉例來說,請使用下列建立參數。
執行指令前,請先詳閱下列所有步驟,判斷是否要加入其他標記。
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY \
--reservation=RESERVATION
操作步驟如下:
-
更改下列內容:
NAME_PATTERN:用於 G4 執行個體的名稱模式。 舉例來說,如果名稱模式為instance-#,就會產生名稱為instance-1和instance-2等的 G4 執行個體,最多可達--count指定的 G4 執行個體數量。COUNT:要建立的 G4 執行個體數量。MACHINE_TYPE:G4 執行個體使用的機型。詳情請參閱 Compute Engine 說明文件中的「GPU 機器類型」。IMAGE_FAMILY:您要使用的 OS 映像檔系列。 如需所有支援的作業系統清單,請參閱「支援的作業系統」。IMAGE_PROJECT:OS 映像檔的專案 ID。REGION:指定要使用的機型所在的區域。如要指定密集配置政策,您必須使用與密集配置政策相同的區域。 如需地區相關資訊,請參閱「各區域和可用區的 GPU 供應情形」。DISK_SIZE:開機磁碟的大小,單位為 GB。詳情請參閱Google Cloud Hyperdisk 大小限制或永久磁碟大小限制,視磁碟類型而定。RESERVATION_AFFINITY:執行個體可使用的預留項目 (如適用)。指定下列其中一項:RESERVATION:要使用的預留項目。根據您為RESERVATION_AFFINITY指定的值,指定下列其中一個值:- 如果您指定
any,請將RESERVATION替換為空字串 ("")。或者,您也可以完全移除--reservation旗標。 如果您指定
specific,請將RESERVATION替換為下列內容:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
更改下列內容:
RESERVATION_OWNER_PROJECT_ID:建立預留項目的專案 ID。RESERVATION_NAME:預訂名稱。
- 如果您指定
根據預設,如果執行個體當機,或 Compute Engine 因排程停止 (例如維護事件) 而停止執行個體,系統會自動重新啟動執行個體。如要停用自動重新啟動功能,請新增下列標記:
--no-restart-on-failure
-
選用步驟:如果您選擇使用密集配置政策,請在指令中加入下列旗標:
--resource-policies=POLICY_NAME
更改下列內容:
POLICY_NAME:密集配置政策的名稱。
-
選用:如要連結本機 SSD 磁碟,請為每個本機 SSD 磁碟新增下列
--local-ssd標記。請確認您連接的本機 SSD 磁碟數量符合機型規定。詳情請參閱 Compute Engine 說明文件中的「關於本機 SSD 磁碟」。具體來說,G4 機器類型使用 Titanium SSD 磁碟。
--local-ssd interface=INTERFACE_TYPE
更改下列內容:
INTERFACE_TYPE:您要用於本機 SSD 磁碟的磁碟介面類型。如果開機磁碟映像檔具有最佳化 NVMe 驅動程式,請指定NVME。為其他圖片指定SCSI。
建立含有本機 SSD 磁碟的 VM 後,您必須先格式化並掛接每個裝置,方可使用。
-
選用:如要使用 NVIDIA RTX 虛擬工作站 (vWS),請新增下列標記。
建立使用 NVIDIA RTX Virtual Workstation 的執行個體時,Compute Engine 會自動新增 vWS 授權。如要瞭解虛擬工作站的定價,請參閱 GPU 定價頁面。
--accelerator=type=nvidia-rtx-pro-6000-vws,count=VWS_ACCELERATOR_COUNT
請將
VWS_ACCELERATOR_COUNT替換為所需的虛擬 GPU 數量。 - 執行更改後的指令。
隨選
執行指令前,請先詳閱下列所有步驟,判斷是否要加入其他標記。
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY
操作步驟如下:
-
更改下列內容:
NAME_PATTERN:用於 G4 執行個體的名稱模式。 舉例來說,如果名稱模式為instance-#,就會產生名稱為instance-1和instance-2等的 G4 執行個體,最多可達--count指定的 G4 執行個體數量。COUNT:要建立的 G4 執行個體數量。MACHINE_TYPE:G4 執行個體使用的機型。詳情請參閱 Compute Engine 說明文件中的「GPU 機器類型」。IMAGE_FAMILY:您要使用的 OS 映像檔系列。 如需所有支援的作業系統清單,請參閱「支援的作業系統」。IMAGE_PROJECT:OS 映像檔的專案 ID。REGION:指定要使用的機型所在的區域。如要指定密集配置政策,您必須使用與密集配置政策相同的區域。 如需地區相關資訊,請參閱「各區域和可用區的 GPU 供應情形」。DISK_SIZE:開機磁碟的大小,單位為 GB。詳情請參閱Google Cloud Hyperdisk 大小限制或永久磁碟大小限制,視磁碟類型而定。RESERVATION_AFFINITY:執行個體可使用的預留項目 (如適用)。指定下列其中一項:any(預留容量為選用項目):這是預設選項。執行個體會嘗試使用自動使用預留項目的容量,但前提是必須有相符的預留容量。否則,執行個體會使用隨選容量。none(必須使用隨需容量):禁止執行個體使用任何預留容量。
根據預設,如果執行個體當機,或 Compute Engine 因排程停止 (例如維護事件) 而停止執行個體,系統會自動重新啟動執行個體。如要停用自動重新啟動功能,請新增下列標記:
--no-restart-on-failure
-
選用步驟:如果您選擇使用密集配置政策,請在指令中加入下列旗標:
--resource-policies=POLICY_NAME
更改下列內容:
POLICY_NAME:密集配置政策的名稱。
-
選用:如要連結本機 SSD 磁碟,請為每個本機 SSD 磁碟新增下列
--local-ssd標記。請確認您連接的本機 SSD 磁碟數量符合機型規定。詳情請參閱 Compute Engine 說明文件中的「關於本機 SSD 磁碟」。具體來說,G4 機器類型使用 Titanium SSD 磁碟。
--local-ssd interface=INTERFACE_TYPE
更改下列內容:
INTERFACE_TYPE:您要用於本機 SSD 磁碟的磁碟介面類型。如果開機磁碟映像檔具有最佳化 NVMe 驅動程式,請指定NVME。為其他圖片指定SCSI。
建立含有本機 SSD 磁碟的 VM 後,您必須先格式化並掛接每個裝置,方可使用。
-
選用:如要使用 NVIDIA RTX 虛擬工作站 (vWS),請新增下列標記。
建立使用 NVIDIA RTX Virtual Workstation 的執行個體時,Compute Engine 會自動新增 vWS 授權。如要瞭解虛擬工作站的定價,請參閱 GPU 定價頁面。
--accelerator=type=nvidia-rtx-pro-6000-vws,count=VWS_ACCELERATOR_COUNT
請將
VWS_ACCELERATOR_COUNT替換為所需的虛擬 GPU 數量。 - 執行更改後的指令。
Spot
執行指令前,請先詳閱下列所有步驟,判斷是否要加入其他標記。
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=hyperdisk-balanced \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=SPOT \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--no-restart-on-failure
操作步驟如下:
-
更改下列內容:
NAME_PATTERN:用於 G4 執行個體的名稱模式。 舉例來說,如果名稱模式為instance-#,就會產生名稱為instance-1和instance-2等的 G4 執行個體,最多可達--count指定的 G4 執行個體數量。COUNT:要建立的 G4 執行個體數量。MACHINE_TYPE:G4 執行個體使用的機型。詳情請參閱 Compute Engine 說明文件中的「GPU 機器類型」。IMAGE_FAMILY:您要使用的 OS 映像檔系列。 如需所有支援的作業系統清單,請參閱「支援的作業系統」。IMAGE_PROJECT:OS 映像檔的專案 ID。REGION:指定要使用的機型所在的區域。如要指定密集配置政策,您必須使用與密集配置政策相同的區域。 如需地區相關資訊,請參閱「各區域和可用區的 GPU 供應情形」。DISK_SIZE:開機磁碟的大小,單位為 GB。詳情請參閱Google Cloud Hyperdisk 大小限制或永久磁碟大小限制,視磁碟類型而定。TERMINATION_ACTION:Compute Engine 預先終止執行個體時採取的動作,可以是STOP(預設) 或DELETE。
-
選用步驟:如果您選擇使用密集配置政策,請在指令中加入下列旗標:
--resource-policies=POLICY_NAME
更改下列內容:
POLICY_NAME:密集配置政策的名稱。
-
選用:如要連結本機 SSD 磁碟,請為每個本機 SSD 磁碟新增下列
--local-ssd標記。請確認您連接的本機 SSD 磁碟數量符合機型規定。詳情請參閱 Compute Engine 說明文件中的「關於本機 SSD 磁碟」。具體來說,G4 機器類型使用 Titanium SSD 磁碟。
--local-ssd interface=INTERFACE_TYPE
更改下列內容:
INTERFACE_TYPE:您要用於本機 SSD 磁碟的磁碟介面類型。如果開機磁碟映像檔具有最佳化 NVMe 驅動程式,請指定NVME。為其他圖片指定SCSI。
建立含有本機 SSD 磁碟的 VM 後,您必須先格式化並掛接每個裝置,方可使用。
-
選用:如要使用 NVIDIA RTX 虛擬工作站 (vWS),請新增下列標記。
建立使用 NVIDIA RTX Virtual Workstation 的執行個體時,Compute Engine 會自動新增 vWS 授權。如要瞭解虛擬工作站的定價,請參閱 GPU 定價頁面。
--accelerator=type=nvidia-rtx-pro-6000-vws,count=VWS_ACCELERATOR_COUNT
請將
VWS_ACCELERATOR_COUNT替換為所需的虛擬 GPU 數量。 - 執行更改後的指令。
REST
如要大量建立執行個體,請對
instances.bulkInsert 方法發出 POST 要求。
您需要指定的參數取決於此部署作業使用的消耗選項。選取與計費方案對應的分頁。
預留項目
G4 執行個體支援下列預留類型:
- 隨需預留項目
- 標準未來預留項目
如要使用這類預留項目,執行個體必須採用標準佈建模式。舉例來說,請使用下列建立參數。
提交要求前,請先查看下列所有步驟,判斷是否要加入其他欄位。
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "hyperdisk-balanced",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY",
"key": "compute.googleapis.com/reservation-name",
"values": [
"RESERVATION"
]
}
}
}
操作步驟如下:
-
更改下列內容:
PROJECT_ID:您要在當中建立 G4 執行個體的專案 ID。ZONE:指定可使用所需機型的區域。如要指定密集配置政策,您必須使用與密集配置政策位於相同區域的可用區。 如需地區相關資訊,請參閱「各區域和可用區的 GPU 供應情形」。NAME_PATTERN:用於 G4 執行個體的名稱模式。 舉例來說,如果名稱模式為instance-#,就會產生名稱為instance-1和instance-2等的 G4 執行個體,最多可達--count指定的 G4 執行個體數量。COUNT:要建立的 G4 執行個體數量。MACHINE_TYPE:G4 執行個體使用的機型。詳情請參閱 Compute Engine 說明文件中的「GPU 機器類型」。DISK_SIZE:開機磁碟的大小,單位為 GB。詳情請參閱Google Cloud Hyperdisk 大小限制或永久磁碟大小限制,視磁碟類型而定。IMAGE_PROJECT:OS 映像檔的專案 ID。IMAGE_FAMILY:您要使用的 OS 映像檔系列。 如需所有支援的作業系統清單,請參閱「支援的作業系統」。AUTOMATIC_RESTART:如果執行個體當機,或 Compute Engine 因排定的停止作業 (例如維護事件) 而停止執行個體,則執行個體會自動重新啟動。指定true啟用自動重新啟動 (預設),或指定false停用自動重新啟動。RESERVATION_AFFINITY:執行個體可使用的預留項目 (如適用)。指定下列其中一項:RESERVATION:要使用的預留項目。根據您為RESERVATION_AFFINITY指定的值,指定下列其中一個值:- 如果您指定了
ANY_RESERVATION,請刪除RESERVATION,讓值成為空字串 ("")。或者,您也可以完全移除key和values欄位。 如果您指定
SPECIFIC_RESERVATION,請將RESERVATION替換為下列內容:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
更改下列內容:
RESERVATION_OWNER_PROJECT_ID:建立預留項目的專案 ID。RESERVATION_NAME:預訂名稱。
- 如果您指定了
-
選用:如果您選擇使用密集配置政策,請在要求主體中新增下列
instanceProperties子欄位:"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]更改下列內容:
PROJECT_ID:密集配置政策的專案 ID。REGION:密集配置政策的區域。POLICY_NAME:密集配置政策的名稱。
-
選用:如要使用本機 SSD 磁碟,請將下列欄位新增至每個本機 SSD 磁碟的
disks[]欄位。請以半形逗號分隔每個disks[]子欄位 (包括開機磁碟)。請確認您連接的本機 SSD 磁碟數量符合機型規定。詳情請參閱 Compute Engine 說明文件中的「關於本機 SSD 磁碟」。具體來說,G4 機器類型使用 Titanium SSD 磁碟。
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }更改下列內容:
ZONE:您指定的可用區。INTERFACE_TYPE:您要用於本機 SSD 磁碟的磁碟介面類型。如果開機磁碟映像檔具有最佳化 NVMe 驅動程式,請指定NVME。為其他圖片指定SCSI。
建立含有本機 SSD 磁碟的 VM 後,您必須先格式化並掛接每個裝置,方可使用。
-
選用:如要使用 NVIDIA RTX 虛擬工作站 (vWS),請新增下列欄位。
建立使用 NVIDIA RTX Virtual Workstation 的執行個體時,Compute Engine 會自動新增 vWS 授權。如要瞭解虛擬工作站的定價,請參閱 GPU 定價頁面。
"guestAccelerators": [ { "acceleratorCount": VWS_ACCELERATOR_COUNT, "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-rtx-pro-6000-vws" } ]請將
VWS_ACCELERATOR_COUNT替換為所需的虛擬 GPU 數量。 - 提交要求。
隨選
提交要求前,請先查看下列所有步驟,判斷是否要加入其他欄位。
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "hyperdisk-balanced",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY"
}
}
}
操作步驟如下:
-
更改下列內容:
PROJECT_ID:您要在當中建立 G4 執行個體的專案 ID。ZONE:指定可使用所需機型的區域。如要指定密集配置政策,您必須使用與密集配置政策位於相同區域的可用區。 如需地區相關資訊,請參閱「各區域和可用區的 GPU 供應情形」。NAME_PATTERN:用於 G4 執行個體的名稱模式。 舉例來說,如果名稱模式為instance-#,就會產生名稱為instance-1和instance-2等的 G4 執行個體,最多可達--count指定的 G4 執行個體數量。COUNT:要建立的 G4 執行個體數量。MACHINE_TYPE:G4 執行個體使用的機型。詳情請參閱 Compute Engine 說明文件中的「GPU 機器類型」。DISK_SIZE:開機磁碟的大小,單位為 GB。詳情請參閱Google Cloud Hyperdisk 大小限制或永久磁碟大小限制,視磁碟類型而定。IMAGE_PROJECT:OS 映像檔的專案 ID。IMAGE_FAMILY:您要使用的 OS 映像檔系列。 如需所有支援的作業系統清單,請參閱「支援的作業系統」。AUTOMATIC_RESTART:如果執行個體當機,或 Compute Engine 因排定的停止作業 (例如維護事件) 而停止執行個體,則執行個體會自動重新啟動。指定true啟用自動重新啟動 (預設),或指定false停用自動重新啟動。RESERVATION_AFFINITY:執行個體可使用的預留項目 (如適用)。指定下列其中一項:ANY_RESERVATION(預留容量為選用項目):這是預設選項。執行個體會嘗試使用自動使用的預留項目容量,但前提是必須有相符的預留項目容量。否則,執行個體會使用隨選容量。NO_RESERVATION(必須使用隨需容量):禁止執行個體使用任何預留容量。
-
選用:如果您選擇使用密集配置政策,請在要求主體中新增下列
instanceProperties子欄位:"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]更改下列內容:
PROJECT_ID:密集配置政策的專案 ID。REGION:密集配置政策的區域。POLICY_NAME:密集配置政策的名稱。
-
選用:如要使用本機 SSD 磁碟,請將下列欄位新增至每個本機 SSD 磁碟的
disks[]欄位。請以半形逗號分隔每個disks[]子欄位 (包括開機磁碟)。請確認您連接的本機 SSD 磁碟數量符合機型規定。詳情請參閱 Compute Engine 說明文件中的「關於本機 SSD 磁碟」。具體來說,G4 機器類型使用 Titanium SSD 磁碟。
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }更改下列內容:
ZONE:您指定的可用區。INTERFACE_TYPE:您要用於本機 SSD 磁碟的磁碟介面類型。如果開機磁碟映像檔具有最佳化 NVMe 驅動程式,請指定NVME。為其他圖片指定SCSI。
建立含有本機 SSD 磁碟的 VM 後,您必須先格式化並掛接每個裝置,方可使用。
-
選用:如要使用 NVIDIA RTX 虛擬工作站 (vWS),請新增下列欄位。
建立使用 NVIDIA RTX Virtual Workstation 的執行個體時,Compute Engine 會自動新增 vWS 授權。如要瞭解虛擬工作站的定價,請參閱 GPU 定價頁面。
"guestAccelerators": [ { "acceleratorCount": VWS_ACCELERATOR_COUNT, "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-rtx-pro-6000-vws" } ]請將
VWS_ACCELERATOR_COUNT替換為所需的虛擬 GPU 數量。 - 提交要求。
Spot
提交要求前,請先查看下列所有步驟,判斷是否要加入其他欄位。
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "hyperdisk-balanced",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling":
{
"provisioningModel": "SPOT",
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
"automaticRestart": false
}
}
}
操作步驟如下:
-
更改下列內容:
PROJECT_ID:您要在當中建立 G4 執行個體的專案 ID。ZONE:指定可使用所需機型的區域。如要指定密集配置政策,您必須使用與密集配置政策位於相同區域的可用區。 如需地區相關資訊,請參閱「各區域和可用區的 GPU 供應情形」。NAME_PATTERN:用於 G4 執行個體的名稱模式。 舉例來說,如果名稱模式為instance-#,就會產生名稱為instance-1和instance-2等的 G4 執行個體,最多可達--count指定的 G4 執行個體數量。COUNT:要建立的 G4 執行個體數量。MACHINE_TYPE:G4 執行個體使用的機型。詳情請參閱 Compute Engine 說明文件中的「GPU 機器類型」。DISK_SIZE:開機磁碟的大小,單位為 GB。詳情請參閱Google Cloud Hyperdisk 大小限制或永久磁碟大小限制,視磁碟類型而定。IMAGE_PROJECT:OS 映像檔的專案 ID。IMAGE_FAMILY:您要使用的 OS 映像檔系列。 如需所有支援的作業系統清單,請參閱「支援的作業系統」。TERMINATION_ACTION:Compute Engine 預先終止執行個體時採取的動作,可以是STOP(預設) 或DELETE。
-
選用:如果您選擇使用密集配置政策,請在要求主體中新增下列
instanceProperties子欄位:"resourcePolicies": [ "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME" ]更改下列內容:
PROJECT_ID:密集配置政策的專案 ID。REGION:密集配置政策的區域。POLICY_NAME:密集配置政策的名稱。
-
選用:如要使用本機 SSD 磁碟,請將下列欄位新增至每個本機 SSD 磁碟的
disks[]欄位。請以半形逗號分隔每個disks[]子欄位 (包括開機磁碟)。請確認您連接的本機 SSD 磁碟數量符合機型規定。詳情請參閱 Compute Engine 說明文件中的「關於本機 SSD 磁碟」。具體來說,G4 機器類型使用 Titanium SSD 磁碟。
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }更改下列內容:
ZONE:您指定的可用區。INTERFACE_TYPE:您要用於本機 SSD 磁碟的磁碟介面類型。如果開機磁碟映像檔具有最佳化 NVMe 驅動程式,請指定NVME。為其他圖片指定SCSI。
建立含有本機 SSD 磁碟的 VM 後,您必須先格式化並掛接每個裝置,方可使用。
-
選用:如要使用 NVIDIA RTX 虛擬工作站 (vWS),請新增下列欄位。
建立使用 NVIDIA RTX Virtual Workstation 的執行個體時,Compute Engine 會自動新增 vWS 授權。如要瞭解虛擬工作站的定價,請參閱 GPU 定價頁面。
"guestAccelerators": [ { "acceleratorCount": VWS_ACCELERATOR_COUNT, "acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/nvidia-rtx-pro-6000-vws" } ]請將
VWS_ACCELERATOR_COUNT替換為所需的虛擬 GPU 數量。 - 提交要求。
如要進一步瞭解大量建立 VM 時的設定選項,請參閱 Compute Engine 說明文件中的「大量建立 VM」。
安裝 GPU 驅動程式
建立執行個體後,除非已安裝正確的 GPU 驅動程式,否則執行個體無法使用 GPU。 您需要安裝的驅動程式取決於執行個體是否具有部分 GPU,或是是否已啟用 NVIDIA RTX 虛擬工作站 (vWS)。請使用下列其中一種方式:
- 如果您指定了含有部分 GPU 的機型,例如
g4-standard-6、g4-standard-12或g4-standard-24,請參閱 Compute Engine 說明文件中的「安裝 vGPU 驅動程式 (部分 GPU)」。 - 如果已啟用 vWS,請參閱 Compute Engine 說明文件中的「安裝 NVIDIA RTX 虛擬工作站 (vWS) 的驅動程式」。
否則,請使用預設的 GPU 驅動程式,如下所示:
- 如果您指定包含 GPU 驅動程式的 OS 映像檔,則不需要採取任何行動。
- 如果 OS 映像檔未包含 GPU 驅動程式,請參閱 Compute Engine 說明文件中的「安裝 GPU 驅動程式」。