Questo documento spiega come creare in blocco istanze di macchine virtuali (VM) che utilizzano la serie di macchine N1 con GPU collegate. Per saperne di più su questi tipi di macchine ottimizzate per l'acceleratore, consulta Serie N1 + GPU.
Per saperne di più sulla creazione di VM in blocco, consulta Informazioni sulla creazione in blocco delle VM nella documentazione di Compute Engine.
Per scoprire altri modi per creare VM o cluster, vedi Panoramica delle opzioni di deployment.
Limitazioni
Per le limitazioni che si applicano ai tipi di macchine N1 con GPU, consulta quanto segue:
- Tipi di macchine GPU
- Macchine con GPU nella famiglia di macchine ottimizzate per l'acceleratore
- Serie di macchine N1
Prima di iniziare
Prima di creare VM in blocco, se non l'hai ancora fatto, completa i seguenti passaggi:
- Scegli un'opzione di consumo: la tua scelta determina come ottenere e utilizzare le risorse GPU. Per saperne di più, consulta Scegliere un'opzione di consumo.
- Ottenere capacità: la procedura per ottenere capacità varia a seconda dell'opzione di consumo. Per scoprire di più sulla procedura per ottenere la capacità per l'opzione di consumo scelta, consulta Panoramica della capacità.
Seleziona la scheda relativa a come prevedi di utilizzare gli esempi in questa pagina:
Console
Quando utilizzi la console Google Cloud per accedere ai servizi Google Cloud e alle API, non devi configurare l'autenticazione.
gcloud
Nella console Google Cloud , attiva Cloud Shell.
Nella parte inferiore della console Google Cloud viene avviata una sessione di Cloud Shell e viene visualizzato un prompt della riga di comando. Cloud Shell è un ambiente shell con Google Cloud CLI già installata e con valori già impostati per il progetto corrente. L'inizializzazione della sessione può richiedere alcuni secondi.
REST
Per utilizzare gli esempi di API REST in questa pagina in un ambiente di sviluppo locale, utilizzi le credenziali che fornisci a gcloud CLI.
Installa Google Cloud CLI.
Se utilizzi un provider di identità (IdP) esterno, devi prima accedere a gcloud CLI con la tua identità federata.
Per saperne di più, consulta Autenticati per usare REST nella documentazione sull'autenticazione di Google Cloud .
Ruoli obbligatori
Per ottenere le autorizzazioni necessarie
per creare più VM contemporaneamente,
chiedi all'amministratore di concederti
il ruolo IAM Compute Instance Admin (v1) (roles/compute.instanceAdmin.v1) nel progetto.
Per saperne di più sulla concessione dei ruoli, consulta Gestisci l'accesso a progetti, cartelle e organizzazioni.
Questo ruolo predefinito include le autorizzazioni necessarie per creare più VM contemporaneamente. Per visualizzare le autorizzazioni obbligatorie corrette, espandi l'omonima sezione:
Autorizzazioni obbligatorie
Per creare più VM contemporaneamente, sono necessarie le seguenti autorizzazioni:
-
compute.instances.createsul progetto -
Per utilizzare un'immagine personalizzata per creare la VM:
compute.images.useReadOnlysull'immagine -
Per utilizzare uno snapshot per creare la VM:
compute.snapshots.useReadOnlysullo snapshot -
Per utilizzare un template di istanza per creare la VM:
compute.instanceTemplates.useReadOnlysul template di istanza -
Per specificare una subnet per la VM:
compute.subnetworks.usesul progetto o sulla subnet scelta -
Per specificare un indirizzo IP statico per la VM:
compute.addresses.usesul progetto -
Per assegnare un indirizzo IP esterno alla VM quando utilizzi una rete VPC:
compute.subnetworks.useExternalIpsul progetto o sulla subnet scelta -
Per assegnare una rete legacy alla VM:
compute.networks.usesul progetto -
Per assegnare un indirizzo IP esterno alla VM quando utilizzi una rete legacy:
compute.networks.useExternalIpsul progetto -
Per impostare i metadati dell'istanza VM per la VM:
compute.instances.setMetadatasul progetto -
Per impostare i tag per la VM:
compute.instances.setTagssulla VM -
Per impostare le etichette per la VM:
compute.instances.setLabelssulla VM -
Per impostare un service account che la VM possa utilizzare:
compute.instances.setServiceAccountsulla VM -
Per creare un nuovo disco per la VM:
compute.disks.createsul progetto -
Per collegare un disco esistente in modalità di sola lettura o di lettura e scrittura:
compute.disks.usesul disco -
Per collegare un disco esistente in modalità di sola lettura:
compute.disks.useReadOnlysul disco
Potresti anche ottenere queste autorizzazioni con ruoli personalizzati o altri ruoli predefiniti.
Panoramica
La creazione collettiva di istanze con il tipo di macchina N1 con GPU T4 o V100 include i seguenti passaggi:
Crea VM N1 con GPU collettivamente
Per creare più VM N1 con GPU contemporaneamente, utilizza uno dei seguenti metodi.
I seguenti comandi impostano anche l'ambito di accesso per le tue istanze. Per semplificare la gestione delle autorizzazioni, Google consiglia di impostare l'ambito di accesso di un'istanza sucloud-platform e poi utilizzare i ruoli IAM per definire i servizi a cui l'istanza può accedere. Per saperne di più, consulta le best practice per gli ambiti.
gcloud
Per creare
istanze in
blocco, utilizza il
comando gcloud compute instances bulk create.
I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.
Prenotazione
Le istanze N1 con GPU T4 o V100 supportano i seguenti tipi di prenotazioni:
- Prenotazioni on demand
- Prenotazioni future standard
Per utilizzare questi tipi di prenotazioni, un'istanza deve utilizzare il modello di provisioning standard. Ad esempio, utilizza i seguenti parametri di creazione.
Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY \
--reservation=RESERVATION
Completa i seguenti passaggi:
-
Sostituisci quanto segue:
NAME_PATTERN: il pattern del nome da utilizzare per le istanze N1 con GPU T4 o V100. Ad esempio, l'utilizzo diinstance-#per il pattern del nome genera istanze N1 con GPU T4 o V100 con nomi comeinstance-1einstance-2, fino al numero di istanze N1 con GPU T4 o V100 specificato da--count.COUNT: il numero di istanze N1 con GPU T4 o V100 da creare.MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza N1 con GPU T4 o V100. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.ACCELERATOR_COUNT: il numero di GPU che vuoi collegare alla VM N1. Per un elenco dei limiti delle GPU in base al tipo di macchina della VM, consulta le informazioni sulle GPU N1 nella documentazione di Compute Engine.ACCELERATOR_TYPE: il tipo di acceleratore per le VM N1 che vuoi utilizzare. Per i carichi di lavoro di AI, ti consigliamo di utilizzare GPU T4 o V100.IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:any(la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.specific(è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.
RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato perRESERVATION_AFFINITY:- Se hai specificato
any, sostituisciRESERVATIONcon una stringa vuota (""). In alternativa, puoi rimuovere completamente il flag--reservation. Se hai specificato
specific, sostituisciRESERVATIONcon quanto segue:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Sostituisci quanto segue:
RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.RESERVATION_NAME: il nome della prenotazione.
- Se hai specificato
Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:
--no-restart-on-failure
-
(Facoltativo) Per collegare dischi SSD locali, aggiungi il seguente flag
--local-ssdper ogni disco SSD locale.Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Sostituisci quanto segue:
INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specificaNVME. SpecificaSCSIper le altre immagini.
Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.
- Esegui il comando.
On demand
Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=STANDARD \
--maintenance-policy=TERMINATE \
--reservation-affinity=RESERVATION_AFFINITY
Completa i seguenti passaggi:
-
Sostituisci quanto segue:
NAME_PATTERN: il pattern del nome da utilizzare per le istanze N1 con GPU T4 o V100. Ad esempio, l'utilizzo diinstance-#per il pattern del nome genera istanze N1 con GPU T4 o V100 con nomi comeinstance-1einstance-2, fino al numero di istanze N1 con GPU T4 o V100 specificato da--count.COUNT: il numero di istanze N1 con GPU T4 o V100 da creare.MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza N1 con GPU T4 o V100. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.ACCELERATOR_COUNT: il numero di GPU che vuoi collegare alla VM N1. Per un elenco dei limiti delle GPU in base al tipo di macchina della VM, consulta le informazioni sulle GPU N1 nella documentazione di Compute Engine.ACCELERATOR_TYPE: il tipo di acceleratore per le VM N1 che vuoi utilizzare. Per i carichi di lavoro di AI, ti consigliamo di utilizzare GPU T4 o V100.IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:any(la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.none(è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.
Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:
--no-restart-on-failure
-
(Facoltativo) Per collegare dischi SSD locali, aggiungi il seguente flag
--local-ssdper ogni disco SSD locale.Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Sostituisci quanto segue:
INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specificaNVME. SpecificaSCSIper le altre immagini.
Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.
- Esegui il comando.
Spot
Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.
gcloud compute instances bulk create \
--name-pattern=NAME_PATTERN \
--count=COUNT \
--machine-type=MACHINE_TYPE \
--accelerator=type=ACCELERATOR_TYPE,count=ACCELERATOR_COUNT \
--image-family=IMAGE_FAMILY \
--image-project=IMAGE_PROJECT \
--region=REGION \
--boot-disk-type=DISK_TYPE \
--boot-disk-size=DISK_SIZE \
--scopes=cloud-platform \
--provisioning-model=SPOT \
--instance-termination-action=TERMINATION_ACTION \
--maintenance-policy=TERMINATE \
--no-restart-on-failure
Completa i seguenti passaggi:
-
Sostituisci quanto segue:
NAME_PATTERN: il pattern del nome da utilizzare per le istanze N1 con GPU T4 o V100. Ad esempio, l'utilizzo diinstance-#per il pattern del nome genera istanze N1 con GPU T4 o V100 con nomi comeinstance-1einstance-2, fino al numero di istanze N1 con GPU T4 o V100 specificato da--count.COUNT: il numero di istanze N1 con GPU T4 o V100 da creare.MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza N1 con GPU T4 o V100. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.ACCELERATOR_COUNT: il numero di GPU che vuoi collegare alla VM N1. Per un elenco dei limiti delle GPU in base al tipo di macchina della VM, consulta le informazioni sulle GPU N1 nella documentazione di Compute Engine.ACCELERATOR_TYPE: il tipo di acceleratore per le VM N1 che vuoi utilizzare. Per i carichi di lavoro di AI, ti consigliamo di utilizzare GPU T4 o V100.IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovveroSTOP(impostazione predefinita) oDELETE.
-
(Facoltativo) Per collegare dischi SSD locali, aggiungi il seguente flag
--local-ssdper ogni disco SSD locale.Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.
--local-ssd interface=INTERFACE_TYPE
Sostituisci quanto segue:
INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specificaNVME. SpecificaSCSIper le altre immagini.
Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.
- Esegui il comando.
REST
Per creare
istanze in
blocco, invia una richiesta POST al
metodo
instances.bulkInsert.
I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.
Prenotazione
Le istanze N1 con GPU T4 o V100 supportano i seguenti tipi di prenotazioni:
- Prenotazioni on demand
- Prenotazioni future standard
Per utilizzare questi tipi di prenotazioni, un'istanza deve utilizzare il modello di provisioning standard. Ad esempio, utilizza i seguenti parametri di creazione.
Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"guestAccelerators":
[
{
"acceleratorCount": ACCELERATOR_COUNT,
"acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
}
],
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY",
"key": "compute.googleapis.com/reservation-name",
"values": [
"RESERVATION"
]
}
}
}
Completa i seguenti passaggi:
-
Sostituisci quanto segue:
PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza N1 con GPU T4 o V100.ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.NAME_PATTERN: il pattern del nome da utilizzare per le istanze N1 con GPU T4 o V100. Ad esempio, l'utilizzo diinstance-#per il pattern del nome genera istanze N1 con GPU T4 o V100 con nomi comeinstance-1einstance-2, fino al numero di istanze N1 con GPU T4 o V100 specificato da--count.COUNT: il numero di istanze N1 con GPU T4 o V100 da creare.MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza N1 con GPU T4 o V100. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.ACCELERATOR_COUNT: il numero di GPU che vuoi collegare alla VM N1. Per un elenco dei limiti delle GPU in base al tipo di macchina della VM, consulta le informazioni sulle GPU N1 nella documentazione di Compute Engine.ACCELERATOR_TYPE: il tipo di acceleratore per le VM N1 che vuoi utilizzare. Per i carichi di lavoro di AI, ti consigliamo di utilizzare GPU T4 o V100.DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specificatrueper attivare il riavvio automatico (impostazione predefinita) ofalseper disattivarlo.RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:ANY_RESERVATION(la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.SPECIFIC_RESERVATION(è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.
RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato perRESERVATION_AFFINITY:- Se hai specificato
ANY_RESERVATION, eliminaRESERVATIONin modo che il valore sia una stringa vuota (""). In alternativa, puoi rimuovere completamente i campikeyevalues. Se hai specificato
SPECIFIC_RESERVATION, sostituisciRESERVATIONcon quanto segue:projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME
Sostituisci quanto segue:
RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.RESERVATION_NAME: il nome della prenotazione.
- Se hai specificato
-
(Facoltativo) Per utilizzare i dischi SSD locali, aggiungi il seguente campo al campo
disks[]per ogni disco SSD locale. Separa ogni sottocampodisks[](incluso il disco di avvio) con una virgola.Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Sostituisci quanto segue:
ZONE: la zona specificata.INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specificaNVME. SpecificaSCSIper le altre immagini.
Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.
- Invia la richiesta.
On demand
Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"guestAccelerators":
[
{
"acceleratorCount": ACCELERATOR_COUNT,
"acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
}
],
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling": {
"provisioningModel": "STANDARD",
"onHostMaintenance": "TERMINATE",
"automaticRestart": AUTOMATIC_RESTART
},
"reservationAffinity": {
"consumeReservationType": "RESERVATION_AFFINITY"
}
}
}
Completa i seguenti passaggi:
-
Sostituisci quanto segue:
PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza N1 con GPU T4 o V100.ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.NAME_PATTERN: il pattern del nome da utilizzare per le istanze N1 con GPU T4 o V100. Ad esempio, l'utilizzo diinstance-#per il pattern del nome genera istanze N1 con GPU T4 o V100 con nomi comeinstance-1einstance-2, fino al numero di istanze N1 con GPU T4 o V100 specificato da--count.COUNT: il numero di istanze N1 con GPU T4 o V100 da creare.MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza N1 con GPU T4 o V100. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.ACCELERATOR_COUNT: il numero di GPU che vuoi collegare alla VM N1. Per un elenco dei limiti delle GPU in base al tipo di macchina della VM, consulta le informazioni sulle GPU N1 nella documentazione di Compute Engine.ACCELERATOR_TYPE: il tipo di acceleratore per le VM N1 che vuoi utilizzare. Per i carichi di lavoro di AI, ti consigliamo di utilizzare GPU T4 o V100.DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specificatrueper attivare il riavvio automatico (impostazione predefinita) ofalseper disattivarlo.RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:ANY_RESERVATION(la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.NO_RESERVATION(è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.
-
(Facoltativo) Per utilizzare i dischi SSD locali, aggiungi il seguente campo al campo
disks[]per ogni disco SSD locale. Separa ogni sottocampodisks[](incluso il disco di avvio) con una virgola.Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Sostituisci quanto segue:
ZONE: la zona specificata.INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specificaNVME. SpecificaSCSIper le altre immagini.
Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.
- Invia la richiesta.
Spot
Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.
POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
"namePattern": "NAME_PATTERN",
"count": "COUNT",
"instanceProperties": {
"machineType": "MACHINE_TYPE",
"guestAccelerators":
[
{
"acceleratorCount": ACCELERATOR_COUNT,
"acceleratorType": "projects/PROJECT_ID/zones/ZONE/acceleratorTypes/ACCELERATOR_TYPE"
}
],
"disks": [
{
"boot": true,
"initializeParams": {
"diskSizeGb": "DISK_SIZE",
"diskType": "DISK_TYPE",
"sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
},
"mode": "READ_WRITE",
"type": "PERSISTENT"
}
],
"serviceAccounts": [
{
"email": "default",
"scopes": [
"https://www.googleapis.com/auth/cloud-platform"
]
}
],
"scheduling":
{
"provisioningModel": "SPOT",
"instanceTerminationAction": "TERMINATION_ACTION",
"onHostMaintenance": "TERMINATE",
"automaticRestart": false
}
}
}
Completa i seguenti passaggi:
-
Sostituisci quanto segue:
PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza N1 con GPU T4 o V100.ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.NAME_PATTERN: il pattern del nome da utilizzare per le istanze N1 con GPU T4 o V100. Ad esempio, l'utilizzo diinstance-#per il pattern del nome genera istanze N1 con GPU T4 o V100 con nomi comeinstance-1einstance-2, fino al numero di istanze N1 con GPU T4 o V100 specificato da--count.COUNT: il numero di istanze N1 con GPU T4 o V100 da creare.MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza N1 con GPU T4 o V100. Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.ACCELERATOR_COUNT: il numero di GPU che vuoi collegare alla VM N1. Per un elenco dei limiti delle GPU in base al tipo di macchina della VM, consulta le informazioni sulle GPU N1 nella documentazione di Compute Engine.ACCELERATOR_TYPE: il tipo di acceleratore per le VM N1 che vuoi utilizzare. Per i carichi di lavoro di AI, ti consigliamo di utilizzare GPU T4 o V100.DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.DISK_TYPE: il tipo di disco di avvio. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo.IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati.TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovveroSTOP(impostazione predefinita) oDELETE.
-
(Facoltativo) Per utilizzare i dischi SSD locali, aggiungi il seguente campo al campo
disks[]per ogni disco SSD locale. Separa ogni sottocampodisks[](incluso il disco di avvio) con una virgola.Assicurati che il numero di dischi SSD locali che colleghi sia consentito per il tuo tipo di macchina. Per i dettagli, consulta Informazioni sui dischi SSD locali nella documentazione di Compute Engine.
{ "type": "SCRATCH", "initializeParams": { "diskType": "zones/ZONE/diskTypes/local-ssd" }, "autoDelete": true, "interface": "INTERFACE_TYPE" }Sostituisci quanto segue:
ZONE: la zona specificata.INTERFACE_TYPE: il tipo di interfaccia del disco che vuoi utilizzare per il disco SSD locale. Se l'immagine del disco di avvio ha driver NVMe ottimizzati, specificaNVME. SpecificaSCSIper le altre immagini.
Dopo aver creato una VM con dischi SSD locali, per poterla utilizzare devi prima formattare e montare ogni dispositivo.
- Invia la richiesta.
Per saperne di più sulle opzioni di configurazione durante la creazione di VM in blocco, consulta Crea VM in blocco nella documentazione di Compute Engine.
Installa i driver della GPU
Dopo aver creato un'istanza, questa non può utilizzare le GPU a meno che non siano già installati i driver GPU corretti. Il driver che devi installare dipende dal fatto che l'istanza abbia attivato NVIDIA RTX Virtual Workstation (vWS). Utilizza una delle seguenti opzioni:
- Se hai attivato vWS, consulta Installare i driver per le workstation virtuali (vWS) NVIDIA RTX nella documentazione di Compute Engine.
In caso contrario, utilizza i driver GPU predefiniti come segue:
- Se hai specificato un'immagine del sistema operativo che include i driver GPU, non è necessaria alcuna azione.
- Se l'immagine del sistema operativo non include i driver GPU, consulta la sezione Installare i driver GPU nella documentazione di Compute Engine.
Passaggi successivi
- Visualizza i dettagli di una VM
- Ottieni un elenco di VM
- Verifica il consumo della prenotazione
- Risolvi i problemi relativi al consumo delle prenotazioni)