Crea in blocco VM A3 High o A3 Mega ottimizzate per l'AI

Questo documento spiega come creare istanze di macchine virtuali (VM) in blocco che utilizzano tipi di macchine ottimizzati per l'acceleratore A3 High o A3 Mega. Per saperne di più sui tipi di macchina, consulta Informazioni sugli acceleratori GPU.

Per saperne di più sulla creazione di VM in blocco, consulta Informazioni sulla creazione in blocco delle VM nella documentazione di Compute Engine.

Per scoprire altri modi per creare VM o cluster, consulta la pagina Panoramica.

Limitazioni

Quando crei VM A3 High o A3 Mega in blocco, si applicano le seguenti limitazioni:

A3 High

A3 Mega

Prima di iniziare

Prima di creare VM in blocco, se non l'hai ancora fatto, completa i seguenti passaggi:

  1. Scegli un'opzione di consumo: la tua scelta determina come ottenere e utilizzare le risorse GPU. Per saperne di più, consulta Scegliere un'opzione di consumo.
  2. Ottenere capacità: la procedura per ottenere capacità varia a seconda dell'opzione di consumo. Per scoprire di più sulla procedura per ottenere la capacità per l'opzione di consumo scelta, consulta Panoramica della capacità.

Seleziona la scheda relativa a come prevedi di utilizzare gli esempi in questa pagina:

Console

Quando utilizzi la console Google Cloud per accedere ai servizi Google Cloud e alle API, non devi configurare l'autenticazione.

gcloud

Nella console Google Cloud , attiva Cloud Shell.

Attiva Cloud Shell

Nella parte inferiore della console Google Cloud viene avviata una sessione di Cloud Shell e viene visualizzato un prompt della riga di comando. Cloud Shell è un ambiente shell con Google Cloud CLI già installata e con valori già impostati per il progetto corrente. L'inizializzazione della sessione può richiedere alcuni secondi.

REST

Per utilizzare gli esempi di API REST in questa pagina in un ambiente di sviluppo locale, utilizzi le credenziali che fornisci a gcloud CLI.

    Installa Google Cloud CLI.

    Se utilizzi un provider di identità (IdP) esterno, devi prima accedere a gcloud CLI con la tua identità federata.

Per saperne di più, consulta Autenticati per usare REST nella documentazione sull'autenticazione di Google Cloud .

Ruoli obbligatori

Per ottenere le autorizzazioni necessarie per creare più VM contemporaneamente, chiedi all'amministratore di concederti il ruolo IAM Compute Instance Admin (v1) (roles/compute.instanceAdmin.v1) nel progetto. Per saperne di più sulla concessione dei ruoli, consulta Gestisci l'accesso a progetti, cartelle e organizzazioni.

Questo ruolo predefinito include le autorizzazioni necessarie per creare più VM contemporaneamente. Per visualizzare le autorizzazioni obbligatorie corrette, espandi l'omonima sezione:

Autorizzazioni obbligatorie

Per creare più VM contemporaneamente, sono necessarie le seguenti autorizzazioni:

  • compute.instances.create sul progetto
  • Per utilizzare un'immagine personalizzata per creare la VM: compute.images.useReadOnly sull'immagine
  • Per utilizzare uno snapshot per creare la VM: compute.snapshots.useReadOnly sullo snapshot
  • Per utilizzare un template di istanza per creare la VM: compute.instanceTemplates.useReadOnly sul template di istanza
  • Per specificare una subnet per la VM: compute.subnetworks.use sul progetto o sulla subnet scelta
  • Per specificare un indirizzo IP statico per la VM: compute.addresses.use sul progetto
  • Per assegnare un indirizzo IP esterno alla VM quando utilizzi una rete VPC: compute.subnetworks.useExternalIp sul progetto o sulla subnet scelta
  • Per assegnare una rete legacy alla VM: compute.networks.use sul progetto
  • Per assegnare un indirizzo IP esterno alla VM quando utilizzi una rete legacy: compute.networks.useExternalIp sul progetto
  • Per impostare i metadati dell'istanza VM per la VM: compute.instances.setMetadata sul progetto
  • Per impostare i tag per la VM: compute.instances.setTags sulla VM
  • Per impostare le etichette per la VM: compute.instances.setLabels sulla VM
  • Per impostare un service account che la VM possa utilizzare: compute.instances.setServiceAccount sulla VM
  • Per creare un nuovo disco per la VM: compute.disks.create sul progetto
  • Per collegare un disco esistente in modalità di sola lettura o di lettura e scrittura: compute.disks.use sul disco
  • Per collegare un disco esistente in modalità di sola lettura: compute.disks.useReadOnly sul disco

Potresti anche ottenere queste autorizzazioni con ruoli personalizzati o altri ruoli predefiniti.

Panoramica

La creazione di istanze in blocco con il tipo di macchina A3 Mega o A3 High (8 GPU) include i seguenti passaggi:

  1. Crea reti VPC
  2. (Facoltativo) Crea una policy di posizionamento compatto
  3. Creare istanze in blocco
  4. Installa i driver della GPU
  5. (Facoltativo) Attiva la modalità GPU multi-istanza NVIDIA

Crea reti VPC

Per consentire una comunicazione efficiente per le tue VM GPU, devi creare una rete di gestione e una o più reti di dati. La rete di gestione viene utilizzata per l'accesso esterno, ad esempio SSH, e per la maggior parte delle comunicazioni di rete generali. Le reti di dati vengono utilizzate per la comunicazione ad alte prestazioni tra le GPU su VM diverse, ad esempio per il traffico Remote Direct Memory Access (RDMA).

Per queste reti VPC, ti consigliamo di impostare l'unità massima di trasmissione (MTU) su un valore maggiore. Valori MTU più elevati aumentano le dimensioni dei pacchetti e riducono l'overhead delle intestazioni dei pacchetti, il che aumenta il throughput dei dati del payload. Per ulteriori informazioni su come creare reti VPC, consulta Crea e verifica una rete MTU con frame jumbo.

Crea una rete di gestione, una subnet e una regola firewall

Per configurare la rete di gestione, completa i seguenti passaggi:

  1. Crea la rete di gestione utilizzando il comando networks create:

    gcloud compute networks create NETWORK_NAME_PREFIX-mgmt-net \
        --project=PROJECT_ID \
        --subnet-mode=custom \
        --mtu=8244
    
  2. Crea la subnet di gestione utilizzando il comando networks subnets create:

    gcloud compute networks subnets create NETWORK_NAME_PREFIX-mgmt-sub \
        --project=PROJECT_ID \
        --network=NETWORK_NAME_PREFIX-mgmt-net \
        --region=REGION \
        --range=192.168.0.0/24
    
  3. Crea le regole firewall utilizzando il comando firewall-rules create.

    1. Crea una regola firewall per la rete di gestione.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-internal \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=tcp:0-65535,udp:0-65535,icmp \
          --source-ranges=192.168.0.0/16
      
    2. Crea la regola firewall tcp:22 per limitare gli indirizzi IP di origine che possono connettersi alla tua VM utilizzando SSH.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ssh \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=tcp:22 \
          --source-ranges=SSH_SOURCE_IP_RANGE
      
    3. Crea la regola firewall icmp che può essere utilizzata per verificare la presenza di problemi di trasmissione dei dati nella rete.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ping \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=icmp \
          --source-ranges=0.0.0.0/0
      

Sostituisci quanto segue:

  • NETWORK_NAME_PREFIX: il prefisso del nome da utilizzare per le reti VPC e le subnet.
  • PROJECT_ID: il tuo ID progetto.
  • REGION: la regione in cui vuoi creare le reti.
  • SSH_SOURCE_IP_RANGE: l'intervallo IP in formato CIDR. Questo specifica quali indirizzi IP di origine possono connettersi alla VM utilizzando SSH.

Crea reti dati, subnet e regole firewall

Il numero di reti di dati varia a seconda del tipo di macchina GPU che stai creando.

A3 Mega

A3 Mega richiede otto reti dati. Per creare otto reti dati, ciascuna con subnet e regole firewall, utilizza il seguente comando.

for N in $(seq 1 8); do
gcloud compute networks create NETWORK_NAME_PREFIX-data-net-$N \
    --project=PROJECT_ID \
    --subnet-mode=custom \
    --mtu=8244

gcloud compute networks subnets create NETWORK_NAME_PREFIX-data-sub-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --region=REGION \
    --range=192.168.$N.0/24

gcloud compute firewall-rules create NETWORK_NAME_PREFIX-data-internal-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --action=ALLOW \
    --rules=tcp:0-65535,udp:0-65535,icmp \
    --source-ranges=192.168.0.0/16
done

A3 High

A3 High richiede quattro reti di dati. Utilizza il seguente comando per creare quattro reti dati, ciascuna con subnet e regole firewall.

for N in $(seq 1 4); do
gcloud compute networks create NETWORK_NAME_PREFIX-data-net-$N \
    --project=PROJECT_ID \
    --subnet-mode=custom \
    --mtu=8244

gcloud compute networks subnets create NETWORK_NAME_PREFIX-data-sub-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --region=REGION \
    --range=192.168.$N.0/24

gcloud compute firewall-rules create NETWORK_NAME_PREFIX-data-internal-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --action=ALLOW \
    --rules=tcp:0-65535,udp:0-65535,icmp \
    --source-ranges=192.168.0.0/16
done
Se vuoi utilizzare una policy di posizionamento compatto, consulta le limitazioni per le policy di posizionamento.

(Facoltativo) Crea una policy di posizionamento compatto

Puoi specificare il posizionamento delle VM creando una policy di posizionamento compatto. Quando applichi una policy di posizionamento compatto alle tue VM, Compute Engine tenta al meglio di creare VM il più vicine possibile tra loro. Se la tua applicazione è sensibile alla latenza e richiede la massima compattezza, specifica il campo maxDistance (anteprima) quando crei una policy di posizionamento compatto. Un valore maxDistance inferiore garantisce un posizionamento più vicino delle VM, ma aumenta anche la probabilità che alcune VM non vengano create.

Per creare una policy di posizionamento compatto, seleziona una delle seguenti opzioni:

gcloud

Per creare una policy di posizionamento compatto, utilizza il comando gcloud beta compute resource-policies create group-placement:

gcloud beta compute resource-policies create group-placement POLICY_NAME \
    --collocation=collocated \
    --max-distance=MAX_DISTANCE \
    --region=REGION

Sostituisci quanto segue:

  • POLICY_NAME: il nome della policy di posizionamento compatto.
  • MAX_DISTANCE: la configurazione della distanza massima per le VM, che può essere specificata (anteprima, consigliata) o non specificata (rimuovi il flag --max-distance). In base a ciò che supporta il tipo di macchina, puoi specificare uno dei seguenti valori:
    • Per posizionare le VM nello stesso blocco secondario: 1
    • Per posizionare le VM nello stesso blocco: 2
    • Per posizionare le VM in blocchi adiacenti: 3
    Assicurati che la configurazione della distanza massima supporti la serie di macchine e il numero di VM che prevedi di creare. Per saperne di più, consulta Informazioni sulle policy di posizionamento compatto nella documentazione di Compute Engine.
  • REGION: la regione in cui vuoi creare la policy di posizionamento compatto. Specifica la regione che contiene la zona in cui prevedi di creare istanze e verifica che il tipo di macchina che vuoi utilizzare sia disponibile in quella regione. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.

REST

Per creare una policy di posizionamento compatto, invia una richiesta POST al metodo resourcePolicies.insert beta. Nel corpo della richiesta, includi il campo collocation impostato su COLLOCATED e il campo maxDistance.

POST https://compute.googleapis.com/compute/beta/projects/PROJECT_ID/regions/REGION/resourcePolicies
  {
    "name": "POLICY_NAME",
    "groupPlacementPolicy": {
      "collocation": "COLLOCATED",
      "maxDistance": MAX_DISTANCE
    }
  }

Sostituisci quanto segue:

  • PROJECT_ID: il tuo ID progetto.
  • POLICY_NAME: il nome della policy di posizionamento compatto.
  • MAX_DISTANCE: la configurazione della distanza massima per le VM, che può essere specificata (anteprima, consigliata) o non specificata (rimuovi il campo maxDistance). In base a ciò che supporta il tipo di macchina, puoi specificare uno dei seguenti valori:
    • Per posizionare le VM nello stesso blocco secondario: 1
    • Per posizionare le VM nello stesso blocco: 2
    • Per posizionare le VM in blocchi adiacenti: 3
    Assicurati che la configurazione della distanza massima supporti la serie di macchine e il numero di VM che prevedi di creare. Per saperne di più, consulta Informazioni sulle policy di posizionamento compatto nella documentazione di Compute Engine.
  • REGION: la regione in cui vuoi creare la policy di posizionamento compatto. Specifica la regione che contiene la zona in cui prevedi di creare istanze e verifica che il tipo di macchina che vuoi utilizzare sia disponibile in quella regione. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.

Crea VM A3 High o A3 Mega collettivamente

Per creare più VM A3 High o A3 Mega contemporaneamente, utilizza uno dei seguenti metodi.

I seguenti comandi impostano anche l'ambito di accesso per le tue istanze. Per semplificare la gestione delle autorizzazioni, Google consiglia di impostare l'ambito di accesso di un'istanza su cloud-platform e poi utilizzare i ruoli IAM per definire i servizi a cui l'istanza può accedere. Per saperne di più, consulta le best practice per gli ambiti.

gcloud

Seleziona una delle seguenti opzioni per la serie di macchine.

A3 Mega

Per creare istanze in blocco, utilizza il comando gcloud compute instances bulk create.

I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.

Prenotazione

Le istanze A3 Mega o A3 High (8 GPU) supportano più modelli di provisioning per le prenotazioni. Seleziona la scheda corrispondente al tipo di prenotazione che vuoi utilizzare.

  • Utilizza i parametri Con prenotazione, che specificano il modello di provisioning con prenotazione, per quanto segue:

    • Prenotazioni future in AI Hypercomputer
    • Prenotazioni future in modalità calendario
  • Utilizza i parametri Prenotazione standard, che specificano il modello di provisioning standard, per quanto segue:

    • Prenotazioni on demand
    • Prenotazioni future standard

Con prenotazione

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --reservation-affinity=specific \
    --reservation=RESERVATION \
    --provisioning-model=RESERVATION_BOUND \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --restart-on-failure

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • RESERVATION: il nome della prenotazione o un blocco specifico all'interno di una prenotazione. Per ottenere il nome della prenotazione o i blocchi disponibili, vedi Visualizzare la capacità riservata. In base al tuo requisito per il posizionamento dell'istanza, scegli una delle seguenti opzioni:
      • Per creare istanze in più blocchi o in un singolo blocco:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Inoltre, per un singolo blocco, applica una policy di posizionamento compatto che specifica una collocazione di blocchi (maxDistance=2) . Compute Engine applica quindi la policy alla prenotazione e crea istanze sullo stesso blocco.

      • Per creare istanze su un blocco specifico:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME
    • TERMINATION_ACTION: indica se Compute Engine arresta (STOP) o elimina (DELETE) l'istanza A3 Mega o A3 High (8 GPU) al termine del periodo di prenotazione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Esegui il comando.

Su prenotazione standard

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • any (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • specific (è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.

    • RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato per RESERVATION_AFFINITY:

      • Se hai specificato any, sostituisci RESERVATION con una stringa vuota (""). In alternativa, puoi rimuovere completamente il flag --reservation.
      • Se hai specificato specific, sostituisci RESERVATION con quanto segue:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Sostituisci quanto segue:

        • RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.
        • RESERVATION_NAME: il nome della prenotazione.
  2. Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:

    --no-restart-on-failure
  3. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  4. Esegui il comando.

On demand

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • any (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • none (è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.

  2. Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:

    --no-restart-on-failure
  3. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  4. Esegui il comando.

Spot

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovvero STOP (impostazione predefinita) o DELETE.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Esegui il comando.

A3 High

Per creare istanze in blocco, utilizza il comando gcloud compute instances bulk create.

I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.

Prenotazione

Le istanze A3 Mega o A3 High (8 GPU) supportano più modelli di provisioning per le prenotazioni. Seleziona la scheda corrispondente al tipo di prenotazione che vuoi utilizzare.

  • Utilizza i parametri Con prenotazione, che specificano il modello di provisioning con prenotazione, per quanto segue:

    • Prenotazioni future in AI Hypercomputer
    • Prenotazioni future in modalità calendario
  • Utilizza i parametri Prenotazione standard, che specificano il modello di provisioning standard, per quanto segue:

    • Prenotazioni on demand
    • Prenotazioni future standard

Con prenotazione

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --reservation-affinity=specific \
    --reservation=RESERVATION \
    --provisioning-model=RESERVATION_BOUND \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --restart-on-failure

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • RESERVATION: il nome della prenotazione o un blocco specifico all'interno di una prenotazione. Per ottenere il nome della prenotazione o i blocchi disponibili, vedi Visualizzare la capacità riservata. In base al tuo requisito per il posizionamento dell'istanza, scegli una delle seguenti opzioni:
      • Per creare istanze in più blocchi o in un singolo blocco:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Inoltre, per un singolo blocco, applica una policy di posizionamento compatto che specifica una collocazione di blocchi (maxDistance=2) . Compute Engine applica quindi la policy alla prenotazione e crea istanze sullo stesso blocco.

      • Per creare istanze su un blocco specifico:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME
    • TERMINATION_ACTION: indica se Compute Engine arresta (STOP) o elimina (DELETE) l'istanza A3 Mega o A3 High (8 GPU) al termine del periodo di prenotazione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Esegui il comando.

Su prenotazione standard

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • any (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • specific (è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.

    • RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato per RESERVATION_AFFINITY:

      • Se hai specificato any, sostituisci RESERVATION con una stringa vuota (""). In alternativa, puoi rimuovere completamente il flag --reservation.
      • Se hai specificato specific, sostituisci RESERVATION con quanto segue:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Sostituisci quanto segue:

        • RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.
        • RESERVATION_NAME: il nome della prenotazione.
  2. Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:

    --no-restart-on-failure
  3. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  4. Esegui il comando.

On demand

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • any (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, il che si verifica solo se è disponibile la capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • none (è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.

  2. Per impostazione predefinita, l'istanza viene riavviata automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Se vuoi disattivare il riavvio automatico, aggiungi il seguente flag:

    --no-restart-on-failure
  3. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  4. Esegui il comando.

Spot

Prima di eseguire il comando, esamina tutti i passaggi seguenti per determinare se includere flag aggiuntivi.

gcloud compute instances bulk create \
    --name-pattern=NAME_PATTERN \
    --count=COUNT \
     --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --region=REGION \
    --boot-disk-type=DISK_TYPE \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • REGION: specifica una regione in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare la stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, consulta la sezione Disponibilità delle GPU per regioni e zone.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovvero STOP (impostazione predefinita) o DELETE.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente flag al comando:

    --resource-policies=POLICY_NAME
    

    Sostituisci quanto segue:

    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Esegui il comando.

REST

Seleziona una delle seguenti opzioni per la serie di macchine.

A3 Mega

Per creare istanze in blocco, invia una richiesta POST al metodo instances.bulkInsert.

I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.

Prenotazione

Le istanze A3 Mega o A3 High (8 GPU) supportano più modelli di provisioning per le prenotazioni. Seleziona la scheda corrispondente al tipo di prenotazione che vuoi utilizzare.

  • Utilizza i parametri Con prenotazione, che specificano il modello di provisioning con prenotazione, per quanto segue:

    • Prenotazioni future in AI Hypercomputer
    • Prenotazioni future in modalità calendario
  • Utilizza i parametri Prenotazione standard, che specificano il modello di provisioning standard, per quanto segue:

    • Prenotazioni on demand
    • Prenotazioni future standard

Con prenotazione

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      },
    "reservationAffinity": {
        "consumeReservationType": "SPECIFIC_RESERVATION",
        "key": "compute.googleapis.com/reservation-name",
        "values": [
          "RESERVATION"
        ]
      },
    "scheduling": {
        "provisioningModel": "RESERVATION_BOUND",
        "instanceTerminationAction": "DELETE",
        "onHostMaintenance": "TERMINATE",
        "automaticRestart": true
      }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • RESERVATION: il nome della prenotazione o un blocco specifico all'interno di una prenotazione. Per ottenere il nome della prenotazione o i blocchi disponibili, vedi Visualizzare la capacità riservata. In base al tuo requisito per il posizionamento dell'istanza, scegli una delle seguenti opzioni:
      • Per creare istanze in più blocchi o in un singolo blocco:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Inoltre, per un singolo blocco, applica una policy di posizionamento compatto che specifica una collocazione di blocchi (maxDistance=2) . Compute Engine applica quindi la policy alla prenotazione e crea istanze sullo stesso blocco.

      • Per creare istanze su un blocco specifico:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME
    • TERMINATION_ACTION: indica se Compute Engine arresta (STOP) o elimina (DELETE) l'istanza A3 Mega o A3 High (8 GPU) al termine del periodo di prenotazione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

Su prenotazione standard

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      },
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specifica true per attivare il riavvio automatico (impostazione predefinita) o false per disattivarlo.

    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • ANY_RESERVATION (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • SPECIFIC_RESERVATION (è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.

    • RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato per RESERVATION_AFFINITY:

      • Se hai specificato ANY_RESERVATION, elimina RESERVATION in modo che il valore sia una stringa vuota (""). In alternativa, puoi rimuovere completamente i campi key e values.
      • Se hai specificato SPECIFIC_RESERVATION, sostituisci RESERVATION con quanto segue:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Sostituisci quanto segue:

        • RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.
        • RESERVATION_NAME: il nome della prenotazione.
  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

On demand

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      },
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specifica true per attivare il riavvio automatico (impostazione predefinita) o false per disattivarlo.

    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • ANY_RESERVATION (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • NO_RESERVATION (è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

Spot

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      },
    "scheduling":
    {
      "provisioningModel": "SPOT",
      "instanceTerminationAction": "TERMINATION_ACTION",
      "onHostMaintenance": "TERMINATE",
      "automaticRestart": false
    }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o versioni successive oppure utilizza rocky-linux-accelerator-cloud per l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 Mega, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o versioni successive e di disattivare gli aggiornamenti automatici oppure di utilizzare l'immagine Rocky Linux rocky-linux-8-optimized-gcp-nvidia-580.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovvero STOP (impostazione predefinita) o DELETE.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

A3 High

Per creare istanze in blocco, invia una richiesta POST al metodo instances.bulkInsert.

I parametri da specificare dipendono dall'opzione di consumo che utilizzi per questo deployment. Seleziona la scheda corrispondente all'opzione di consumo.

Prenotazione

Le istanze A3 Mega o A3 High (8 GPU) supportano più modelli di provisioning per le prenotazioni. Seleziona la scheda corrispondente al tipo di prenotazione che vuoi utilizzare.

  • Utilizza i parametri Con prenotazione, che specificano il modello di provisioning con prenotazione, per quanto segue:

    • Prenotazioni future in AI Hypercomputer
    • Prenotazioni future in modalità calendario
  • Utilizza i parametri Prenotazione standard, che specificano il modello di provisioning standard, per quanto segue:

    • Prenotazioni on demand
    • Prenotazioni future standard

Con prenotazione

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
    "reservationAffinity": {
        "consumeReservationType": "SPECIFIC_RESERVATION",
        "key": "compute.googleapis.com/reservation-name",
        "values": [
          "RESERVATION"
        ]
      },
    "scheduling": {
        "provisioningModel": "RESERVATION_BOUND",
        "instanceTerminationAction": "DELETE",
        "onHostMaintenance": "TERMINATE",
        "automaticRestart": true
      }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • RESERVATION: il nome della prenotazione o un blocco specifico all'interno di una prenotazione. Per ottenere il nome della prenotazione o i blocchi disponibili, vedi Visualizzare la capacità riservata. In base al tuo requisito per il posizionamento dell'istanza, scegli una delle seguenti opzioni:
      • Per creare istanze in più blocchi o in un singolo blocco:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Inoltre, per un singolo blocco, applica una policy di posizionamento compatto che specifica una collocazione di blocchi (maxDistance=2) . Compute Engine applica quindi la policy alla prenotazione e crea istanze sullo stesso blocco.

      • Per creare istanze su un blocco specifico:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME
    • TERMINATION_ACTION: indica se Compute Engine arresta (STOP) o elimina (DELETE) l'istanza A3 Mega o A3 High (8 GPU) al termine del periodo di prenotazione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

Su prenotazione standard

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specifica true per attivare il riavvio automatico (impostazione predefinita) o false per disattivarlo.

    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • ANY_RESERVATION (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • SPECIFIC_RESERVATION (è richiesta la capacità di prenotazione): richiede che l'istanza utilizzi la capacità di una prenotazione con target specifico. L'istanza non è autorizzata a utilizzare la capacità on demand. Se la capacità di prenotazione non è disponibile, la creazione dell'istanza non riesce.

    • RESERVATION: la prenotazione da utilizzare. Specifica uno dei seguenti valori in base al valore specificato per RESERVATION_AFFINITY:

      • Se hai specificato ANY_RESERVATION, elimina RESERVATION in modo che il valore sia una stringa vuota (""). In alternativa, puoi rimuovere completamente i campi key e values.
      • Se hai specificato SPECIFIC_RESERVATION, sostituisci RESERVATION con quanto segue:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Sostituisci quanto segue:

        • RESERVATION_OWNER_PROJECT_ID: l'ID progetto del progetto in cui è stata creata la prenotazione.
        • RESERVATION_NAME: il nome della prenotazione.
  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

On demand

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • AUTOMATIC_RESTART: se l'istanza si riavvia automaticamente in caso di arresto anomalo o se Compute Engine la arresta per un arresto programmato, ad esempio un evento di manutenzione. Specifica true per attivare il riavvio automatico (impostazione predefinita) o false per disattivarlo.

    • RESERVATION_AFFINITY: le prenotazioni che l'istanza può utilizzare, se possibile. Specifica una delle seguenti opzioni:

      • ANY_RESERVATION (la capacità di prenotazione è facoltativa): questa è l'opzione predefinita. L'istanza tenta di utilizzare la capacità di una prenotazione consumata automaticamente, cosa che si verifica solo se è disponibile una capacità di prenotazione corrispondente. In caso contrario, l'istanza utilizza la capacità on demand.

      • NO_RESERVATION (è necessaria la capacità on demand): impedisci all'istanza di utilizzare qualsiasi capacità di prenotazione.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

Spot

Prima di inviare la richiesta, esamina tutti i passaggi seguenti per determinare se includere campi aggiuntivi.

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instances/bulkInsert
{
  "namePattern": "NAME_PATTERN",
  "count": "COUNT",
  "instanceProperties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "DISK_TYPE",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
    "scheduling":
    {
      "provisioningModel": "SPOT",
      "instanceTerminationAction": "TERMINATION_ACTION",
      "onHostMaintenance": "TERMINATE",
      "automaticRestart": false
    }
  }
}

Completa i seguenti passaggi:

  1. Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto del progetto in cui vuoi creare l'istanza A3 Mega o A3 High (8 GPU).
    • ZONE: specifica una zona in cui è disponibile il tipo di macchina che vuoi utilizzare. Se vuoi specificare una policy di posizionamento compatto, devi utilizzare una zona nella stessa regione della policy di posizionamento compatto. Per informazioni sulle regioni, vedi Disponibilità delle GPU per regioni e zone.
    • NAME_PATTERN: il pattern del nome da utilizzare per le istanze A3 Mega o A3 High (8 GPU). Ad esempio, l'utilizzo di instance-# per il pattern del nome genera istanze A3 Mega o A3 High (8 GPU) con nomi come instance-1 e instance-2, fino al numero di istanze A3 Mega o A3 High (8 GPU) specificato da --count.
    • COUNT: il numero di istanze A3 Mega o A3 High (8 GPU) da creare.
    • MACHINE_TYPE: il tipo di macchina da utilizzare per l'istanza A3 Mega o A3 High (8 GPU). Per saperne di più, consulta Tipi di macchine GPU nella documentazione di Compute Engine.
    • DISK_SIZE: le dimensioni del disco di avvio in GB. Per ulteriori informazioni, consulta Limiti di dimensioni di Google Cloud Hyperdisk o Limiti di dimensioni di Persistent Disk in base al tipo di disco.
    • DISK_TYPE: il tipo di disco di avvio. Per questa serie di macchine, ti consigliamo di utilizzare hyperdisk-balanced. Per saperne di più sui tipi di dischi supportati per il tuo tipo di macchina, consulta Macchine GPU nella famiglia di macchine ottimizzate per l'acceleratore nella documentazione di Compute Engine.
    • IMAGE_PROJECT: l'ID progetto dell'immagine del sistema operativo. Ad esempio, utilizza cos-cloud per l'immagine Container-Optimized OS cos-121-lts o successiva.
    • IMAGE_FAMILY: la famiglia di immagini dell'immagine del sistema operativo che vuoi utilizzare. Per un elenco di tutti i sistemi operativi supportati, vedi Sistemi operativi supportati. Per la serie di macchine A3 High, ti consigliamo vivamente di utilizzare l'immagine Container-Optimized OS cos-121-lts o successiva e di disattivare gli aggiornamenti automatici.
    • NETWORK_PROJECT_ID: l'ID progetto della rete.
    • GVNIC_NAME_PREFIX: il prefisso del nome specificato durante la creazione delle reti VPC e delle subnet standard che utilizzano le NIC gVNIC.
    • REGION: la regione della subnet.
    • TERMINATION_ACTION: l'azione da intraprendere quando Compute Engine prerilascia l'istanza, ovvero STOP (impostazione predefinita) o DELETE.

  2. (Facoltativo) Se hai scelto di utilizzare una policy di posizionamento compatto, aggiungi il seguente campo secondario instanceProperties al corpo della richiesta:

        "resourcePolicies": [
          "projects/PROJECT_ID/regions/REGION/resourcePolicies/POLICY_NAME"
        ]
    

    Sostituisci quanto segue:

    • PROJECT_ID: l'ID progetto della policy di posizionamento compatto.
    • REGION: la regione della policy di posizionamento compatto.
    • POLICY_NAME: il nome della policy di posizionamento compatto.
  3. Invia la richiesta.

Per saperne di più sulle opzioni di configurazione durante la creazione di VM in blocco, consulta Crea VM in blocco nella documentazione di Compute Engine.

Installa i driver della GPU

Dopo aver creato un'istanza, questa non può utilizzare le GPU a meno che non siano già installati i driver GPU corretti. Se non hai specificato un'immagine del sistema operativo che include i driver GPU, consulta la sezione Installare i driver GPU nella documentazione di Compute Engine.

(Facoltativo) Attiva la modalità GPU multi-istanza NVIDIA

La modalità GPU multi-istanza (MIG) è una funzionalità che puoi attivare per una GPU NVIDIA supportata. Dopo aver creato un'istanza, puoi attivare la modalità MIG su una singola GPU collegata alla tua macchina. Con la modalità MIG attivata, la singola GPU viene partizionata in un massimo di sette istanze GPU indipendenti. Ogni istanza viene eseguita contemporaneamente, ognuna con la propria memoria, cache e multiprocessori streaming. Puoi quindi eseguire in parallelo diversi carichi di lavoro su queste istanze GPU. Per ulteriori informazioni sull'utilizzo della modalità MIG, consulta la Guida dell'utente per le GPU multi-istanza (MIG) nella documentazione NVIDIA.

Passaggi successivi