KI-optimierte A3 High- oder A3 Mega-MIG erstellen

In diesem Dokument wird beschrieben, wie Sie eine verwaltete Instanzgruppe (MIG) erstellen, die einen beschleunigungsoptimierten Maschinentyp vom Typ „A3 High“ oder „A3 Mega“ verwendet. Weitere Informationen zu den Maschinentypen finden Sie unter GPU-Beschleuniger.

Wenn Sie eine MIG erstellen, können Sie mehrere VMs als eine einzelne Entität verwalten. Jede VM in einer MIG basiert auf einer Instanzvorlage. Durch die automatische Verwaltung der VMs in der Gruppe bieten MIGs Hochverfügbarkeit und Skalierbarkeit. Weitere Informationen zu verwalteten Instanzgruppen finden Sie in der Compute Engine-Dokumentation unter Verwaltete Instanzgruppen.

Weitere Informationen zum Erstellen von VMs oder Clustern finden Sie unter Übersicht über Bereitstellungsoptionen.

Beschränkungen

Wenn Sie eine MIG mit A3 Mega- oder A3 High-VMs erstellen, sollten Sie die Einschränkungen für den Maschinentyp und die MIG berücksichtigen.

Einschränkungen für A3 Mega- oder A3 High-VMs

Je nach Maschinenserie, die von den VMs in Ihrer MIG verwendet wird, gelten die folgenden Einschränkungen:

A3 Mega

A3 High

Beschränkungen für die MIG

Wenn Sie eine MIG mit A3 Mega- oder A3 High-VMs erstellen, gelten die folgenden Einschränkungen:

  • Sie müssen Reparaturen in der MIG deaktivieren, wie in diesem Dokument beschrieben.

+ Wenn Sie eine regionale MIG erstellen, die RDMA-Netzwerke verwendet, können mit der MIG nur A3-Mega- oder A3-High-Instanzen in der Zone erstellt werden, in der Sie das Netzwerkprofil für RDMA konfiguriert haben.

Beschränkungen für Anfragen zur Größenänderung in MIGs

Für Anfragen zur Größenänderung von MIGs gelten die folgenden Einschränkungen:

Weitere Informationen zu allen Einschränkungen für Anfragen zur Größenänderung

Hinweis

Führen Sie vor dem Erstellen einer MIG die folgenden Schritte aus, sofern Sie dies noch nicht getan haben:

  1. Nutzungsoption auswählen: Die von Ihnen gewählte Nutzungsoption bestimmt, wie Sie GPU-Ressourcen erhalten und verwenden. Weitere Informationen finden Sie unter Nutzungsoption auswählen.
  2. Kapazität abrufen: Der Vorgang zum Abrufen von Kapazität unterscheidet sich für jede Verbrauchsoption. Informationen zum Erhalten von Kapazität für die von Ihnen gewählte Verbrauchsoption finden Sie unter Kapazitätsübersicht.

Erforderliche Rollen

Um die Berechtigungen zu erhalten, die Sie zum Erstellen einer MIG benötigen, bitten Sie Ihren Administrator, Ihnen die IAM-Rolle Compute Instance Admin (v1) (roles/compute.instanceAdmin.v1) für das Projekt zu gewähren. Weitere Informationen zum Zuweisen von Rollen finden Sie unter Zugriff auf Projekte, Ordner und Organisationen verwalten.

Diese vordefinierte Rolle enthält die Berechtigungen, die zum Erstellen einer MIG erforderlich sind. Maximieren Sie den Abschnitt Erforderliche Berechtigungen, um die notwendigen Berechtigungen anzuzeigen:

Erforderliche Berechtigungen

Die folgenden Berechtigungen sind zum Erstellen einer MIG erforderlich:

  • So erstellen Sie eine MIG: compute.instanceGroupManagers.create für das Projekt

Sie können diese Berechtigungen auch mit benutzerdefinierten Rollen oder anderen vordefinierten Rollen erhalten.

Übersicht

Das Erstellen einer MIG mit dem Maschinentyp „A3 Mega“ oder „A3 High“ (8 GPUs) umfasst die folgenden Schritte:

  1. VPC-Netzwerke erstellen
  2. Optional: Arbeitslastrichtlinie erstellen
  3. Instanzvorlage erstellen
  4. Eine MIG erstellen
  5. GPU-Treiber installieren
  6. Optional: NVIDIA-GPU-Modus mit mehreren Instanzen aktivieren

VPC-Netzwerke erstellen

Damit die Kommunikation für Ihre GPU-VMs effizient ist, müssen Sie ein Verwaltungsnetzwerk und ein oder mehrere Datennetzwerke erstellen. Das Verwaltungsnetzwerk wird für den externen Zugriff, z. B. SSH, und für die meisten allgemeinen Netzwerkkommunikationen verwendet. Die Datennetzwerke werden für die leistungsstarke Kommunikation zwischen den GPUs auf verschiedenen VMs verwendet, z. B. für RDMA-Traffic (Remote Direct Memory Access).

Für diese VPC-Netzwerke empfehlen wir, die maximale Übertragungseinheit (Maximum Transmission Unit, MTU) auf einen höheren Wert festzulegen. Höhere MTU-Werte steigern die Paketgröße und reduzieren den Paketheader-Overhead, wodurch der Nutzlastdatendurchsatz erhöht wird. Weitere Informationen zum Erstellen von VPC-Netzwerken finden Sie unter MTU-Netzwerk im Jumbo Frame erstellen und prüfen.

Verwaltungsnetzwerk, Subnetz und Firewallregel erstellen

Führen Sie die folgenden Schritte aus, um das Verwaltungsnetzwerk einzurichten:

  1. Erstellen Sie das Verwaltungsnetzwerk mit dem Befehl networks create:

    gcloud compute networks create NETWORK_NAME_PREFIX-mgmt-net \
        --project=PROJECT_ID \
        --subnet-mode=custom \
        --mtu=8244
    
  2. Erstellen Sie das Verwaltungssubnetz mit dem Befehl networks subnets create:

    gcloud compute networks subnets create NETWORK_NAME_PREFIX-mgmt-sub \
        --project=PROJECT_ID \
        --network=NETWORK_NAME_PREFIX-mgmt-net \
        --region=REGION \
        --range=192.168.0.0/24
    
  3. Erstellen Sie Firewallregeln mit dem Befehl firewall-rules create.

    1. Erstellen Sie eine Firewallregel für das Verwaltungsnetzwerk.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-internal \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=tcp:0-65535,udp:0-65535,icmp \
          --source-ranges=192.168.0.0/16
      
    2. Erstellen Sie die Firewallregel tcp:22, um einzuschränken, welche Quell-IP-Adressen eine SSH-Verbindung zu Ihrer VM herstellen können.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ssh \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=tcp:22 \
          --source-ranges=SSH_SOURCE_IP_RANGE
      
    3. Erstellen Sie die Firewallregel icmp, mit der Sie nach Problemen mit der Datenübertragung im Netzwerk suchen können.

      gcloud compute firewall-rules create NETWORK_NAME_PREFIX-mgmt-external-ping \
          --project=PROJECT_ID \
          --network=NETWORK_NAME_PREFIX-mgmt-net \
          --action=ALLOW \
          --rules=icmp \
          --source-ranges=0.0.0.0/0
      

Ersetzen Sie Folgendes:

  • NETWORK_NAME_PREFIX: Das Namenspräfix, das für die VPC-Netzwerke und -Subnetze verwendet werden soll.
  • PROJECT_ID: Ihre Projekt-ID.
  • REGION: Die Region, in der Sie die Netzwerke erstellen möchten.
  • SSH_SOURCE_IP_RANGE: IP-Bereich im CIDR-Format. Hier wird angegeben, welche Quell-IP-Adressen über SSH eine Verbindung zu Ihrer VM herstellen können.

Datennetzwerke, Subnetze und Firewallregeln erstellen

Die Anzahl der Datennetzwerke variiert je nach Art der GPU-Maschine, die Sie erstellen.

A3 Mega

Für A3 Mega sind acht Datennetzwerke erforderlich. Verwenden Sie den folgenden Befehl, um acht Datennetzwerke jeweils mit Subnetzen und Firewallregeln zu erstellen.

for N in $(seq 1 8); do
gcloud compute networks create NETWORK_NAME_PREFIX-data-net-$N \
    --project=PROJECT_ID \
    --subnet-mode=custom \
    --mtu=8244

gcloud compute networks subnets create NETWORK_NAME_PREFIX-data-sub-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --region=REGION \
    --range=192.168.$N.0/24

gcloud compute firewall-rules create NETWORK_NAME_PREFIX-data-internal-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --action=ALLOW \
    --rules=tcp:0-65535,udp:0-65535,icmp \
    --source-ranges=192.168.0.0/16
done

A3 High

Für A3 High sind vier Datennetzwerke erforderlich. Verwenden Sie den folgenden Befehl, um vier Datennetzwerke jeweils mit Subnetzen und Firewallregeln zu erstellen.

for N in $(seq 1 4); do
gcloud compute networks create NETWORK_NAME_PREFIX-data-net-$N \
    --project=PROJECT_ID \
    --subnet-mode=custom \
    --mtu=8244

gcloud compute networks subnets create NETWORK_NAME_PREFIX-data-sub-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --region=REGION \
    --range=192.168.$N.0/24

gcloud compute firewall-rules create NETWORK_NAME_PREFIX-data-internal-$N \
    --project=PROJECT_ID \
    --network=NETWORK_NAME_PREFIX-data-net-$N \
    --action=ALLOW \
    --rules=tcp:0-65535,udp:0-65535,icmp \
    --source-ranges=192.168.0.0/16
done

Optional: Arbeitslastrichtlinie erstellen

Wenn Sie möchten, dass Ihre VMs in einem einzelnen oder angrenzenden Block platziert werden, geben Sie die VM-Platzierung an, indem Sie eine Arbeitslastrichtlinie erstellen. Wenn Sie jedoch möchten, dass Compute Engine Ihre VMs in einem bestimmten Block platziert, überspringen Sie diesen Schritt und geben Sie den Namen des Blocks in der Reservierungsaffinität an, wenn Sie die Instanzvorlage erstellen.

Wählen Sie eine der folgenden Optionen aus, um eine Arbeitslastrichtlinie zu erstellen:

gcloud

Verwenden Sie zum Erstellen einer Workload-Richtlinie den Befehl gcloud compute resource-policies create workload-policy.

  • Wenn Sie eine Best-Effort-Platzierung von VMs wünschen, geben Sie das Flag --type=high-throughput im Befehl an:

    gcloud compute resource-policies create workload-policy WORKLOAD_POLICY_NAME \
        --type=high-throughput \
        --region=REGION
    
  • Wenn Sie VMs strikt gemeinsam platzieren möchten, geben Sie die Flags --max-topology-distance und --type=high-throughput im Befehl an:

    gcloud compute resource-policies create workload-policy WORKLOAD_POLICY_NAME \
        --type=high-throughput \
        --max-topology-distance=TOPOLOGY_DISTANCE \
        --region=REGION
    

Ersetzen Sie Folgendes:

  • WORKLOAD_POLICY_NAME: Der Name der Arbeitslastrichtlinie.
  • TOPOLOGY_DISTANCE: Der maximale Topologieabstand. Geben Sie einen der folgenden Werte an:
    • So platzieren Sie VMs im selben Block: BLOCK
    • So platzieren Sie VMs im selben Cluster: CLUSTER
    Hinweis:Ein kürzerer maximaler Abstand kann die Wahrscheinlichkeit der VM-Verfügbarkeit verringern. Weitere Informationen finden Sie unter Attribut „Maximaler Topologieabstand“.
  • REGION: Die Region, in der Sie die Arbeitslastrichtlinie erstellen möchten. Geben Sie eine Region an, in der Sie die MIG erstellen möchten und in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.

REST

Senden Sie zum Erstellen einer Arbeitslastrichtlinie eine POST-Anfrage an die Methode resourcePolicies.insert.

  • Wenn Sie eine Best-Effort-Platzierung von VMs wünschen, geben Sie das Feld type in der Anfrage so an:

    POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/resourcePolicies
      {
        "name": "WORKLOAD_POLICY_NAME"
        "workloadPolicy": {
          "type": "HIGH_THROUGHPUT"
        }
      }
    
  • Wenn Sie VMs strikt nebeneinander platzieren möchten, geben Sie die Felder maxTopologyDistance und type in der Anfrage so an:

    POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/resourcePolicies
      {
        "name": "WORKLOAD_POLICY_NAME"
        "workloadPolicy": {
          "type": "HIGH_THROUGHPUT",
          "maxTopologyDistance": "TOPOLOGY_DISTANCE"
        }
      }
    

Ersetzen Sie Folgendes:

  • PROJECT_ID: Ihre Projekt-ID.
  • REGION: Die Region, in der Sie die Arbeitslastrichtlinie erstellen möchten. Geben Sie eine Region an, in der Sie die MIG erstellen möchten und in der der Maschinentyp verfügbar ist, den Sie verwenden möchten. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • WORKLOAD_POLICY_NAME: Der Name der Arbeitslastrichtlinie.
  • TOPOLOGY_DISTANCE: Der maximale Topologieabstand. Geben Sie einen der folgenden Werte an:
    • So platzieren Sie VMs im selben Block: BLOCK
    • VMs im selben Cluster platzieren: CLUSTER
    Hinweis:Ein kürzerer maximaler Abstand kann die Wahrscheinlichkeit der VM-Verfügbarkeit verringern. Weitere Informationen finden Sie unter Attribut „Maximaler Topologieabstand“.

Instanzvorlage erstellen

Geben Sie die VM-Attribute für eine MIG an, indem Sie eine Instanzvorlage erstellen.

Wählen Sie eine der folgenden Optionen aus, um eine Instanzvorlage zu erstellen:

Mit den folgenden Befehlen wird auch der Zugriffsbereich für Ihre Instanzen festgelegt. Um die Berechtigungsverwaltung zu vereinfachen, empfiehlt Google, den Zugriffsbereich für eine Instanz auf cloud-platform-Zugriff festzulegen und dann mit IAM-Rollen zu definieren, auf welche Dienste die Instanz zugreifen kann. Weitere Informationen finden Sie unter Best Practices für Bereiche.

A3 Mega

Wenn Sie eine Instanzvorlage für A3 Mega-VMs erstellen möchten, müssen Sie acht zusätzliche Netzwerkschnittstellen für GPUDirect-TCPXO-Traffic angeben. Falls noch nicht geschehen, müssen Sie acht VPC-Netzwerke erstellen, wie unter VPC-Netzwerke erstellen beschrieben.

gcloud

Verwenden Sie zum Erstellen einer regionalen Instanzvorlage den Befehl gcloud compute instance-templates create.

Die Parameter, die Sie angeben müssen, hängen von der Verbrauchsoption ab, die Sie für diese Bereitstellung verwenden. Wählen Sie den Tab aus, der Ihrer Nutzungsoption entspricht.

Reservierung

A3 Mega- oder A3 High-Instanzen (8 GPUs) unterstützen mehrere Bereitstellungsmodelle für Reservierungen. Wählen Sie den Tab aus, der dem Reservierungstyp entspricht, den Sie nutzen möchten.

  • Verwenden Sie die Parameter Reservierungsgebunden, die das reservierungsgebundene Bereitstellungsmodell angeben, für Folgendes:

    • Vorausschauende Reservierungen in AI Hypercomputer
    • Vorausschauende Reservierungen im Kalendermodus
  • Verwenden Sie die Parameter für die Standardreservierung, die das Standardbereitstellungsmodell angeben, für Folgendes:

    • On-demand-Reservierungen
    • Standardmäßige vorausschauende Reservierungen

Reservierungsgebunden

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --reservation-affinity=specific \
    --reservation=RESERVATION \
    --provisioning-model=RESERVATION_BOUND \
    --instance-termination-action=DELETE \
    --maintenance-policy=TERMINATE \
    --restart-on-failure

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • RESERVATION: entweder der Name der Reservierung oder ein bestimmter Block innerhalb einer Reservierung. Informationen zum Abrufen des Reservierungsnamens oder der verfügbaren Blöcke finden Sie unter Reservierte Kapazität ansehen. Wählen Sie je nach Bedarf an der Platzierung der Instanz eine der folgenden Optionen aus:
    • So erstellen Sie Instanzen über mehrere Blöcke hinweg oder in einem einzelnen Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

      Außerdem müssen Sie für einen einzelnen Block die MIG erstellen, indem Sie eine Arbeitslastrichtlinie anwenden, die eine Block-Colocation (maxTopologyDistance=BLOCK) angibt. Compute Engine wendet die Richtlinie dann auf die Reservierung an und erstellt Instanzen im selben Block.

    • So erstellen Sie Instanzen auf einem bestimmten Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME

Standardreservierung

Bevor Sie den Befehl ausführen, sollten Sie alle folgenden Schritte durchgehen, um festzustellen, ob Sie zusätzliche Flags einfügen müssen.

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Gehen Sie folgendermaßen vor:

  1. Ersetzen Sie Folgendes:

    • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
    • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
    • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
    • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
    • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
    • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
    • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
    • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

      • any (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten-Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

      • specific (Reservierungskapazität ist erforderlich): Erfordert, dass die Instanz Kapazität aus einer speziell ausgewählten Reservierung verwendet. Die Instanz darf keine On-Demand-Kapazität verwenden. Wenn die Reservierungskapazität nicht verfügbar ist, schlägt die Instanzerstellung fehl.

    • RESERVATION: Die zu verwendende Reservierung. Geben Sie je nach dem Wert, den Sie für RESERVATION_AFFINITY angegeben haben, einen der folgenden Werte an:

      • Wenn Sie any angegeben haben, ersetzen Sie RESERVATION durch einen leeren String (""). Alternativ können Sie das Flag --reservation vollständig entfernen.
      • Wenn Sie specific angegeben haben, ersetzen Sie RESERVATION durch Folgendes:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Ersetzen Sie Folgendes:

        • RESERVATION_OWNER_PROJECT_ID: die Projekt-ID des Projekts, in dem die Reservierung erstellt wurde.
        • RESERVATION_NAME: der Name der Reservierung.
  2. Standardmäßig wird die Instanz automatisch neu gestartet, wenn sie abstürzt oder von Compute Engine für einen geplanten Stopp beendet wird, z. B. bei einem Wartungsereignis. Wenn Sie den automatischen Neustart deaktivieren möchten, fügen Sie das folgende Flag hinzu:

    --no-restart-on-failure
  3. Führen Sie den Befehl aus.

On demand

Bevor Sie den Befehl ausführen, sollten Sie alle folgenden Schritte durchgehen, um festzustellen, ob Sie zusätzliche Flags einfügen müssen.

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Gehen Sie folgendermaßen vor:

  1. Ersetzen Sie Folgendes:

    • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
    • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
    • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
    • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
    • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
    • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
    • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
    • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

      • any (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten-Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

      • none (On-Demand-Kapazität erforderlich): Verhindert, dass die Instanz Reservierungskapazität verwendet.

  2. Standardmäßig wird die Instanz automatisch neu gestartet, wenn sie abstürzt oder von Compute Engine für einen geplanten Stopp beendet wird, z. B. bei einem Wartungsereignis. Wenn Sie den automatischen Neustart deaktivieren möchten, fügen Sie das folgende Flag hinzu:

    --no-restart-on-failure
  3. Führen Sie den Befehl aus.

Flex-Start

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --reservation-affinity=none \
    --instance-termination-action=DELETE \
    --max-run-duration=RUN_DURATION \
    --maintenance-policy=TERMINATE \
    --provisioning-model=FLEX_START

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • RUN_DURATION: die Dauer, für die die angeforderten VMs ausgeführt werden sollen. Sie müssen den Wert als Anzahl von Tagen, Stunden, Minuten oder Sekunden gefolgt von d, h, m bzw. s formatieren. Geben Sie beispielsweise 30m für 30 Minuten oder 1d2h3m4s für einen Tag, zwei Stunden, drei Minuten und vier Sekunden an. Der Wert muss zwischen 10 Minuten und 7 Tagen liegen.

Spot

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-5,subnet=GVNIC_NAME_PREFIX-sub-5,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-6,subnet=GVNIC_NAME_PREFIX-sub-6,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-7,subnet=GVNIC_NAME_PREFIX-sub-7,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-8,subnet=GVNIC_NAME_PREFIX-sub-8,no-address \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • TERMINATION_ACTION: Die Aktion, die ausgeführt werden soll, wenn Compute Engine die Instanz vorzeitig beendet, entweder STOP (Standard) oder DELETE.

REST

Senden Sie zum Erstellen einer regionalen Instanzvorlage eine POST-Anfrage an die Methode regionInstanceTemplates.insert.

Die Parameter, die Sie angeben müssen, hängen von der Verbrauchsoption ab, die Sie für diese Bereitstellung verwenden. Wählen Sie den Tab aus, der Ihrer Nutzungsoption entspricht.

Reservierung

A3 Mega- oder A3 High-Instanzen (8 GPUs) unterstützen mehrere Bereitstellungsmodelle für Reservierungen. Wählen Sie den Tab aus, der dem Reservierungstyp entspricht, den Sie nutzen möchten.

  • Verwenden Sie die Parameter Reservierungsgebunden, die das reservierungsgebundene Bereitstellungsmodell angeben, für Folgendes:

    • Vorausschauende Reservierungen in AI Hypercomputer
    • Vorausschauende Reservierungen im Kalendermodus
  • Verwenden Sie die Parameter für die Standardreservierung, die das Standardbereitstellungsmodell angeben, für Folgendes:

    • On-demand-Reservierungen
    • Standardmäßige vorausschauende Reservierungen

Reservierungsgebunden

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      }
    ],
    "reservationAffinity": {
        "consumeReservationType": "SPECIFIC_RESERVATION",
        "key": "compute.googleapis.com/reservation-name",
        "values": [
          "RESERVATION"
        ]
      },
    "scheduling": {
        "provisioningModel": "RESERVATION_BOUND",
        "instanceTerminationAction": "DELETE",
        "onHostMaintenance": "TERMINATE",
        "automaticRestart": true
      }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • RESERVATION: entweder der Name der Reservierung oder ein bestimmter Block innerhalb einer Reservierung. Informationen zum Abrufen des Reservierungsnamens oder der verfügbaren Blöcke finden Sie unter Reservierte Kapazität ansehen. Wählen Sie je nach Bedarf an der Platzierung der Instanz eine der folgenden Optionen aus:
    • So erstellen Sie Instanzen über mehrere Blöcke hinweg oder in einem einzelnen Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

      Außerdem müssen Sie für einen einzelnen Block die MIG erstellen, indem Sie eine Arbeitslastrichtlinie anwenden, die eine Block-Colocation (maxTopologyDistance=BLOCK) angibt. Compute Engine wendet die Richtlinie dann auf die Reservierung an und erstellt Instanzen im selben Block.

    • So erstellen Sie Instanzen auf einem bestimmten Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME

Standardreservierung

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • AUTOMATIC_RESTART: Gibt an, ob Ihre Instanz automatisch neu gestartet wird, wenn sie abstürzt oder von Compute Engine aufgrund eines geplanten Stopps beendet wird, z. B. bei einem Wartungsereignis. Geben Sie entweder true an, um den automatischen Neustart zu aktivieren (Standard), oder false, um ihn zu deaktivieren.

  • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

    • ANY_RESERVATION (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

    • SPECIFIC_RESERVATION (Reservierungskapazität ist erforderlich): Erfordert, dass die Instanz Kapazität aus einer speziell ausgewählten Reservierung verwendet. Die Instanz darf keine On-Demand-Kapazität verwenden. Wenn die Reservierungskapazität nicht verfügbar ist, schlägt die Instanzerstellung fehl.

  • RESERVATION: Die zu verwendende Reservierung. Geben Sie je nach dem Wert, den Sie für RESERVATION_AFFINITY angegeben haben, einen der folgenden Werte an:

    • Wenn Sie ANY_RESERVATION angegeben haben, löschen Sie RESERVATION, sodass der Wert ein leerer String ("") ist. Alternativ können Sie die Felder key und values vollständig entfernen.
    • Wenn Sie SPECIFIC_RESERVATION angegeben haben, ersetzen Sie RESERVATION durch Folgendes:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

      Ersetzen Sie Folgendes:

      • RESERVATION_OWNER_PROJECT_ID: die Projekt-ID des Projekts, in dem die Reservierung erstellt wurde.
      • RESERVATION_NAME: der Name der Reservierung.

On demand

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • AUTOMATIC_RESTART: Gibt an, ob Ihre Instanz automatisch neu gestartet wird, wenn sie abstürzt oder von Compute Engine aufgrund eines geplanten Stopps beendet wird, z. B. bei einem Wartungsereignis. Geben Sie entweder true an, um den automatischen Neustart zu aktivieren (Standard), oder false, um ihn zu deaktivieren.

  • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

    • ANY_RESERVATION (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

    • NO_RESERVATION (On-Demand-Kapazität erforderlich): Verhindert, dass die Instanz Reservierungskapazität verwendet.

Flex-Start

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      }
    ],
    "reservationAffinity": {
        "consumeReservationType": "NO_RESERVATION"
      },
    "scheduling": {
        "instanceTerminationAction": "DELETE",
        "maxRunDuration": {
          "seconds": RUN_DURATION
        },
        "onHostMaintenance": "TERMINATE",
        "provisioningModel": "FLEX_START"
      }

  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • RUN_DURATION ist die Dauer in Sekunden, für die die angeforderten VMs ausgeführt werden sollen. Der Wert muss zwischen 600, d. h. 600 Sekunden (10 Minuten), und 604800, also 604.800 Sekunden (7 Tage) liegen.

Spot

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-5",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-5"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-6",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-6"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-7",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-7"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-8",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-8"
      }
    ],
    "scheduling":
    {
      "provisioningModel": "SPOT",
      "instanceTerminationAction": "TERMINATION_ACTION",
      "onHostMaintenance": "TERMINATE",
      "automaticRestart": false
    }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • TERMINATION_ACTION: Die Aktion, die ausgeführt werden soll, wenn Compute Engine die Instanz vorzeitig beendet, entweder STOP (Standard) oder DELETE.

A3 High

Wenn Sie eine Instanzvorlage für A3 High-VMs erstellen möchten, müssen Sie vier zusätzliche Netzwerkschnittstellen für GPUDirect-TCPX-Traffic angeben. Falls noch nicht geschehen, müssen Sie vier VPC-Netzwerke erstellen, wie unter VPC-Netzwerke erstellen beschrieben.

gcloud

Verwenden Sie zum Erstellen einer regionalen Instanzvorlage den Befehl gcloud compute instance-templates create.

Die Parameter, die Sie angeben müssen, hängen von der Verbrauchsoption ab, die Sie für diese Bereitstellung verwenden. Wählen Sie den Tab aus, der Ihrer Nutzungsoption entspricht.

Reservierung

A3 Mega- oder A3 High-Instanzen (8 GPUs) unterstützen mehrere Bereitstellungsmodelle für Reservierungen. Wählen Sie den Tab aus, der dem Reservierungstyp entspricht, den Sie nutzen möchten.

  • Verwenden Sie die Parameter Reservierungsgebunden, die das reservierungsgebundene Bereitstellungsmodell angeben, für Folgendes:

    • Vorausschauende Reservierungen in AI Hypercomputer
    • Vorausschauende Reservierungen im Kalendermodus
  • Verwenden Sie die Parameter für die Standardreservierung, die das Standardbereitstellungsmodell angeben, für Folgendes:

    • On-demand-Reservierungen
    • Standardmäßige vorausschauende Reservierungen

Reservierungsgebunden

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --reservation-affinity=specific \
    --reservation=RESERVATION \
    --provisioning-model=RESERVATION_BOUND \
    --instance-termination-action=DELETE \
    --maintenance-policy=TERMINATE \
    --restart-on-failure

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • RESERVATION: entweder der Name der Reservierung oder ein bestimmter Block innerhalb einer Reservierung. Informationen zum Abrufen des Reservierungsnamens oder der verfügbaren Blöcke finden Sie unter Reservierte Kapazität ansehen. Wählen Sie je nach Bedarf an der Platzierung der Instanz eine der folgenden Optionen aus:
    • So erstellen Sie Instanzen über mehrere Blöcke hinweg oder in einem einzelnen Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

      Außerdem müssen Sie für einen einzelnen Block die MIG erstellen, indem Sie eine Arbeitslastrichtlinie anwenden, die eine Block-Colocation (maxTopologyDistance=BLOCK) angibt. Compute Engine wendet die Richtlinie dann auf die Reservierung an und erstellt Instanzen im selben Block.

    • So erstellen Sie Instanzen auf einem bestimmten Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME

Standardreservierung

Bevor Sie den Befehl ausführen, sollten Sie alle folgenden Schritte durchgehen, um festzustellen, ob Sie zusätzliche Flags einfügen müssen.

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY \
    --reservation=RESERVATION

Gehen Sie folgendermaßen vor:

  1. Ersetzen Sie Folgendes:

    • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
    • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
    • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
    • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
    • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
    • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
    • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
    • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

      • any (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten-Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

      • specific (Reservierungskapazität ist erforderlich): Erfordert, dass die Instanz Kapazität aus einer speziell ausgewählten Reservierung verwendet. Die Instanz darf keine On-Demand-Kapazität verwenden. Wenn die Reservierungskapazität nicht verfügbar ist, schlägt die Instanzerstellung fehl.

    • RESERVATION: Die zu verwendende Reservierung. Geben Sie je nach dem Wert, den Sie für RESERVATION_AFFINITY angegeben haben, einen der folgenden Werte an:

      • Wenn Sie any angegeben haben, ersetzen Sie RESERVATION durch einen leeren String (""). Alternativ können Sie das Flag --reservation vollständig entfernen.
      • Wenn Sie specific angegeben haben, ersetzen Sie RESERVATION durch Folgendes:

        projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

        Ersetzen Sie Folgendes:

        • RESERVATION_OWNER_PROJECT_ID: die Projekt-ID des Projekts, in dem die Reservierung erstellt wurde.
        • RESERVATION_NAME: der Name der Reservierung.
  2. Standardmäßig wird die Instanz automatisch neu gestartet, wenn sie abstürzt oder von Compute Engine für einen geplanten Stopp beendet wird, z. B. bei einem Wartungsereignis. Wenn Sie den automatischen Neustart deaktivieren möchten, fügen Sie das folgende Flag hinzu:

    --no-restart-on-failure
  3. Führen Sie den Befehl aus.

On demand

Bevor Sie den Befehl ausführen, sollten Sie alle folgenden Schritte durchgehen, um festzustellen, ob Sie zusätzliche Flags einfügen müssen.

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=STANDARD \
    --maintenance-policy=TERMINATE \
    --reservation-affinity=RESERVATION_AFFINITY

Gehen Sie folgendermaßen vor:

  1. Ersetzen Sie Folgendes:

    • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
    • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
    • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
    • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
    • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
    • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
    • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
    • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

      • any (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten-Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

      • none (On-Demand-Kapazität erforderlich): Verhindert, dass die Instanz Reservierungskapazität verwendet.

  2. Standardmäßig wird die Instanz automatisch neu gestartet, wenn sie abstürzt oder von Compute Engine für einen geplanten Stopp beendet wird, z. B. bei einem Wartungsereignis. Wenn Sie den automatischen Neustart deaktivieren möchten, fügen Sie das folgende Flag hinzu:

    --no-restart-on-failure
  3. Führen Sie den Befehl aus.

Flex-Start

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --reservation-affinity=none \
    --instance-termination-action=DELETE \
    --max-run-duration=RUN_DURATION \
    --maintenance-policy=TERMINATE \
    --provisioning-model=FLEX_START

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • RUN_DURATION: die Dauer, für die die angeforderten VMs ausgeführt werden sollen. Sie müssen den Wert als Anzahl von Tagen, Stunden, Minuten oder Sekunden gefolgt von d, h, m bzw. s formatieren. Geben Sie beispielsweise 30m für 30 Minuten oder 1d2h3m4s für einen Tag, zwei Stunden, drei Minuten und vier Sekunden an. Der Wert muss zwischen 10 Minuten und 7 Tagen liegen.

Spot

gcloud compute instance-templates create INSTANCE_TEMPLATE_NAME \
    --machine-type=MACHINE_TYPE \
    --image-family=IMAGE_FAMILY \
    --image-project=IMAGE_PROJECT \
    --instance-template-region=REGION \
    --boot-disk-type=hyperdisk-balanced \
    --boot-disk-size=DISK_SIZE \
    --scopes=cloud-platform \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-0,subnet=GVNIC_NAME_PREFIX-sub-0 \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-1,subnet=GVNIC_NAME_PREFIX-sub-1,no-address 
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-2,subnet=GVNIC_NAME_PREFIX-sub-2,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-3,subnet=GVNIC_NAME_PREFIX-sub-3,no-address \
    --network-interface=nic-type=GVNIC,network=GVNIC_NAME_PREFIX-net-4,subnet=GVNIC_NAME_PREFIX-sub-4,no-address \
    --provisioning-model=SPOT \
    --instance-termination-action=TERMINATION_ACTION \
    --maintenance-policy=TERMINATE \
    --no-restart-on-failure

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • TERMINATION_ACTION: Die Aktion, die ausgeführt werden soll, wenn Compute Engine die Instanz vorzeitig beendet, entweder STOP (Standard) oder DELETE.

REST

Senden Sie zum Erstellen einer regionalen Instanzvorlage eine POST-Anfrage an die Methode regionInstanceTemplates.insert.

Die Parameter, die Sie angeben müssen, hängen von der Verbrauchsoption ab, die Sie für diese Bereitstellung verwenden. Wählen Sie den Tab aus, der Ihrer Nutzungsoption entspricht.

Reservierung

A3 Mega- oder A3 High-Instanzen (8 GPUs) unterstützen mehrere Bereitstellungsmodelle für Reservierungen. Wählen Sie den Tab aus, der dem Reservierungstyp entspricht, den Sie nutzen möchten.

  • Verwenden Sie die Parameter Reservierungsgebunden, die das reservierungsgebundene Bereitstellungsmodell angeben, für Folgendes:

    • Vorausschauende Reservierungen in AI Hypercomputer
    • Vorausschauende Reservierungen im Kalendermodus
  • Verwenden Sie die Parameter für die Standardreservierung, die das Standardbereitstellungsmodell angeben, für Folgendes:

    • On-demand-Reservierungen
    • Standardmäßige vorausschauende Reservierungen

Reservierungsgebunden

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      }
    ],
    "reservationAffinity": {
        "consumeReservationType": "SPECIFIC_RESERVATION",
        "key": "compute.googleapis.com/reservation-name",
        "values": [
          "RESERVATION"
        ]
      },
    "scheduling": {
        "provisioningModel": "RESERVATION_BOUND",
        "instanceTerminationAction": "DELETE",
        "onHostMaintenance": "TERMINATE",
        "automaticRestart": true
      }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • RESERVATION: entweder der Name der Reservierung oder ein bestimmter Block innerhalb einer Reservierung. Informationen zum Abrufen des Reservierungsnamens oder der verfügbaren Blöcke finden Sie unter Reservierte Kapazität ansehen. Wählen Sie je nach Bedarf an der Platzierung der Instanz eine der folgenden Optionen aus:
    • So erstellen Sie Instanzen über mehrere Blöcke hinweg oder in einem einzelnen Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

      Außerdem müssen Sie für einen einzelnen Block die MIG erstellen, indem Sie eine Arbeitslastrichtlinie anwenden, die eine Block-Colocation (maxTopologyDistance=BLOCK) angibt. Compute Engine wendet die Richtlinie dann auf die Reservierung an und erstellt Instanzen im selben Block.

    • So erstellen Sie Instanzen auf einem bestimmten Block:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME/reservationBlocks/RESERVATION_BLOCK_NAME

Standardreservierung

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY",
    "key": "compute.googleapis.com/reservation-name",
    "values": [
      "RESERVATION"
    ]
  }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • AUTOMATIC_RESTART: Gibt an, ob Ihre Instanz automatisch neu gestartet wird, wenn sie abstürzt oder von Compute Engine aufgrund eines geplanten Stopps beendet wird, z. B. bei einem Wartungsereignis. Geben Sie entweder true an, um den automatischen Neustart zu aktivieren (Standard), oder false, um ihn zu deaktivieren.

  • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

    • ANY_RESERVATION (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

    • SPECIFIC_RESERVATION (Reservierungskapazität ist erforderlich): Erfordert, dass die Instanz Kapazität aus einer speziell ausgewählten Reservierung verwendet. Die Instanz darf keine On-Demand-Kapazität verwenden. Wenn die Reservierungskapazität nicht verfügbar ist, schlägt die Instanzerstellung fehl.

  • RESERVATION: Die zu verwendende Reservierung. Geben Sie je nach dem Wert, den Sie für RESERVATION_AFFINITY angegeben haben, einen der folgenden Werte an:

    • Wenn Sie ANY_RESERVATION angegeben haben, löschen Sie RESERVATION, sodass der Wert ein leerer String ("") ist. Alternativ können Sie die Felder key und values vollständig entfernen.
    • Wenn Sie SPECIFIC_RESERVATION angegeben haben, ersetzen Sie RESERVATION durch Folgendes:

      projects/RESERVATION_OWNER_PROJECT_ID/reservations/RESERVATION_NAME

      Ersetzen Sie Folgendes:

      • RESERVATION_OWNER_PROJECT_ID: die Projekt-ID des Projekts, in dem die Reservierung erstellt wurde.
      • RESERVATION_NAME: der Name der Reservierung.

On demand

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      }
    ],
    "scheduling": {
    "provisioningModel": "STANDARD",
    "onHostMaintenance": "TERMINATE",
    "automaticRestart": AUTOMATIC_RESTART
  },
  "reservationAffinity": {
    "consumeReservationType": "RESERVATION_AFFINITY"
  }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • AUTOMATIC_RESTART: Gibt an, ob Ihre Instanz automatisch neu gestartet wird, wenn sie abstürzt oder von Compute Engine aufgrund eines geplanten Stopps beendet wird, z. B. bei einem Wartungsereignis. Geben Sie entweder true an, um den automatischen Neustart zu aktivieren (Standard), oder false, um ihn zu deaktivieren.

  • RESERVATION_AFFINITY: Gibt an, welche Reservierungen die Instanz nach Möglichkeit nutzen darf. Wählen Sie eine der folgenden Optionen aus:

    • ANY_RESERVATION (Reservierungskapazität ist optional): Dies ist die Standardoption. Die Instanz versucht, Kapazität aus einer automatisch genutzten Reservierung zu verwenden. Dies geschieht nur, wenn entsprechende Reservierungskapazität verfügbar ist. Andernfalls wird On-Demand-Kapazität verwendet.

    • NO_RESERVATION (On-Demand-Kapazität erforderlich): Verhindert, dass die Instanz Reservierungskapazität verwendet.

Flex-Start

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      }
    ],
    "reservationAffinity": {
        "consumeReservationType": "NO_RESERVATION"
      },
    "scheduling": {
        "instanceTerminationAction": "DELETE",
        "maxRunDuration": {
          "seconds": RUN_DURATION
        },
        "onHostMaintenance": "TERMINATE",
        "provisioningModel": "FLEX_START"
      }

  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • RUN_DURATION ist die Dauer in Sekunden, für die die angeforderten VMs ausgeführt werden sollen. Der Wert muss zwischen 600, d. h. 600 Sekunden (10 Minuten), und 604800, also 604.800 Sekunden (7 Tage) liegen.

Spot

POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceTemplates
{
  "name": "INSTANCE_TEMPLATE_NAME",
  "properties": {
    "machineType": "MACHINE_TYPE",
    "disks": [
      {
        "boot": true,
        "initializeParams": {
          "diskSizeGb": "DISK_SIZE",
          "diskType": "hyperdisk-balanced",
          "sourceImage": "projects/IMAGE_PROJECT/global/images/family/IMAGE_FAMILY"
        },
        "mode": "READ_WRITE",
        "type": "PERSISTENT"
      }
    ],
    "serviceAccounts": [
      {
        "email": "default",
        "scopes": [
          "https://www.googleapis.com/auth/cloud-platform"
        ]
      }
    ],
    "networkInterfaces": [
      {
        "accessConfigs": [
          {
            "name": "external-nat",
            "type": "ONE_TO_ONE_NAT"
          }
        ],
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-0",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-0"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-1",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-1"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-2",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-2"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-3",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-3"
      },
      {
        "network": "projects/NETWORK_PROJECT_ID/global/networks/GVNIC_NAME_PREFIX-net-4",
        "nicType": "GVNIC",
        "subnetwork": "projects/NETWORK_PROJECT_ID/region/REGION/subnetworks/GVNIC_NAME_PREFIX-sub-4"
      }
    ],
    "scheduling":
    {
      "provisioningModel": "SPOT",
      "instanceTerminationAction": "TERMINATION_ACTION",
      "onHostMaintenance": "TERMINATE",
      "automaticRestart": false
    }
  }
}

Ersetzen Sie Folgendes:

  • INSTANCE_TEMPLATE_NAME ist der Name der Instanzvorlage.
  • MACHINE_TYPE: Der Maschinentyp, der für die A3-Mega- oder A3-High-Instanz (8 GPUs) verwendet werden soll. Weitere Informationen finden Sie unter GPU-Maschinentypen in der Compute Engine-Dokumentation.
  • IMAGE_FAMILY: die Image-Familie des Betriebssystem-Images, das Sie verwenden möchten. Eine Liste aller unterstützten Betriebssysteme finden Sie unter Unterstützte Betriebssysteme.
  • IMAGE_PROJECT: die Projekt-ID des Betriebssystem-Images.
  • REGION: die Region, in der Sie die Instanzvorlage erstellen möchten. Geben Sie eine Region an, in der der gewünschte Maschinentyp verfügbar ist. Informationen zu Regionen finden Sie unter GPU-Verfügbarkeit nach Regionen und Zonen.
  • DISK_SIZE: Die Größe des Bootlaufwerks in GB. Weitere Informationen finden Sie je nach Art des Laufwerks unter Größenbeschränkungen für Google Cloud Hyperdisk oder Größenbeschränkungen für Persistent Disk.
  • NETWORK_PROJECT_ID: die Projekt-ID des Netzwerks.
  • GVNIC_NAME_PREFIX: Das Namenspräfix, das Sie beim Erstellen der standardmäßigen VPC-Netzwerke und -Subnetze angegeben haben, die gVNIC-NICs verwenden.
  • REGION: die Region des Subnetzwerks.
  • TERMINATION_ACTION: Die Aktion, die ausgeführt werden soll, wenn Compute Engine die Instanz vorzeitig beendet, entweder STOP (Standard) oder DELETE.

Nachdem Sie die Instanzvorlage erstellt haben, können Sie sie aufrufen, um ihre ID und die Instanzeigenschaften zu sehen.

Eine MIG erstellen.

Nachdem Sie alle vorherigen Schritte ausgeführt haben, erstellen Sie eine MIG basierend auf Ihrem Szenario:

Szenario Methode zum Erstellen einer MIG und von VMs darin Beispiel
Sie haben mehrere oder parallele Jobs, die mit einer beliebigen Anzahl von VMs gestartet werden können. Erstellen Sie eine MIG und geben Sie mit der Zielgröße die Anzahl der VMs an, die Sie in der Gruppe haben möchten.

Weitere Informationen finden Sie unter MIG mit einer Zielgröße erstellen.

ML-Inferenzjobs
Sie haben einen Job, der auf eine genaue Anzahl von VMs verteilt werden muss. Erstellen Sie eine MIG ohne VMs und dann eine Anfrage zur Größenanpassung in der MIG. Mit der Anfrage zur Größenanpassung können Sie alle VMs auf einmal erhalten.

Weitere Informationen finden Sie unter MIG und Anfrage zur Größenanpassung erstellen.

Verteilte ML-Trainings- und ‑Abstimmungsjobs

MIG mit einer Zielgröße erstellen

Wenn Sie Ihren Job starten können, ohne alle VMs gleichzeitig zu erstellen, erstellen Sie eine MIG mit einer Zielgröße. Die Zielgröße bestimmt die Anzahl der VMs in der verwalteten Instanzgruppe. Die verwaltete Instanzgruppe beginnt mit dem Erstellen von VMs basierend auf der aktuellen Ressourcenverfügbarkeit. Wenn Ressourcen vorübergehend nicht verfügbar sind, versucht die verwaltete Instanzgruppe kontinuierlich, VMs zu erstellen, um die Zielgröße zu erreichen.

Wählen Sie eine der folgenden Optionen aus, um eine verwaltete Instanzgruppe mit einer Zielgröße zu erstellen:

gcloud

Verwenden Sie den Befehl instance-groups managed create, um eine MIG mit einer angegebenen Zielgröße zu erstellen.

Die Befehle, mit denen Sie eine MIG erstellen, verwenden eine Arbeitslastrichtlinie, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Flag --workload-policy.

So erstellen Sie eine zonale oder regionale MIG:

  • Verwenden Sie den folgenden Befehl, um eine zonale MIG zu erstellen:
    gcloud compute instance-groups managed create MIG_NAME \
      --template=INSTANCE_TEMPLATE_URL \
      --size=TARGET_SIZE \
      --workload-policy=WORKLOAD_POLICY_URL \
      --zone=ZONE
    
  • Verwenden Sie den folgenden Befehl, um eine regionale MIG zu erstellen:
    gcloud compute instance-groups managed create MIG_NAME \
        --template=INSTANCE_TEMPLATE_URL \
        --size=TARGET_SIZE \
        --workload-policy=WORKLOAD_POLICY_URL \
        --region=REGION
    
Ersetzen Sie Folgendes:
  • MIG_NAME: Name der MIG.
  • INSTANCE_TEMPLATE_URL: Die URL der Instanzvorlage, die Sie zum Erstellen von Instanzen in der MIG verwenden möchten. Die URL kann entweder die ID oder den Namen der Instanzvorlage enthalten. Geben Sie einen der folgenden Werte an:
    • Für eine regionale Instanzvorlage: projects/PROJECT_ID/regions/REGION/instanceTemplates/INSTANCE_TEMPLATE_ID
    • Für eine globale Instanzvorlage: INSTANCE_TEMPLATE_ID
  • TARGET_SIZE: Die Anzahl der Instanzen, die Sie in der MIG haben möchten.
  • WORKLOAD_POLICY_URL: Optional. Die URL der Arbeitslastrichtlinie, z. B. projects/example-project/regions/us-central1/resourcePolicies/example-workload-policy. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Flag --workload-policy.
  • ZONE: die Zone, in der Sie die MIG erstellen möchten. Wenn Sie eine Arbeitslastrichtlinie verwenden, geben Sie eine Zone innerhalb der Region der Richtlinie an.
  • REGION: die Region, in der Sie die MIG erstellen möchten. Wenn Sie eine Arbeitslastrichtlinie verwenden, geben Sie dieselbe Region wie für die Richtlinie an. Bei einer regionalen MIG können Sie anstelle einer Region die Zonen in dieser Region mit dem Flag --zones angeben.

REST

Wenn Sie eine MIG mit einer bestimmten Zielgröße erstellen möchten, senden Sie eine POST-Anfrage.

In den Anfragen, mit denen Sie eine MIG erstellen, wird eine Arbeitslastrichtlinie verwendet, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Feld resourcePolicies.workloadPolicy.

So erstellen Sie eine zonale oder regionale MIG:

  • Wenn Sie eine zonale MIG erstellen möchten, senden Sie eine POST-Anfrage an die Methode instanceGroupManagers.insert.
    POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers
    {
      "versions": [
        {
          "instanceTemplate": "INSTANCE_TEMPLATE_URL"
        }
      ],
      "name": "MIG_NAME",
      "targetSize": TARGET_SIZE,
      "resourcePolicies": {
        "workloadPolicy": "WORKLOAD_POLICY_URL"
      }
    }
    
  • Um eine regionale MIG zu erstellen, senden Sie eine POST-Anfrage an die Methode regionInstanceGroupManagers.insert.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers
      {
        "name": "MIG_NAME",
        "instanceTemplate": "INSTANCE_TEMPLATE_URL",
        "targetSize": TARGET_SIZE,
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
    
Ersetzen Sie Folgendes:
  • PROJECT_ID: Projekt-ID.
  • ZONE: die Zone, in der Sie die verwaltete Instanzgruppe erstellen möchten. Wenn Sie eine Arbeitslastrichtlinie verwenden, geben Sie eine Zone innerhalb der Region der Richtlinie an.
  • REGION: die Region, in der Sie die MIG erstellen möchten. Wenn Sie eine Arbeitslastrichtlinie verwenden, geben Sie dieselbe Region wie für die Richtlinie an.
  • INSTANCE_TEMPLATE_URL: Die URL der Instanzvorlage, die Sie zum Erstellen von Instanzen in der MIG verwenden möchten. Die URL kann entweder die ID oder den Namen der Instanzvorlage enthalten. Geben Sie einen der folgenden Werte an:
    • Für eine regionale Instanzvorlage: projects/PROJECT_ID/regions/REGION/instanceTemplates/INSTANCE_TEMPLATE_ID
    • Für eine globale Instanzvorlage: INSTANCE_TEMPLATE_ID
  • MIG_NAME: Name der MIG.
  • TARGET_SIZE: Die Anzahl der Instanzen, die Sie in der MIG haben möchten.
  • WORKLOAD_POLICY_URL: Optional. Die URL der Arbeitslastrichtlinie, z. B. projects/example-project/regions/us-central1/resourcePolicies/example-workload-policy. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Feld resourcePolicies.workloadPolicy.

MIG und Anfrage zur Größenanpassung erstellen

Wenn Sie mehrere VMs gleichzeitig benötigen, um einen Job zu starten, erstellen Sie eine MIG und dann eine Anfrage zur Größenänderung in der MIG, wie in diesem Abschnitt beschrieben.

Wählen Sie eine der folgenden Optionen aus, um eine Anfrage zur Größenanpassung in einer MIG zu erstellen:

gcloud

Die Parameter, die Sie angeben müssen, hängen von der Verbrauchsoption ab, die Sie für diese Bereitstellung verwenden. Wählen Sie den Tab aus, der dem Bereitstellungsmodell Ihrer Nutzungsoption entspricht.

Reservierung

Die Befehle, mit denen Sie eine MIG erstellen, verwenden eine Arbeitslastrichtlinie, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Flag --workload-policy.

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

On demand

Die Befehle, mit denen Sie eine MIG erstellen, verwenden eine Arbeitslastrichtlinie, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Flag --workload-policy.

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

Flex-Start

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

  • So erstellen Sie eine zonale MIG und eine Anfrage zur Größenanpassung darin:

    1. Erstellen Sie mit dem Befehl instance-groups managed create eine zonale MIG, wie unten beschrieben.

      gcloud compute instance-groups managed create MIG_NAME \
          --template=INSTANCE_TEMPLATE_URL \
          --size=0 \
          --default-action-on-vm-failure=do-nothing \
          --workload-policy=WORKLOAD_POLICY_URL \
          --zone=ZONE
      
    2. Erstellen Sie mit dem Befehl instance-groups managed resize-requests create eine Anfrage zur Größenanpassung in der zonalen MIG. Mit diesem Befehl wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.

      gcloud compute instance-groups managed resize-requests create MIG_NAME \
          --resize-request=RESIZE_REQUEST_NAME \
          --resize-by=COUNT \
          --zone=ZONE
      
  • So erstellen Sie eine regionale MIG und eine Anfrage zur Größenanpassung darin:

    1. Erstellen Sie mit dem Befehl instance-groups managed create eine regionale MIG.

      gcloud compute instance-groups managed create MIG_NAME \
          --template=INSTANCE_TEMPLATE_URL \
          --size=0 \
          --default-action-on-vm-failure=do-nothing \
      
          --workload-policy=WORKLOAD_POLICY_URL \
      
          --region=REGION \
          --target-distribution-shape=any-single-zone \
          --instance-redistribution-type=none \
          --workload-policy=WORKLOAD_POLICY_URL
        
    2. Erstellen Sie mit dem Befehl instance-groups managed resize-requests create eine Anfrage zur Größenanpassung in der regionalen MIG. Mit diesem Befehl wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.

      gcloud compute instance-groups managed resize-requests create MIG_NAME \
          --resize-request=RESIZE_REQUEST_NAME \
          --resize-by=COUNT \
          --region=REGION
      

Spot

Die Befehle, mit denen Sie eine MIG erstellen, verwenden eine Arbeitslastrichtlinie, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Flag --workload-policy.

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

Ersetzen Sie Folgendes:
  • MIG_NAME: Name der MIG.
  • INSTANCE_TEMPLATE_URL: Die URL der Instanzvorlage, die Sie zum Erstellen von Instanzen in der MIG verwenden möchten. Die URL kann entweder die ID oder den Namen der Instanzvorlage enthalten. Geben Sie einen der folgenden Werte an:
    • Für eine regionale Instanzvorlage: projects/PROJECT_ID/regions/REGION/instanceTemplates/INSTANCE_TEMPLATE_ID
    • Für eine globale Instanzvorlage: INSTANCE_TEMPLATE_ID
  • WORKLOAD_POLICY_URL: Optional. Die URL der Arbeitslastrichtlinie, z. B. projects/example-project/regions/us-central1/resourcePolicies/example-workload-policy. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Flag --workload-policy.
  • ZONE: die Zone, in der Sie die MIG erstellen möchten. Auch für eine regionale MIG müssen Sie eine Zone angeben. Diese Zone muss die Zone sein, die das Profil für Ihr VPC-Netzwerk enthält, und eine Zone sein, in der der Maschinentyp verfügbar ist. Weitere Informationen finden Sie unter Einschränkungen.
  • RESIZE_REQUEST_NAME: der Name der Anfrage zur Größenänderung, der innerhalb der angegebenen MIG eindeutig sein muss. Andernfalls schlägt das Erstellen der Anfrage zur Größenänderung fehl.
  • COUNT: Die Anzahl der Instanzen, die gleichzeitig zur MIG hinzugefügt werden sollen.
  • REGION: die Region, in der Sie die MIG erstellen möchten.

Anfrage zur Größenanpassung erstellen, indem Sie eine Liste mit VM-Namen angeben

Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, geben Sie eine Liste mit Namen an, mit denen die VMs erstellt werden sollen. Die Anzahl der Namen, die Sie angeben, bestimmt die Anzahl der VMs, die die MIG auf einmal erstellt.

Verwenden Sie zum Erstellen einer Anfrage zur Größenanpassung mit bestimmten VM-Namen in einer MIG den Betabefehl gcloud compute instance-groups managed resize-requests create mit dem Flag --instances:

  • Führen Sie in einer zonalen MIG den folgenden Befehl aus:

    gcloud beta compute instance-groups managed resize-requests create MIG_NAME \
        --resize-request=RESIZE_REQUEST_NAME \
        --instances=INSTANCE_NAMES \
        --zone=ZONE
    
  • Führen Sie in einer regionalen verwalteten Instanzgruppe den folgenden Befehl aus:

    gcloud beta compute instance-groups managed resize-requests create MIG_NAME \
        --resize-request=RESIZE_REQUEST_NAME \
        --instances=INSTANCE_NAMES \
        --region=REGION
    
Ersetzen Sie INSTANCE_NAMES durch eine kommagetrennte Liste mit Namen für die VMs. Beispiel: instance-1,instance-2,instance-3.

REST

Die Parameter, die Sie angeben müssen, hängen von der Verbrauchsoption ab, die Sie für diese Bereitstellung verwenden. Wählen Sie den Tab aus, der dem Bereitstellungsmodell Ihrer Nutzungsoption entspricht.

Reservierung

In den Anfragen, mit denen Sie eine MIG erstellen, wird eine Arbeitslastrichtlinie verwendet, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Feld resourcePolicies.workloadPolicy.

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

  • So erstellen Sie eine zonale MIG und eine Anfrage zur Größenanpassung darin:
    1. Erstellen Sie eine zonale MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagers.insert senden.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der zonalen MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagerResizeRequests.insert senden. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      
  • So erstellen Sie eine regionale MIG und eine Anfrage zur Größenanpassung darin:
    1. So erstellen Sie eine regionale MIG und senden eine POST-Anfrage an die regionInstanceGroupManagers.insert-Methode:
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "distributionPolicy": {
          "targetShape": "ANY_SINGLE_ZONE",
          "zones": [
            {
              "zone": "projects/PROJECT_ID/zones/ZONE"
            }
          ]
        },
        "updatePolicy": {
          "instanceRedistributionType": "NONE"
        },
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der regionalen MIG, indem Sie eine POST-Anfrage an die Methode regionInstanceGroupManagerResizeRequests.insert senden, wie unten beschrieben. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      

On demand

In den Anfragen, mit denen Sie eine MIG erstellen, wird eine Arbeitslastrichtlinie verwendet, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Feld resourcePolicies.workloadPolicy.

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

  • So erstellen Sie eine zonale MIG und eine Anfrage zur Größenanpassung darin:
    1. Erstellen Sie eine zonale MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagers.insert senden.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der zonalen MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagerResizeRequests.insert senden. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      
  • So erstellen Sie eine regionale MIG und eine Anfrage zur Größenanpassung darin:
    1. So erstellen Sie eine regionale MIG und senden eine POST-Anfrage an die regionInstanceGroupManagers.insert-Methode:
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "distributionPolicy": {
          "targetShape": "ANY_SINGLE_ZONE",
          "zones": [
            {
              "zone": "projects/PROJECT_ID/zones/ZONE"
            }
          ]
        },
        "updatePolicy": {
          "instanceRedistributionType": "NONE"
        },
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der regionalen MIG, indem Sie eine POST-Anfrage an die Methode regionInstanceGroupManagerResizeRequests.insert senden, wie unten beschrieben. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      

Flex-Start

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

  • So erstellen Sie eine zonale MIG und eine Anfrage zur Größenanpassung darin:
    1. Erstellen Sie eine zonale MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagers.insert senden.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "instanceLifecyclePolicy": {
          "defaultActionOnFailure": "DO_NOTHING"
        },
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der zonalen MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagerResizeRequests.insert senden. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      
  • So erstellen Sie eine regionale MIG und eine Anfrage zur Größenanpassung darin:
    1. So erstellen Sie eine regionale MIG und senden eine POST-Anfrage an die regionInstanceGroupManagers.insert-Methode:
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "distributionPolicy": {
          "targetShape": "ANY_SINGLE_ZONE",
          "zones": [
            {
              "zone": "projects/PROJECT_ID/zones/ZONE"
            }
          ]
        },
        "updatePolicy": {
          "instanceRedistributionType": "NONE"
        },
        "instanceLifecyclePolicy": {
          "defaultActionOnFailure": "DO_NOTHING"
        },
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der regionalen MIG, indem Sie eine POST-Anfrage an die Methode regionInstanceGroupManagerResizeRequests.insert senden, wie unten beschrieben. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      

Spot

In den Anfragen, mit denen Sie eine MIG erstellen, wird eine Arbeitslastrichtlinie verwendet, um die Instanzplatzierung anzugeben. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Feld resourcePolicies.workloadPolicy.

So erstellen Sie eine zonale oder regionale MIG und eine Anfrage zur Größenanpassung:

  • So erstellen Sie eine zonale MIG und eine Anfrage zur Größenanpassung darin:
    1. Erstellen Sie eine zonale MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagers.insert senden.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der zonalen MIG, indem Sie eine POST-Anfrage an die Methode instanceGroupManagerResizeRequests.insert senden. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/zones/ZONE/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      
  • So erstellen Sie eine regionale MIG und eine Anfrage zur Größenanpassung darin:
    1. So erstellen Sie eine regionale MIG und senden eine POST-Anfrage an die regionInstanceGroupManagers.insert-Methode:
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers
      {
        "versions": [
          {
            "instanceTemplate": "INSTANCE_TEMPLATE_URL"
          }
        ],
        "name": "MIG_NAME",
        "targetSize": 0,
        "distributionPolicy": {
          "targetShape": "ANY_SINGLE_ZONE",
          "zones": [
            {
              "zone": "projects/PROJECT_ID/zones/ZONE"
            }
          ]
        },
        "updatePolicy": {
          "instanceRedistributionType": "NONE"
        },
        "resourcePolicies": {
          "workloadPolicy": "WORKLOAD_POLICY_URL"
        }
      }
      
    2. Erstellen Sie eine Anfrage zur Größenänderung in der regionalen MIG, indem Sie eine POST-Anfrage an die Methode regionInstanceGroupManagerResizeRequests.insert senden, wie unten beschrieben. In dieser Anfrage wird die Anzahl der VMs angegeben, die Sie erstellen möchten. Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, erstellen Sie eine Größenänderungsanfrage, indem Sie eine Liste von VM-Namen angeben.
      POST https://compute.googleapis.com/compute/v1/projects/PROJECT_ID/regions/REGION/instanceGroupManagers/MIG_NAME/resizeRequests
      {
        "name": "RESIZE_REQUEST_NAME",
        "resizeBy": COUNT
      }
      
Ersetzen Sie Folgendes:
  • PROJECT_ID: Projekt-ID.
  • ZONE: die Zone, in der Sie die MIG erstellen möchten. Diese Zone muss mit der Zone übereinstimmen, die das Profil für Ihr VPC-Netzwerk enthält, und muss eine Zone sein, in der der ausgewählte Maschinentyp verfügbar ist. Weitere Informationen finden Sie unter Einschränkungen.
  • REGION: Die Region, in der Sie die MIG erstellen möchten. Diese Region muss dieselbe Region sein, die das Profil für Ihr VPC-Netzwerk enthält, und eine Zone enthalten, in der der von Ihnen ausgewählte Maschinentyp verfügbar ist. Weitere Informationen finden Sie unter Einschränkungen.
  • INSTANCE_TEMPLATE_URL: Die URL der Instanzvorlage, die Sie zum Erstellen von Instanzen in der MIG verwenden möchten. Die URL kann entweder die ID oder den Namen der Instanzvorlage enthalten. Geben Sie einen der folgenden Werte an:
    • Für eine regionale Instanzvorlage: projects/PROJECT_ID/regions/REGION/instanceTemplates/INSTANCE_TEMPLATE_ID
    • Für eine globale Instanzvorlage: INSTANCE_TEMPLATE_ID
  • MIG_NAME: Name der MIG.
  • WORKLOAD_POLICY_URL: Optional. Die URL der Arbeitslastrichtlinie, z. B. projects/example-project/regions/us-central1/resourcePolicies/example-workload-policy. Wenn Sie keine Arbeitslastrichtlinie verwenden möchten, entfernen Sie das Feld resourcePolicies.workloadPolicy.
  • RESIZE_REQUEST_NAME: der Name der Anfrage zur Größenänderung, der innerhalb der angegebenen MIG eindeutig sein muss. Andernfalls schlägt das Erstellen der Anfrage zur Größenänderung fehl.
  • COUNT: die Anzahl der Instanzen, die gleichzeitig zur MIG hinzugefügt werden sollen

Anfrage zur Größenanpassung erstellen, indem Sie eine Liste mit VM-Namen angeben

Wenn für Ihre Arbeitslast bestimmte VM-Namen erforderlich sind, geben Sie eine Liste mit Namen an, mit denen die VMs erstellt werden sollen. Die Anzahl der Namen, die Sie angeben, bestimmt die Anzahl der VMs, die die MIG auf einmal erstellt.

Wenn Sie eine Anfrage zur Größenänderung mit bestimmten VM-Namen in einer MIG erstellen möchten, verwenden Sie eine der folgenden Methoden:

Wenn Sie beispielsweise zwei VM-Namen angeben möchten, fügen Sie Folgendes in den Anfragetext ein:

{
  "name": "RESIZE_REQUEST_NAME",
  "instances": [
    {
      "name": "INSTANCE_NAME_1"
    },
    {
      "name": "INSTANCE_NAME_2"
    }
  ]
}

Ersetzen Sie INSTANCE_NAME_1, INSTANCE_NAME_2 durch die Namen der VMs.

GPU-Treiber installieren

Nachdem Sie eine Instanz erstellt haben, können die GPUs der Instanz nur verwendet werden, wenn die richtigen GPU-Treiber bereits installiert sind. Wenn Sie kein Betriebssystem-Image mit GPU-Treibern angegeben haben, lesen Sie den Abschnitt GPU-Treiber installieren in der Compute Engine-Dokumentation.

Optional: NVIDIA-GPU-Modus für mehrere Instanzen aktivieren

Der MIG-Modus (Multi-Instance GPU) ist eine Funktion, die Sie für eine unterstützte NVIDIA-GPU aktivieren können. Nachdem Sie eine Instanz erstellt haben, können Sie den MIG-Modus auf einer einzelnen GPU aktivieren, die an Ihren Computer angehängt ist. Wenn der MIG-Modus aktiviert ist, wird die einzelne GPU in bis zu sieben unabhängige GPU-Instanzen partitioniert. Jede Instanz wird gleichzeitig ausgeführt und verfügt über einen eigenen Arbeitsspeicher, Cache und eigene Streaming-Multiprozessoren. Anschließend können Sie verschiedene Arbeitslasten parallel auf diesen GPU-Instanzen ausführen. Weitere Informationen zur Verwendung des MIG-Modus finden Sie im Nutzerhandbuch für Multi-Instanz-GPUs (MIG) in der NVIDIA-Dokumentation.

Nächste Schritte