Wenn Sie einen Managed Service for Apache Spark-Cluster erstellen, geben Sie eine Compute Engine-Region als Speicherort des Clusters an. Sie können auch eine Zone innerhalb dieser Region angeben oder die Zone auslassen, damit die Funktion zur automatischen Zonenplatzierung von Managed Service for Apache Spark eine Zone in der angegebenen Region für Sie auswählt. Alle Knoten für den Cluster werden in der ausgewählten Zone bereitgestellt.
Sie können Zonen aus den Auswahlkriterien für Auto Zone ausschließen, wenn die Clusterregion mindestens zwei nicht ausgeschlossene Zonen enthält. Weitere Informationen finden Sie unter Automatische Zonenplatzierung verwenden.
Auto Zone- und Ressourcenreservierungen
Bei Auto Zone wird die Erstellung eines Clusters in einer Zone mit Ressourcenreservierungen priorisiert. Das funktioniert so:
Wenn die angeforderten Clusterressourcen vollständig durch reservierte und, falls erforderlich, On-Demand-Ressourcen in einer Zone erfüllt werden können, werden die reservierten und On-Demand-Ressourcen von Auto Zone genutzt und der Cluster in dieser Zone erstellt.
Bei der Auto Zone werden Zonen für die Auswahl nach der Gesamtzahl der reservierten CPU-Kerne (
vCPU) in einer Zone priorisiert.Beispiel:In einer Anfrage zum Erstellen eines Clusters werden 20
n2-standard-2und 1n2-standard-64angegeben (40 + 64vCPUsangefordert). Auto Zone priorisiert die folgenden Zonen für die Auswahl entsprechend der Gesamtzahl der in der Zone verfügbaren vCPU-Reservierungen:- Verfügbare Reservierungen: 3
n2-standard-2und 1n2-standard-64(70vCPUs)zone-c zone-bVerfügbare Reservierungen: 1n2-standard-64(64vCPUs)zone-averfügbare Reservierungen: 25n2-standard-2(50vCPUs)Angenommen, in jeder dieser Zonen sind zusätzliche On-Demand-
vCPUund andere Ressourcen verfügbar, die für die Clusteranfrage ausreichen. In diesem Fall wird Auto Zonezone-cfür die Clustererstellung ausgewählt.
- Verfügbare Reservierungen: 3
Wenn die angeforderten Clusterressourcen in einer Zone nicht vollständig durch reservierte und On-Demand-Ressourcen abgedeckt werden können, wird der Cluster in einer Zone erstellt, in der die Anfrage mit On-Demand-Ressourcen am wahrscheinlichsten erfüllt werden kann.
Auto Zone-Platzierung verwenden
Google Cloud Console
So erstellen Sie einen Cluster mit Auto Zone-Platzierung:
- Öffnen Sie in der Google Cloud Console die Seite Cluster erstellen.
- Wählen Sie im Bereich Cluster definieren eine Region aus.
- Wählen Sie im Feld Zone die Option Beliebig aus.
Zonen ausschließen:Das Angeben von Zonen, die von der automatischen Auto Zone-Platzierung ausgeschlossen werden sollen, wird über die Google Cloud Console nicht unterstützt. Dieses Feature ist über die Google Cloud CLI und die REST API verfügbar.
gcloud-CLI
Verwenden Sie den Befehl gcloud dataproc clusters create, um einen Managed Service for Apache Spark-Cluster mit Auto Zone-Platzierung zu erstellen. Setzen Sie das --region-Flag auf eine Region. Lassen Sie dann entweder das --zone-Flag weg oder setzen Sie es auf einen leeren String (--zone="").--zone
--auto-zone-exclude-zones verwenden, um eine durch Kommas getrennte Liste von Zonen anzugeben. Bei der Auto Zone-Auswahl wird eine Zone aus der angegebenen Region ausgewählt, die aufgeführten Zonen werden jedoch aus den Auswahlkriterien ausgeschlossen. Es müssen mindestens zwei nicht ausgeschlossene Zonen in der Clusterregion verfügbar sein.
Beispiele:
Grundlegende Verwendung der Auto Zone:
gcloud dataproc clusters create CLUSTER_NAME \ --region=REGION \ other args ...
Auto Zone mit ausgeschlossenen Zonen:
gcloud dataproc clusters create CLUSTER_NAME \ --region=REGION \ --auto-zone-exclude-zones=ZONE_1,ZONE_2 \ other args ...
REST API
Gehen Sie zum Erstellen eines Managed Service for Apache Spark-Clusters mit Auto Zone-Platzierung so vor: Erstellen Sie die JSON API-Anfrage clusters.create und lassen Sie das Feld gceClusterConfig.zoneUri leer. Geben Sie im REST-Endpunkt https://dataproc.googleapis.com/v1/projects/projectId/regions/region/clusters einen Regionsnamen ein. Die automatische Zonenplatzierung von Managed Service for Apache Spark wählt eine Zone für den Cluster innerhalb der angegebenen Region aus.
Wenn Sie bestimmte Zonen ausschließen möchten, können Sie das Feld gceClusterConfig.autoZoneExcludeZoneUris mit einer Liste der auszuschließenden Zonennamen füllen. Es müssen mindestens zwei nicht ausgeschlossene Zonen in der Clusterregion verfügbar sein.
Kurze Ressourcennamen mit Auto Zone-Platzierung verwenden: Wenn Sie in einer REST API-Anfrage zum Erstellen eines Clusters mit Auto Zone-Platzierung einen Ressourcen-URI wie machineTypeUri oder acceleratorTypeUri angeben, verwenden Sie einen kurzen Ressourcennamen ohne Zonenspezifikation, z. B. „n1-standard-2“ oder „nvidia-tesla-t4“.