Sie wählen für die Clusterknoten von Managed Service for Apache Spark nichtflüchtigen Standardspeicher, nichtflüchtigen SSD-Speicher, abgestimmten nichtflüchtigen Speicher, oder abgestimmten Google Cloud Hyperdisk-Speicher als Bootlaufwerke aus.
Optionen für den Bootlaufwerktyp:
Sie können für Masterknoten, primäre Worker-Knoten und sekundäre Worker-Knoten des Clusters ein Standard-Bootlaufwerk, ein SSD-Bootlaufwerk oder ein abgestimmtes Bootlaufwerk auswählen.
Sie können abgestimmten Hyperdisk-Speicher als Bootlaufwerk für Masterknoten und primäre Worker-Knoten auswählen. Wenn der Bootlaufwerktyp des primären Worker-Knotens auf „abgestimmter Hyperdisk-Speicher“ festgelegt ist, wird der Bootlaufwerktyp des sekundären Worker-Knotens automatisch auf „abgestimmter Hyperdisk-Speicher“ festgelegt.
Der standardmäßige nichtflüchtige Bootlaufwerktyp für Managed Service for Apache Spark-Cluster
Masterknoten und primäre Worker-Knoten ist Standard (pd-standard). Wenn der VM
Maschinentyp
nur abgestimmten Hyperdisk-Speicher
als Bootlaufwerk unterstützt, ist das Standard-Bootlaufwerk abgestimmter Hyperdisk-Speicher (hyperdisk-balanced).
Der standardmäßige nichtflüchtige Bootlaufwerktyp für sekundäre Worker-Knoten des Clusters ist der
nichtflüchtige Bootlaufwerktyp des primären Worker-Knotens.
Nichtflüchtige Bootlaufwerktypen für Clusterknoten auswählen
Sie können den nichtflüchtigen Bootlaufwerktyp auswählen, wenn Sie einen Cluster über die Google Cloud Console, die Google Cloud CLI oder die Dataproc API erstellen.
Google Cloud Console
So wählen Sie Bootlaufwerktypen für Clusterknoten aus:
- Öffnen Sie die Seite Managed Service for Apache Spark Cluster erstellen.
- Klicken Sie auf Zusätzliche Konfiguration , um den Bereich zu maximieren.
- Klicken Sie auf Primäre Worker und Sekundäre Worker , um die Standardeinstellungen zu bestätigen oder zu ändern.
- Standardmäßig sind die Einstellungen für den Treiberknoten (Masterknoten) mit den Einstellungen für den primären Worker identisch. Unter Zusätzliche Konfiguration können Sie auf Treiberknoten klicken, um das Kästchen Treiberknoten standardmäßig auf primären Worker festlegen zu deaktivieren und dann die Einstellungen für den Treiberknoten anzugeben.
gcloud CLI
Sie können einen Cluster erstellen und Bootlaufwerktypen für Clusterknoten auswählen. Verwenden Sie dazu den
gcloud dataproc clusters create
Befehl mit den --master-boot-disk-type,
--worker-boot-disk-type und
--secondary-worker-boot-disk-type Flags.
gcloud dataproc clusters create CLUSTER_NAME \ --region=REGION \ --master-boot-disk-type=pd-ssd \ --worker-boot-disk-type=hyperdisk-balanced \ other args ...
REST API
Sie können in der masterConfig, workerConfig, und
secondaryWorkerConfig im
InstanceGroupConfig.DiskConfig.bootDiskType
Feld im Rahmen einer
cluster.create
API-Anfrage einen Wert von pd-standard, pd-ssd, pd-balanced, oder hyperdisk-balanced festlegen.
Hyperdisk-Einstellungen
Wenn Sie einen Cluster mit einem abgestimmten Hyperdisk-Volume als Bootlaufwerk für einen Managed Service for Apache Spark-Clusterknoten erstellen, können Sie die bereitgestellten IOPS und den Durchsatz festlegen.
Console
So konfigurieren Sie die bereitgestellten IOPS und den Durchsatz:
- Öffnen Sie die Seite Managed Service for Apache Spark Cluster erstellen.
- Klicken Sie auf Zusätzliche Konfiguration , um den Bereich zu maximieren.
- Klicken Sie auf Treiberknoten oder Primäre Worker.
- Konfigurieren Sie im daraufhin geöffneten Steuerfeld die Einstellungen für die bereitgestellten IOPS und den Durchsatz und klicken Sie dann auf Speichern.
gcloud CLI
Sie können die bereitgestellten IOPS und den bereitgestellten Durchsatz für Clusterknoten mit den
abgestimmten Hyperdisk-Bootlaufwerken mit dem
gcloud dataproc clusters create
Befehl --master-boot-disk-provisioned-iops,
--worker-boot-disk-provisioned-iops,
--master-boot-disk-provisioned-throughput und
--worker-boot-disk-provisioned-throughput Flags festlegen.
gcloud dataproc clusters create CLUSTER_NAME \ --region=REGION \ --master-boot-disk-type=hyperdisk-balanced \ --master-boot-disk-provisioned-iops=MASTER_BOOT_DISK_IOPS \ --master-boot-disk-provisioned-throughput=MASTER_BOOT_DISK_THROUGHPUT \ --worker-boot-disk-type=hyperdisk-balanced \ --worker-boot-disk-provisioned-iops=WORKER_BOOT_DISK_IOPS \ --worker-boot-disk-provisioned-throughput=WORKER_BOOT_DISK_THROUGHPUT \ other args ...
REST API
Sie können die bereitgestellten IOPS und den bereitgestellten Durchsatz für Clusterknoten mit
Hyperdisk-Bootlaufwerken mit den Feldern InstanceGroupConfig.DiskConfig.bootDiskProvisionedIops und InstanceGroupConfig.DiskConfig.bootDiskProvisionedThroughput für
die Master- und Worker-Konfigurationen festlegen.