Selecione disco permanente padrão, SSD, equilibrado Persistent Disk, ou Google Cloud Hyperdisk equilibrado como discos de inicialização para nós de cluster do Serviço Gerenciado para Apache Spark.
Opções de tipo de disco de inicialização:
É possível selecionar um disco permanente padrão, SSD ou equilibrado como disco de inicialização para nós de cluster mestre, worker principal e worker secundário.
É possível selecionar o hiperdisco equilibrado como disco de inicialização para nós mestre e worker principal. Observação: o Serviço Gerenciado para Apache Spark define automaticamente o tipo de disco de inicialização do worker secundário como Hyperdisk Balanced quando o tipo de disco de inicialização do worker principal é definido como Hyperdisk Balanced.
O tipo de disco de inicialização permanente padrão para nós mestre e de trabalho principal do cluster do Serviço Gerenciado para Apache Spark é padrão (pd-standard). Se o tipo de máquina da VM oferecer suporte apenas ao Hyperdisk Balanced como disco de inicialização, o disco de inicialização padrão será Hyperdisk Balanced (hyperdisk-balanced). O tipo de disco de inicialização permanente padrão para nós de trabalho secundário do cluster é o tipo de disco de inicialização permanente do nó de trabalho principal.
Selecionar tipos de disco de inicialização permanente para nós de cluster
É possível selecionar o tipo de disco de inicialização permanente ao criar um cluster usando o Google Cloud console, a Google Cloud CLI ou a API Dataproc.
Google Cloud Console
Para selecionar tipos de disco de inicialização de nós de cluster:
- Abra a página Criar um cluster do Serviço Gerenciado para Apache Spark.
- Clique em Configuração adicional para expandir essa seção.
- Clique em Workers principais e Workers secundários para confirmar ou mudar as configurações padrão.
- Por padrão, as configurações do nó do driver (mestre) são as mesmas que as configurações do worker principal. Em Configuração adicional, clique em Nó do driver para desmarcar a caixa de seleção Nó do driver padrão é o mesmo que o do worker principal e especifique as configurações do nó do driver.
CLI gcloud
É possível criar um cluster e selecionar tipos de disco de inicialização de nós de cluster usando o
comando gcloud dataproc clusters create
com as flags --master-boot-disk-type,
--worker-boot-disk-type e
--secondary-worker-boot-disk-type.
gcloud dataproc clusters create CLUSTER_NAME \ --region=REGION \ --master-boot-disk-type=pd-ssd \ --worker-boot-disk-type=hyperdisk-balanced \ other args ...
API REST
É possível definir um valor de pd-standard, pd-ssd,
pd-balanced, ou hyperdisk-balanced no
InstanceGroupConfig.DiskConfig.bootDiskType
campo em masterConfig, workerConfig, e
secondaryWorkerConfig como parte de uma
cluster.create
solicitação de API.
Configurações do hiperdisco
Ao criar um cluster com um volume equilibrado do hiperdisco como disco de inicialização para um nó de cluster do Serviço Gerenciado para Apache Spark, é possível definir as IOPS e a capacidade de processamento provisionadas.
Console
Para configurar as IOPS e a capacidade de processamento provisionadas:
- Abra a página Criar um cluster do Serviço Gerenciado para Apache Spark.
- Clique em Configuração adicional para expandir essa seção.
- Clique em Nó do driver ou Workers principais.
- No painel que é aberto, configure as IOPS e as configurações de capacidade de processamento provisionadas e clique em Salvar.
CLI gcloud
É possível definir as IOPS e a capacidade de processamento provisionadas para nós de cluster com os
discos de inicialização do hiperdisco equilibrado usando o
gcloud dataproc clusters create
comando --master-boot-disk-provisioned-iops,
--worker-boot-disk-provisioned-iops,
--master-boot-disk-provisioned-throughput e
--worker-boot-disk-provisioned-throughput flags.
gcloud dataproc clusters create CLUSTER_NAME \ --region=REGION \ --master-boot-disk-type=hyperdisk-balanced \ --master-boot-disk-provisioned-iops=MASTER_BOOT_DISK_IOPS \ --master-boot-disk-provisioned-throughput=MASTER_BOOT_DISK_THROUGHPUT \ --worker-boot-disk-type=hyperdisk-balanced \ --worker-boot-disk-provisioned-iops=WORKER_BOOT_DISK_IOPS \ --worker-boot-disk-provisioned-throughput=WORKER_BOOT_DISK_THROUGHPUT \ other args ...
API REST
É possível definir as IOPS e a capacidade de processamento provisionadas para nós de cluster com
discos de inicialização do hiperdisco usando os campos InstanceGroupConfig.DiskConfig.bootDiskProvisionedIops e InstanceGroupConfig.DiskConfig.bootDiskProvisionedThroughput para
as configurações mestre e worker.