Visão geral da capacidade

O Hipercomputador de IA oferece várias opções de consumo para ajudar você a receber e usar recursos de computação. Este documento fornece uma visão geral de como você pode conseguir capacidade para cada opção de consumo.

Como conseguir capacidade

A tabela a seguir descreve como você pode conseguir capacidade para cada opção de consumo.

Opção de consumo Processo para obter capacidade Implicações nos preços
Reservas adiantadas no Hipercomputador de IA

Para receber recursos de reserva adiantada, o processo é o seguinte:

  1. Entre em contato com sua equipe de conta para reservar capacidade.
  2. A cota é aumentada automaticamente antes da entrega da capacidade. Nenhuma ação é necessária.
  3. Ao criar uma instância ou cluster do Compute Engine, especifique o modelo de provisionamento vinculado à reserva. As instâncias e os clusters de computação são provisionados com base na capacidade reservada.
Você recebe cobranças por todo o período da reserva, mesmo que não use os recursos reservados durante todo o período. Para mais informações, consulte a seção Faturamento de reservas na documentação de reservas do Compute Engine.
Reservas adiantadas por menos de 90 dias (no modo de calendário)

Para receber recursos de reserva adiantada, o processo é o seguinte:

  1. Pesquise a capacidade disponível e reserve recursos.
  2. Nenhuma cota é cobrada, e você não precisa fazer nada.
  3. Ao criar uma instância ou um cluster de computação, especifique o modelo de provisionamento vinculado à reserva. As instâncias e os clusters de computação são provisionados com base na capacidade reservada.
Você vai receber cobranças por todo o período da reserva, mesmo que não use os recursos reservados durante todo o período. Para mais informações, consulte Preços do programador de cargas de trabalho dinâmicas.
Início flexível

Para essa opção de consumo, não é necessário fazer reserva. Para receber recursos de início flexível, o processo é o seguinte:

  1. Você precisa solicitar uma cota preemptiva para o tipo de máquina com GPU que quer usar.
  2. Ao criar instâncias ou clusters de computação usando uma das seguintes opções, especifique o modelo de provisionamento de início flexível:

    Quando os recursos solicitados ficam disponíveis, o Compute Engine provisiona as VMs. As VMs são executadas por até sete dias.

Você recebe uma cobrança quando os recursos estão em uso. Os recursos provisionados usando o início flexível recebem descontos automaticamente com os preços do Programador dinâmico de cargas de trabalho.
Sob demanda

Para essa opção de consumo, reservar capacidade é opcional. Os recursos sob demanda estão disponíveis apenas para GPUs de uso geral (como N1, G2, G4, A2 ou A3 Edge). Para receber esses recursos sob demanda, o processo é o seguinte:

  1. Solicite uma cota de GPU padrão para o tipo de máquina que você quer usar. Para mais informações, consulte Solicitar um aumento de cota.
  2. Verifique a disponibilidade consultando as regiões preferidas para seu hardware na lista do Compute Engine Disponibilidade de GPUs por região e zona.
  3. Crie uma instância de computação ou um cluster e especifique o modelo de provisionamento padrão. Os recursos são provisionados imediatamente com base na capacidade disponível.
As taxas padrão sob demanda são aplicadas enquanto os recursos estão em uso.
Reservas imediatas

As reservas sob demanda (às vezes chamadas de reservas) estão disponíveis apenas para GPUs de uso geral, como G2, G4, A2 ou A3 Edge. Para reservar capacidade, o processo é o seguinte:

  1. Solicite uma cota de GPU padrão para seu tipo de máquina. Para mais detalhes, consulte Solicitar um aumento de cota.
  2. Crie uma reserva imediata para sua VM e tipo de GPU específicos usando o console Google Cloud , a CLI gcloud ou outros métodos. Para mais detalhes sobre todos os métodos de criação de reservas, consulte Criar uma reserva para um único projeto.
  3. Provisione seus recursos criando uma instância ou um cluster e segmentando sua reserva específica.
As taxas padrão são válidas para todo o período da reserva. Aplique CUDs para economizar muito.
Reservas adiantadas padrão

Nessa opção de consumo, você reserva capacidade para uma data futura. As reservas adiantadas padrão usam o modelo de provisionamento padrão e estão disponíveis apenas para GPUs gerais.

  1. Solicite uma cota de GPU padrão para seu tipo de máquina. Para mais detalhes, consulte Solicitar um aumento de cota.
  2. Crie uma solicitação de reserva adiantada para sua VM e tipo de GPU específicos.
  3. Quando a reserva atingir o horário de início, crie instâncias de computação usando a capacidade reservada.
As taxas padrão são válidas para todo o período da reserva. Aplique CUDs para economizar muito.
Spot

Para essa opção de consumo, não é necessário fazer reserva. Para receber recursos spot, o processo é o seguinte:

  1. Você precisa solicitar uma cota preemptiva para o tipo de máquina com GPU que quer usar.
  2. Confira a disponibilidade de recursos na região ou zona em que você quer criar instâncias de computação.
  3. Ao criar uma instância ou cluster de computação, especifique o modelo de provisionamento spot. Os recursos são provisionados para você à medida que a capacidade fica disponível, mas podem ser interrompidos a qualquer momento.
Você recebe uma cobrança quando os recursos estão em uso. As VMs spot recebem descontos automaticamente com os preços das VMs spot.

A seguir