Visão geral da capacidade

O Hipercomputador de IA oferece várias opções de consumo para ajudar você a conseguir e usar recursos de computação. Este documento oferece uma visão geral de como você pode conseguir capacidade para cada opção de consumo.

Como conseguir capacidade

A tabela a seguir descreve como você pode conseguir capacidade para cada opção de consumo.

Opção de consumo Processo para conseguir capacidade Implicações nos preços
Reservas adiantadas no Hipercomputador de IA

Para conseguir recursos de reserva adiantada, o processo é o seguinte:

  1. Reserve capacidade entrando em contato com sua equipe de conta.
  2. A cota é aumentada automaticamente antes da entrega da capacidade. Nenhuma ação é necessária.
  3. Ao criar uma instância ou cluster do Compute Engine, especifique o modelo de provisionamento vinculado à reserva. As instâncias e clusters de computação são provisionados com base na capacidade reservada.
A cobrança é feita por todo o período de reserva, mesmo que você não use os recursos reservados durante todo o período. Para mais informações, consulte a seção Faturamento de reserva da documentação de reservas do Compute Engine.
Reservas adiantadas por menos de 90 dias (no modo de calendário)

Para conseguir recursos de reserva adiantada, o processo é o seguinte:

  1. Pesquise a capacidade disponível e reserve recursos.
  2. Nenhuma cota é cobrada e nenhuma ação é necessária.
  3. Ao criar uma instância ou cluster de computação, é necessário especificar o modelo de provisionamento vinculado à reserva. As instâncias e clusters de computação são provisionados com base na capacidade reservada.
A cobrança é feita por todo o período de reserva, mesmo que você não use os recursos reservados durante todo o período. Para mais informações, consulte Preços do Programador dinâmico de cargas de trabalho.
Início flexível

Para essa opção de consumo, não é necessário fazer uma reserva. Para conseguir recursos de início flexível, o processo é o seguinte:

  1. É necessário solicitar uma cota preemptiva para o tipo de máquina de GPU que você quer usar.
  2. Ao criar instâncias ou clusters de computação usando uma das seguintes opções, especifique o modelo de provisionamento de início flexível:

    Quando os recursos solicitados ficam disponíveis, o Compute Engine provisiona as VMs. As VMs são executadas por até sete dias.

A cobrança é feita quando os recursos estão em uso. Os recursos provisionados usando o início flexível recebem descontos automaticamente com os preços doProgramador dinâmico de cargas de trabalho.
Sob demanda

Para essa opção de consumo, a reserva de capacidade é opcional. Os recursos sob demanda só estão disponíveis para GPUs gerais (como N1, G2, G4, A2 ou A3 Edge). Para conseguir esses recursos sob demanda, o processo é o seguinte:

  1. Solicite uma cota de GPU padrão para o tipo de máquina que você quer usar. Para mais informações, consulte Solicitar um aumento de cota.
  2. Verifique a disponibilidade conferindo as regiões preferenciais do hardware na lista de disponibilidade de GPU do Compute Engine por região e zona.
  3. Crie uma instância ou cluster de computação e especifique o modelo de provisionamento padrão. Os recursos são provisionados imediatamente com base na capacidade disponível.
As taxas padrão sob demanda são aplicadas enquanto os recursos estão em uso.
Reservas imediatas

As reservas imediatas (às vezes chamadas de reservas) só estão disponíveis para GPUs gerais (como G2, G4, A2 ou A3 Edge). Para reservar capacidade, o processo é o seguinte:

  1. Solicite uma cota de GPU padrão para o tipo de máquina. Para mais detalhes, consulte Solicitar um aumento de cota.
  2. Crie uma reserva imediata para seu tipo específico de VM e GPU usando o Google Cloud console, a CLI gcloud ou outros métodos. Para detalhes sobre todos os métodos de criação de reservas, consulte Criar uma reserva para um único projeto.
  3. Provisione os recursos criando uma instância ou cluster e direcionando para sua reserva específica.
As taxas padrão são aplicadas durante todo o período de reserva. Aplique CUDs para economias significativas.
Reservas adiantadas padrão

Para essa opção de consumo, você reserva capacidade para uma data futura. As reservas adiantadas padrão usam o modelo de provisionamento padrão e só estão disponíveis para GPUs gerais.

  1. Solicite uma cota de GPU padrão para o tipo de máquina. Para mais detalhes, consulte Solicitar um aumento de cota.
  2. Crie uma solicitação de reserva adiantada para seu tipo específico de VM e GPU.
  3. Quando a reserva atingir o horário de início, crie instâncias de computação usando a capacidade reservada.
As taxas padrão são aplicadas durante todo o período de reserva. Aplique CUDs para economias significativas.
Spot

Para essa opção de consumo, não é necessário fazer uma reserva. Para conseguir recursos spot, o processo é o seguinte:

  1. É necessário solicitar uma cota preemptiva para o tipo de máquina de GPU que você quer usar.
  2. Confira a disponibilidade de recursos na região ou zona em que você quer criar instâncias de computação.
  3. Ao criar uma instância ou cluster de computação, especifique o modelo de provisionamento spot. Os recursos são provisionados para você à medida que a capacidade fica disponível, mas podem ser preemptivos a qualquer momento.
A cobrança é feita quando os recursos estão em uso. As VMs spot recebem descontos automaticamente com os preços de VMs spot.

A seguir