O Hipercomputador de IA oferece várias
opções de consumo
para ajudar você a conseguir e usar recursos de computação. Este documento oferece uma visão geral de como você pode conseguir capacidade para cada opção de consumo.
Como conseguir capacidade
A tabela a seguir descreve como você pode conseguir capacidade para cada opção de consumo.
Opção de consumo
Processo para conseguir capacidade
Implicações nos preços
Reservas adiantadas no Hipercomputador de IA
Para conseguir recursos de reserva adiantada, o processo é o seguinte:
A cota é aumentada automaticamente antes da entrega da capacidade. Nenhuma
ação é necessária.
Ao
criar uma
instância ou cluster do Compute Engine, especifique o modelo de provisionamento vinculado à reserva. As instâncias e clusters de computação são provisionados com base na
capacidade reservada.
A cobrança é feita por todo o período de reserva, mesmo que você não use
os recursos reservados durante todo o período. Para mais informações, consulte a seção
Faturamento de reserva da documentação de reservas do Compute Engine.
Reservas adiantadas por menos de 90 dias (no modo de calendário)
Para conseguir recursos de reserva adiantada, o processo é o seguinte:
Nenhuma cota é cobrada e nenhuma ação é necessária.
Ao
criar uma instância ou cluster de
computação, é necessário especificar o modelo de provisionamento
vinculado à reserva. As instâncias e clusters de computação são provisionados com base na
capacidade reservada.
Quando os recursos solicitados ficam disponíveis, o Compute Engine
provisiona as VMs. As VMs são executadas por até sete dias.
A cobrança é feita quando os recursos estão em uso. Os recursos provisionados usando o início flexível recebem descontos automaticamente com os preços doProgramador dinâmico de cargas de trabalho.
Sob demanda
Para essa opção de consumo, a reserva de capacidade é opcional.
Os recursos sob demanda só estão disponíveis para GPUs gerais
(como N1, G2, G4, A2 ou A3 Edge). Para conseguir esses recursos sob demanda, o
processo é o seguinte:
Solicite uma cota de GPU padrão para o tipo de máquina
que você quer usar. Para mais informações, consulte
Solicitar um aumento de cota.
Crie uma instância ou cluster de computação e especifique o
modelo de provisionamento padrão. Os recursos são provisionados imediatamente com base na
capacidade disponível.
As taxas padrão sob demanda são aplicadas enquanto os recursos estão em uso.
Reservas imediatas
As reservas imediatas (às vezes chamadas de reservas) só estão disponíveis para GPUs gerais (como
G2, G4, A2 ou A3 Edge). Para reservar capacidade, o processo é o seguinte:
Solicite uma cota de GPU padrão para o tipo de máquina. Para mais detalhes,
consulte Solicitar um aumento de cota.
Crie uma reserva imediata para seu tipo específico de VM e GPU
usando o Google Cloud console, a CLI gcloud ou outros métodos. Para detalhes sobre todos os métodos de criação de reservas, consulte Criar uma reserva para um único projeto.
Provisione os recursos criando uma instância ou cluster
e direcionando para sua reserva específica.
As taxas padrão são aplicadas durante todo o período de reserva. Aplique CUDs para economias significativas.
Reservas adiantadas padrão
Para essa opção de consumo, você reserva capacidade para uma data futura. As reservas adiantadas padrão usam o modelo de provisionamento padrão e só estão disponíveis para GPUs gerais.
Solicite uma cota de GPU padrão para o tipo de máquina. Para mais detalhes, consulte Solicitar um aumento de cota.
Crie uma solicitação de reserva adiantada para seu tipo específico de VM e GPU.
Quando a reserva atingir o horário de início, crie instâncias de computação usando a capacidade reservada.
As taxas padrão são aplicadas durante todo o período de reserva. Aplique CUDs para economias significativas.
Spot
Para essa opção de consumo, não é necessário fazer uma reserva. Para conseguir
recursos spot, o processo é o seguinte:
Ao
criar uma
instância ou cluster de computação, especifique o modelo de provisionamento spot. Os recursos
são provisionados para você à medida que a capacidade fica disponível, mas podem ser
preemptivos a qualquer momento.
A cobrança é feita quando os recursos estão em uso. As VMs spot
recebem descontos automaticamente com os
preços de VMs spot.
A seguir
Para analisar as opções disponíveis para consumir recursos, consulte Modelos
de consumo.
[[["Fácil de entender","easyToUnderstand","thumb-up"],["Meu problema foi resolvido","solvedMyProblem","thumb-up"],["Outro","otherUp","thumb-up"]],[["Difícil de entender","hardToUnderstand","thumb-down"],["Informações incorretas ou exemplo de código","incorrectInformationOrSampleCode","thumb-down"],["Não contém as informações/amostras de que eu preciso","missingTheInformationSamplesINeed","thumb-down"],["Problema na tradução","translationIssue","thumb-down"],["Outro","otherDown","thumb-down"]],["Última atualização 2026-09-10 UTC."],[],[]]