Escolher um tipo de reserva

Este documento descreve os diferentes tipos de reserva que podem ser usados para reservar capacidade para instâncias do Compute Engine. Para saber mais sobre os recursos usados para criar instâncias, consulte Instâncias do Compute Engine.

As reservas garantem que você tenha os recursos disponíveis para criar instâncias com o mesmo hardware (memória e vCPUs) e recursos opcionais (GPUs, clusters de HPC H4D, TPUs ou discos SSD locais) sempre que precisar. As reservas oferecem os seguintes benefícios:

  • Alta garantia de capacidade: você reserva recursos para acomodar aumentos futuros na demanda, como:

    • Crescimento

    • Picos de uso planejados ou não

    • Grandes migrações

    • Backup e recuperação de desastres

  • Acesso exclusivo: as reservas impedem que outras pessoas usem seus recursos reservados.

  • Propriedades herdadas: as reservas herdam as mesmas propriedades da família de máquinas escolhida.

Depois de reservar a capacidade, você pode usá-la para criar instâncias que correspondam à reserva. Não há cobranças extras ao criar essas instâncias. Você só paga por recursos que não fazem parte da reserva, como discos ou endereços IP.

Limitações

Todos os tipos de reserva têm as seguintes limitações:

  • As reservas são recursos específicos da zona.

  • Não é possível usar a capacidade reservada para criar os seguintes recursos do Compute Engine:

    • Tipos de máquina f1-micro e g1-small

    • VMs de início flexível

    • Nós de locatário individual

    • VMs spot ou instâncias preemptivas

Escolher um tipo de reserva

O diagrama a seguir ajuda você a escolher o tipo de reserva do Compute Engine mais adequado às necessidades da sua carga de trabalho:

Um fluxograma com os diferentes métodos de reserva disponíveis no Compute Engine.

As perguntas no diagrama anterior são as seguintes:

  1. Você precisa de capacidade imediatamente?

    • Sim: vá para a próxima pergunta.

    • Não: vá para a pergunta 3.

  2. Você precisa de flexibilidade sobre quanto tempo manter a capacidade?

  3. Você precisa de recursos de alta demanda, como GPUs?

  4. Você precisa de recursos por mais de 90 dias?

Usar reservas imediatas

Com as reservas imediatas, é possível tentar reservar capacidade imediatamente para instâncias de computação. Se a tentativa for bem-sucedida, o Compute Engine vai criar uma reserva para instâncias correspondentes que usam o modelo de provisionamento padrão. Depois de criar uma reserva imediata, você pode consumi-la, modificá-la ou excluí-la sempre que precisar.

Para mais informações, consulte Sobre reservas.

Usar reservas adiantadas

Para reservar instâncias por um período definido, use reservas adiantadas padrão. Depois de criar uma solicitação de reserva, envie-a para Google Cloud análise. Google Cloud normalmente leva cinco dias para analisar sua solicitação. Se a solicitação for aprovada, o Compute Engine vai criar reservas imediatas com a capacidade solicitada na data e hora escolhidas. Para consumir essas reservas, crie instâncias de computação que correspondam às reservas e use o modelo de provisionamento padrão. Após o período de reserva, é possível modificar ou excluir as reservas.

Para mais informações, consulte Sobre solicitações de reserva adiantada.

Usar reservas adiantadas no modo de calendário

Para reservar instâncias de GPU, instâncias H4D ou TPUs por até 90 dias, use reservas adiantadas no modo de calendário. Para criar esse tipo de reserva, primeiro veja quando o número e o tipo de recursos escolhidos estão disponíveis em uma região. Em seguida, crie e envie uma solicitação de reserva com as propriedades que você confirmou como disponíveis. Se você conseguir criar a solicitação,Google Cloud ela será aprovada em um minuto. Depois que a solicitação for aprovada, o Compute Engine vai fazer o seguinte:

  • O Compute Engine cria uma reserva automaticamente.

  • O Compute Engine reserva os recursos solicitados o mais próximo possível uns dos outros para minimizar a latência da rede.

No início do período de reserva, você pode consumir a reserva criando instâncias de GPU, H4D ou TPU correspondentes que usam o modelo de provisionamento vinculado à reserva. No final do período de reserva, o Compute Engine exclui a reserva e interrompe ou exclui todas as instâncias que consomem a reserva com base na ação de encerramento especificada para as instâncias.

Para mais informações, consulte Sobre solicitações de reserva adiantada no modo de calendário.

Usar reservas adiantadas com o Hipercomputador de IA ou clusters de HPC H4D

Entre em contato com a equipe de conta e solicite a reserva de instâncias de GPU para cargas de trabalho de inteligência artificial (IA) e machine learning (ML) em grande escala ou para criar um cluster de instâncias de HPC H4D com recursos aprimorados de gerenciamento de cluster. Depois que o Google criar uma solicitação de reserva de rascunho para você, envie-a para análise se tudo estiver correto. Google Cloud aprova imediatamente a solicitação e, em seguida, o Compute Engine faz o seguinte:

  • O Compute Engine cria uma reserva automaticamente.

  • O Compute Engine reserva os recursos solicitados o mais próximo possível uns dos outros para minimizar a latência da rede.

  • O Compute Engine reserva recursos com programação com reconhecimento de topologia, além de monitoramento e manutenção aprimorados.

No início do período de reserva, você pode consumir a reserva criando instâncias de GPU ou H4D correspondentes que usam o modelo de provisionamento vinculado à reserva. No final do período de reserva, o Compute Engine exclui a reserva e interrompe ou exclui todas as instâncias que consomem a reserva com base na ação de encerramento especificada para as instâncias.

Para mais informações, consulte um dos seguintes links: