Otimizar o provisionamento de computação

Configurar suas cargas de trabalho para depender de um único tipo de máquina ou zona pode limitar sua capacidade de acessar recursos disponíveis durante picos de demanda. Para otimizar o provisionamento de computação e manter as cargas de trabalho em execução durante picos de demanda, é necessário projetar uma infraestrutura flexível do Compute Engine. Com a flexibilidade da infraestrutura, é possível especificar várias zonas, tipos de máquinas ou horários de início em vez de uma configuração fixa. O Compute Engine seleciona automaticamente suas opções preferidas, ajudando você a maximizar a disponibilidade de recursos, melhorar o custo-benefício e adotar com segurança o hardware mais recente.

Este documento explica as dimensões da flexibilidade da infraestrutura, os benefícios dela e como escolher a abordagem certa para sua carga de trabalho. Ele também descreve os recursos relevantes do Compute Engine, as considerações de design e as etapas para adoção. Este documento é destinado a arquitetos de soluções, operadores de infraestrutura e engenheiros de nuvem que projetam ou gerenciam infraestrutura de computação.

Flexibilidade da infraestrutura

É possível projetar a flexibilidade da infraestrutura nas três dimensões a seguir:

  • Flexibilidade de local (onde): distribua instâncias do Compute Engine em várias zonas de uma região para maximizar o acesso aos recursos disponíveis ou selecione automaticamente uma única zona com capacidade disponível para cargas de trabalho sensíveis à latência.

  • Flexibilidade do tipo de máquina (o quê): especifique uma lista classificada de tipos de máquina compatíveis, permitindo que sua carga de trabalho use alternativas quando necessário.

  • Flexibilidade de tempo (quando): coloque na fila solicitações de recursos de alta demanda, como aceleradores, em vez de exigir provisionamento imediato para cargas de trabalho que não precisam começar imediatamente.

Benefícios de uma infraestrutura flexível

Adotar uma infraestrutura flexível do Compute Engine oferece os seguintes benefícios:

  • Automatiza o gerenciamento de capacidade durante picos de demanda. Suas cargas de trabalho encontram e usam recursos automaticamente em vários tipos de máquinas e zonas. Essa abordagem ajuda a garantir que suas solicitações de escalonamento sejam bem-sucedidas, mesmo que o hardware preferido esteja temporariamente indisponível.

  • Simplifica o gerenciamento de capacidade. É possível reduzir a sobrecarga operacional da pesquisa manual de hardware disponível. O Compute Engine redireciona automaticamente suas solicitações com base nas preferências de substituição, reduzindo gargalos operacionais.

  • Mitiga os riscos de capacidade durante a transição para o hardware mais recente. É possível configurar suas implantações para priorizar as gerações de hardware mais recentes e manter as gerações mais antigas como substituição. Essa configuração reduz o risco de adotar as máquinas mais recentes e muito demandadas. Se as mais recentes não estiverem disponíveis, a implantação ainda poderá solicitar capacidade automaticamente para máquinas mais antigas.

  • Otimiza o custo para tráfego de referência e de pico. Você pode reservar capacidade apenas para seu tráfego conhecido e de referência e usar substituições de tipo de máquina para lidar com picos imprevisíveis. Essa abordagem reduz o custo da capacidade de backup ociosa. Você também pode manter a cobertura de descontos em séries de máquinas e regiões usando descontos por compromisso de uso (CUDs) flexíveis de computação, que evitam os preços sob demanda quando sua carga de trabalho muda de série de máquinas ou regiões.

Comparação das dimensões de flexibilidade

É possível combinar a flexibilidade de local com a de tipo de máquina ou de tempo. No entanto, a flexibilidade do tipo de máquina e a flexibilidade de tempo são incompatíveis em uma única implantação. Você precisa escolher entre opções de fallback de hardware ou esperar em uma fila até que os recursos fiquem disponíveis.

Para ajudar você a avaliar essas opções, a tabela a seguir compara como cada dimensão de flexibilidade funciona. Para orientações sobre qual abordagem se adapta ao seu caso de uso específico, consulte Adequação e recomendações de carga de trabalho.

Flexibilidade de local (onde) Flexibilidade do tipo de máquina (o quê) Flexibilidade de horário (quando)
Como isso melhora a disponibilidade Maximiza o acesso aos recursos disponíveis em várias zonas de uma região. Reduz as chances de encontrar erros de recursos indisponíveis ao usar tipos de máquinas alternativos e compatíveis. Obtém recursos de alta demanda colocando solicitações em uma fila para aguardar a disponibilidade de capacidade.
Cronograma de provisionamento Imediato Imediato Na fila
Método de provisionamento Provisiona instâncias de computação com base na disponibilidade em todas as zonas selecionadas. Provisiona instâncias de computação com base na disponibilidade em tipos de máquina selecionados. Provisiona instâncias de computação quando toda a capacidade solicitada está disponível.
Compatibilidade com tipos de máquina Oferece suporte a um ou vários tipos de máquinas em várias zonas. Usa vários tipos de máquina. Aceita apenas um tipo de máquina.

Adequação e recomendações de carga de trabalho

Adotar a flexibilidade da infraestrutura depende da arquitetura e dos requisitos de desempenho da sua carga de trabalho. Para ajudar você a escolher a melhor abordagem, a tabela a seguir resume as dimensões e configurações de flexibilidade recomendadas para alguns tipos comuns de carga de trabalho.

Tipo de carga de trabalho Recomendação de flexibilidade
Processamento em lote sem estado, computação de alta capacidade (HTC) dissociada

Flexibilidade de local e tipo de máquina: use a política de flexibilidade de instância com uma das seguintes opções:

  • Um grupo gerenciado de instâncias (MIG) regional com formato de distribuição ANY
  • Uma criação de instância de computação em massa regional configurada com contagem mínima para permitir atendimento parcial e com formato de distribuição ANY.

Essas abordagens permitem que suas cargas de trabalho sejam escalonadas em diversas zonas e tipos de máquinas para maximizar a disponibilidade de recursos.

Treinamento, ajuste e jobs em lote de grande escala de IA/ML Flexibilidade de tempo: use modelos de provisionamento que usam o Dynamic Workload Scheduler (DWS). Essa abordagem melhora o acesso a recursos de alta demanda, como aceleradores, colocando solicitações em uma fila em vez de exigir provisionamento imediato e sob demanda.
Microsserviços e front-ends da Web Flexibilidade de local e tipo de máquina: use MIGs regionais com o formato de distribuição de destino BALANCED e uma política de flexibilidade de instância. Selecione tipos de máquinas com contagens correspondentes de vCPU e memória para escalonamento automático previsível. Além disso, ative a atualização durante o reparo para que qualquer instância de computação recriada use a configuração de flexibilidade de instância mais recente.
Bancos de dados de alta disponibilidade

Flexibilidade de local e tipo de máquina: use MIGs regionais com formato de distribuição de destino BALANCED para espalhar réplicas em várias zonas e garantir alta disponibilidade. Para evitar variações de desempenho entre réplicas, escolha tipos de máquinas com perfis de desempenho semelhantes.

Sistemas estritamente limitados pela latência Flexibilidade de local: use MIGs regionais com o formato de distribuição ANY_SINGLE_ZONE. Essa forma oferece flexibilidade de localidade ao pesquisar em todas as zonas da região para encontrar capacidade suficiente, garantindo que todas as instâncias sejam colocadas na mesma zona para manter a baixa latência.

Configurações flexíveis podem introduzir variações de hardware que afetam o desempenho do aplicativo. Ao projetar para flexibilidade, avalie as vantagens e desvantagens entre maximizar a disponibilidade de recursos e manter um desempenho consistente. Para orientações, consulte a seção a seguir sobre Avaliar e adotar infraestrutura flexível.

Principais recursos de flexibilidade no Compute Engine

Para automatizar o gerenciamento de capacidade, implemente a flexibilidade em várias camadas da sua infraestrutura. O Compute Engine oferece recursos que permitem flexibilidade de local, tipo de máquina e tempo. É possível configurar esses recursos de forma independente ou combiná-los para atender aos requisitos da sua carga de trabalho.

Recursos de flexibilidade de local

Os recursos de flexibilidade de local maximizam a disponibilidade de recursos distribuindo instâncias de computação em várias zonas de uma região. Para maximizar esse benefício, selecione regiões em que os tipos de máquina preferidos estão disponíveis em todas as zonas.

É possível aplicar a flexibilidade de local aos seguintes tipos de implantação:

  • MIGs:os MIGs regionais avaliam a capacidade em tempo real durante a criação e a manutenção de instâncias para provisionar instâncias de computação onde os recursos estão disponíveis. Se uma zona não tiver capacidade durante um reparo de instância, os MIGs que usam os formatos ANY ou BALANCED poderão recriar automaticamente a instância de computação com falha em outra zona. Para ter os melhores resultados, configure a forma de distribuição de destino com base na meta da carga de trabalho:

    • ANY:recomendado para máxima disponibilidade. Use esse formato para maximizar a disponibilidade de recursos. Esse formato aloca instâncias de computação para qualquer zona com capacidade disponível e prioriza reservas não utilizadas.

    • BALANCED:recomendado para alta disponibilidade. Use esse formato para cargas de trabalho de alta disponibilidade. Ele distribui as instâncias de computação de maneira uniforme entre as zonas para proteger contra interrupções zonais, priorizando as zonas em que os recursos estão disponíveis.

    • ANY_SINGLE_ZONE:recomendado para baixa latência. Use esse formato para limites de latência estritos. Ele aloca todas as instâncias de computação em um MIG em uma única zona com mais recursos disponíveis.

    Para mais informações, consulte Sobre MIGs regionais.

  • Grupos de instâncias não gerenciadas: esses grupos não oferecem suporte nativo à flexibilidade de local. Em vez disso, crie instâncias de computação em massa usando a API regionInstances.bulkInsert, que pode provisionar até 5.000 instâncias de computação autônomas com o formato de distribuição de destino ANY_SINGLE_ZONE. Essa solicitação cria instâncias de computação em uma única zona, e você pode adicioná-las ao grupo não gerenciado. Para instâncias de computação autônomas, o Compute Engine avalia a capacidade para selecionar a zona apenas durante a solicitação de criação da instância.

    Para mais informações, consulte Agrupar VMs não gerenciadas.

  • Instâncias de computação independente:use a solicitação regional de criação de instâncias em massa (API regionInstances.bulkInsert) com um formato de distribuição de destino (ANY, BALANCED ou ANY_SINGLE_ZONE) e defina uma contagem mínima. A contagem mínima permite que sua solicitação provisione o máximo possível de instâncias de computação em vez de falhar completamente se a capacidade total não estiver disponível imediatamente. Para instâncias de computação autônomas, o Compute Engine avalia a capacidade para selecionar a zona apenas durante a solicitação de criação da instância.

    Para mais informações, consulte Sobre a criação em massa de VMs.

Recursos de flexibilidade do tipo de máquina

Com os recursos de flexibilidade do tipo de máquina, sua implantação pode usar uma lista priorizada de tipos de máquinas alternativos. Se a opção principal não estiver disponível, o Compute Engine vai usar automaticamente os tipos de máquina secundários. Para configurar esse recurso, defina uma política de flexibilidade de instância, que consiste em uma lista única ou classificada de várias seleções de instância.

É possível aplicar uma política de flexibilidade de instância aos seguintes tipos de implantação:

  • MIGs:anexe uma política de flexibilidade de instância a um MIG para permitir que o grupo faça fallback automático para hardware alternativo durante picos de demanda. Se o MIG usar VMs spot, essa política vai priorizar automaticamente os tipos de máquina de substituição que oferecem tempos de atividade estimados mais longos e um risco menor de interrupção forçada. Para mais informações, consulte Sobre a flexibilidade de instâncias em MIGs.

  • Grupos não gerenciados de instâncias:como esses grupos não oferecem suporte nativo a políticas de flexibilidade de instância, é possível provisionar as instâncias usando a API regionInstances.bulkInsert e adicioná-las ao grupo. Na solicitação de API, inclua uma política de flexibilidade de instância e especifique uma única zona (locationPolicy.zones.zone) ou use o formato de distribuição de destino ANY_SINGLE_ZONE. Usar o formato ANY_SINGLE_ZONE oferece o benefício adicional da flexibilidade de local, selecionando automaticamente a zona com mais recursos disponíveis. Para instâncias autônomas, o Compute Engine aplica a política de flexibilidade apenas durante a solicitação de criação de instância.

    Para mais informações sobre como criar instâncias de computação em massa, consulte Criar VMs em massa com flexibilidade de instância e, para adicioná-las a um grupo, consulte Agrupar VMs não gerenciadas.

  • Instâncias de computação independente:para cargas de trabalho que não exigem grupos de instâncias, como jobs de processamento em lote independentes, use a API regionInstances.bulkInsert com uma política de flexibilidade de instância para provisionar as instâncias de computação. Para instâncias autônomas, o Compute Engine aplica a política de flexibilidade apenas durante a solicitação de criação de instância.

    Para mais informações, consulte Sobre a flexibilidade de instâncias para VMs criadas em massa.

Escalonar sem problemas em diferentes tipos de máquinas

Quando você configura a flexibilidade do tipo de máquina, os tipos de máquina de substituição podem ter arquiteturas de hardware ou especificações de disco diferentes. Se essas especificações forem incompatíveis para os tipos de máquinas em uma seleção de instâncias, o provisionamento poderá falhar.

Para usar tipos de máquinas com especificações incompatíveis, defina substituições de propriedade na política de flexibilidade de instâncias. Essas substituições garantem que, quando o Compute Engine volta a um tipo de máquina alternativo, ele aplica automaticamente a imagem de inicialização, o tipo de disco ou o baseline do processador correto necessário para esse hardware específico. Com esse recurso, sua implantação pode ser escalonada em diferentes tipos de máquinas sem problemas e com maiores chances de provisionamento bem-sucedido.

Para mais informações, consulte Como funcionam as substituições de plataforma de disco e CPU.

Recursos de flexibilidade de horário

Com os recursos de flexibilidade de tempo, suas cargas de trabalho que não precisam ser iniciadas imediatamente podem esperar por recursos de alta demanda, como aceleradores, em vez de exigir provisionamento imediato.

Para implementar a flexibilidade de tempo, dependendo dos requisitos da sua carga de trabalho, use os seguintes recursos que usam o DWS:

Avaliar e adotar infraestrutura flexível

Antes de configurar a flexibilidade de local ou tipo de máquina, verifique se o local e os tipos de máquina escolhidos são compatíveis entre si e com os requisitos da carga de trabalho. Para ajudar você a projetar e implementar sua infraestrutura flexível, as seções a seguir fornecem considerações importantes sobre a avaliação e uma estratégia de adoção incremental.

Considerações sobre a avaliação

Confira algumas considerações importantes para avaliar uma infraestrutura flexível:

  • Flexibilidade de local:distribuir sua carga de trabalho em várias zonas pode afetar a latência da rede e aumentar os custos de transferência de dados entre zonas.

    Para saber mais, assista a estes vídeos:

  • Flexibilidade do tipo de máquina:o uso de tipos de máquinas alternativos pode gerar variações no desempenho e nos custos do aplicativo. A flexibilidade do tipo de máquina em várias gerações geralmente exige a implementação de substituições de plataforma de disco e CPU. Verifique se os tipos de máquina que você quer usar atendem aos pré-requisitos técnicos do aplicativo.

    Para saber mais, assista a estes vídeos:

Estratégia de adoção

Dependendo de você estar projetando uma nova implantação ou migrando uma existente, escolha a estratégia correspondente da seguinte maneira:

  • Para uma nova carga de trabalho:se você estiver projetando uma nova implantação, recomendamos adotar a flexibilidade no design da infraestrutura. Para identificar as dimensões de flexibilidade recomendadas para seu tipo de carga de trabalho, siga as orientações em Adequação e recomendações de carga de trabalho. Em seguida, escolha o tipo de implantação mais adequado para sua carga de trabalho. Para mais informações sobre os tipos de implantação e as configurações de flexibilidade, consulte a seção Principais recursos de flexibilidade.

  • Para uma implantação atual:se você quiser migrar uma implantação que usa uma única zona ou tipo de máquina para uma infraestrutura flexível, recomendamos adotar a flexibilidade de forma incremental para minimizar o risco. Você pode usar uma estratégia de adoção incremental, como as seguintes:

    1. Adicione flexibilidade de local. Migre cargas de trabalho zonais para um MIG regional com o formato de distribuição BALANCED ou ANY. Se você usa um MIG regional com o formato EVEN, mude para BALANCED. Essa mudança é importante para MIGs que estão escalonando horizontalmente. Uma restrição temporária de capacidade em uma zona não bloqueia a operação de escalonamento horizontal. Como alternativa, se quiser criar instâncias de computação autônomas, use a API regionInstances.bulkInsert.

    2. Adicione tipos de máquina alternativos que compartilham a mesma arquitetura. Anexe uma política de flexibilidade de instância que especifique tipos de máquinas que compartilham a mesma arquitetura de CPU e suporte a disco, por exemplo, n2-standard-8 e n2d-standard-8.

    3. Adicione tipos de máquinas alternativas de diferentes gerações e alinhe os CUDs. Incorpore as gerações de máquinas mais recentes, como n4-standard-8, e use substituições de disco conforme necessário. Além disso, cobrir descontos para uso de fallback com CUDs flexíveis do Compute.

Para garantir uma adoção segura e bem-sucedida de novas implantações e migrações incrementais, recomendamos o seguinte fluxo de trabalho de lançamento:

  • Validar e fazer comparativos. Teste seu aplicativo em todas as famílias de máquinas, combinações de disco e zonas selecionadas em um ambiente de não produção.

  • Produza e dimensione. Implante progressivamente suas políticas de flexibilidade de instância ou formas de distribuição MIG regionais em um subconjunto da sua frota de produção antes de escalonar globalmente.

  • Monitore e otimize. Monitore continuamente suas taxas de fallback, métricas de performance e custos para refinar sua lista priorizada de tipos de máquina. Ao usar MIGs, para acompanhar a distribuição de instâncias de computação em tempo real em tipos de máquinas e zonas, use o painel de monitoramento da distribuição de instâncias do MIG. Para instruções, consulte Monitorar a distribuição de instâncias em MIGs.

Práticas recomendadas

Para maximizar a eficiência e a capacidade de recuperação da sua infraestrutura flexível, use as práticas recomendadas descritas nas seções a seguir.

Práticas recomendadas para flexibilidade de local

  • Use o posicionamento regional com reconhecimento de capacidade. Implante cargas de trabalho usando MIGs regionais ou criação em massa de VMs regionais. Selecione o formato de distribuição BALANCED ou ANY, porque eles permitem que o Compute Engine avalie a capacidade em tempo real em todas as zonas da região para colocar automaticamente as instâncias de computação onde os recursos estão disponíveis.

  • Escolha regiões que ofereçam suporte ao tipo de máquina em várias zonas:implante cargas de trabalho em regiões onde os tipos de máquina selecionados são compatíveis em todas as zonas. Essa abordagem garante que os recursos de flexibilidade de local tenham o máximo de zonas alternativas para encaminhar solicitações durante uma limitação temporária de capacidade. Para conferir uma lista de regiões e zonas, consulte Regiões e zonas disponíveis.

  • Verifique a disponibilidade para implantações de VM spot. Se a implantação usar VMs spot, verifique a disponibilidade em tempo real e o tempo de atividade esperado das VMs spot em vários tipos de máquinas e locais. Escolha uma região ou zona com alta capacidade disponível e um tempo de atividade adequado à sua carga de trabalho para reduzir o risco de remoção. Para mais informações, consulte Ver a disponibilidade de VMs spot (prévia).

Práticas recomendadas para flexibilidade do tipo de máquina

  • Diversifique entre famílias de máquinas. Evite políticas que variam apenas de acordo com os núcleos de CPU em uma única família, por exemplo, n2-standard-4 e n2-standard-8. Restrições de capacidade localizadas podem afetar toda a família de máquinas simultaneamente. Para melhorar a disponibilidade, abranja várias gerações e arquiteturas de máquinas, por exemplo, n4-standard-8 e n2-standard-8.

  • Adote novos tipos de máquina com os mais antigos como substitutos. Incorpore as famílias de máquinas mais recentes à sua política de flexibilidade de instâncias, além das famílias mais antigas, para maximizar a disponibilidade.

  • Configure substituições de disco e plataforma de CPU. A mistura de tipos de máquinas de gerações diferentes pode envolver diferenças em discos e plataformas de CPU. Defina substituições de plataforma de disco e CPU na sua política de flexibilidade para garantir que a infraestrutura seja escalonada em gerações de máquinas sem problemas. Por exemplo, configure o Hyperdisk Balanced para instâncias N4 e o Persistent Disk para substituições N2.

  • Priorize tipos de máquinas menores. Dependendo da adequação da sua carga de trabalho, use tipos de máquinas com menos vCPUs e memória. Por exemplo, em vez de confiar em um único tipo de máquina, como n2-standard-64, avalie se sua carga de trabalho pode ser escalonada em quatro instâncias de computação que usam um tipo de máquina n2-standard-16. Tipos de máquinas menores geralmente têm maior disponibilidade de recursos.

  • Selecione tipos de máquina com desempenho semelhante. Especifique tipos de máquinas alternativos com tamanhos semelhantes de vCPU e memória. Por exemplo, combine n2d-standard-8, n4-standard-8 e n4a-standard-8 na política de flexibilidade da instância. Essa abordagem mantém um desempenho consistente do aplicativo e melhora a disponibilidade de recursos.

  • Ative a atualização durante reparo em MIGs. Por padrão, um MIG corrige uma instância de computação com falha usando o tipo de máquina original, o que pode falhar se esse hardware estiver temporariamente indisponível. Ative a atualização durante o reparo para que os reparos revertam automaticamente para os tipos de máquinas disponíveis na sua política de flexibilidade. Para mais detalhes, consulte Flexibilidade de instâncias e correções de VM.

  • Incorpore VMs spot com substituições. Para cargas de trabalho tolerantes a falhas, combine VMs do Spot com flexibilidade de local e tipo de máquina. Se o Compute Engine forçar a interrupção de uma VM spot, esses recursos de flexibilidade permitirão que sua implantação procure automaticamente tipos de máquinas ou zonas alternativos. Essa estratégia ajuda a manter a disponibilidade de recursos para sua carga de trabalho a um custo menor do que o provisionamento padrão.

Práticas recomendadas para flexibilidade de horário

  • Segmentar as cargas de trabalho certas. Implemente a flexibilidade de tempo para cargas de trabalho que têm horários de início flexíveis, mas exigem recursos de alta demanda, como aceleradores. Esse requisito inclui pré-treinamento de modelos pequenos, ajuste fino de modelos, simulações de computação de alto desempenho (HPC) e inferência em lote.

  • Selecione o recurso adequado para sua linha do tempo. Use o modelo de provisionamento de início flexível para enfileirar solicitações de jobs de duração definida que são executados por até sete dias. Para obter recursos de alta demanda por até 90 dias ou mais, use o modelo de provisionamento vinculado à reserva.

  • Otimize os tempos de espera das VMs flex-start. Ao tentar criar VMs de início flexível, especifique um tempo de espera maior se a carga de trabalho precisar ser executada em uma zona específica. Quanto maior a espera, maiores as chances de o Compute Engine provisionar os recursos solicitados. Se você quiser criar VMs de início flexível independentes e sua carga de trabalho puder ser iniciada em qualquer zona de uma região, especifique um tempo de espera de zero segundos. Se a solicitação de criação falhar porque os recursos não estão disponíveis, tente imediatamente em outra zona.

Alinhar reservas e descontos com a flexibilidade da carga de trabalho

Para equilibrar a disponibilidade e os custos de recursos, combine seus descontos por uso contínuo (CUDs) com a estratégia de capacidade escolhida para sua carga de trabalho:

  • Uso constante em vários tipos de máquinas:se sua carga de trabalho for compatível com vários tipos de máquinas e tiver uso constante, configure a flexibilidade do tipo de máquina e use CUDs flexíveis de computação. A flexibilidade do tipo de máquina melhora as taxas de sucesso do provisionamento usando hardware alternativo quando a opção principal não tem capacidade. Os CUDs flexíveis do Compute são descontos baseados em gastos que se aplicam aos seus gastos qualificados de computação, independente da série de máquinas específica provisionada pelo Compute Engine.

  • Referência estável com picos de tráfego:se sua carga de trabalho tiver uma referência previsível, mas puder sofrer picos imprevisíveis, proteja a referência previsível com reservas e CUDs com base em recursos. Para lidar com picos de tráfego, configure a flexibilidade do tipo de máquina e use CUDs flexíveis do Compute para cobrir as máquinas alternativas de failback. Na política de flexibilidade de instâncias, atribua as preferências da seguinte maneira:

    • Preferência mais alta:tipos de máquinas reservadas com CUDs baseados em recursos

    • Preferências mais baixas:tipos de máquinas alternativas e uso de CUDs flexíveis de computação

    O Compute Engine usa primeiro os compromissos com base em recursos e depois os compromissos flexíveis de computação para cobrir o uso qualificado restante.

  • Cargas de trabalho de hardware estritamente fixas:se a carga de trabalho depender de um único tipo de máquina, use reservas e CUDs baseados em recursos. As reservas oferecem alta garantia de capacidade para hardware específico e devem ser consideradas para cargas de trabalho críticas para os negócios. Os CUDs baseados em recursos oferecem descontos para esse uso previsível e estável.

Para mais informações, consulte Escolher um tipo de reserva e Descontos por uso contínuo (CUDs) do Compute Engine.

Considerações sobre o design de reservas

Se sua estratégia incluir reservas, analise as seguintes considerações de design:

  • Priorize tipos de máquinas reservadas. Se você usar reservas com flexibilidade de tipo de máquina, adicione os tipos de máquina reservados à preferência mais alta na política de flexibilidade de instância. Essa configuração ajuda o Compute Engine a priorizar suas reservas em vez da capacidade sob demanda.

  • Avalie o escopo das suas reservas. Evite criar reservas em resposta a restrições temporárias de capacidade. Se a carga de trabalho usar flexibilidade de local, como MIGs regionais, o Compute Engine poderá distribuir instâncias para outras zonas na região. Uma reserva zonal estrita nesse cenário pode resultar em recursos ociosos e não utilizados.

Limitações

Ao projetar uma infraestrutura flexível, as seguintes limitações gerais se aplicam. Para limitações mais detalhadas, consulte as seções "Limitações" nas páginas de recursos correspondentes.

  • Incompatibilidade de recursos: não é possível combinar a flexibilidade do tipo de máquina e a flexibilidade de tempo em uma única implantação. Os recursos que permitem flexibilidade de horário só aceitam uma configuração de tipo de máquina por solicitação.

  • Flexibilidade durante a criação inicial: para instâncias de computação criadas em massa, a avaliação de capacidade e a política de flexibilidade de instância se aplicam apenas durante a solicitação inicial de criação de instância de computação. As instâncias de computação criadas em massa não são redirecionadas automaticamente para zonas ou tipos de máquinas alternativos durante reparos ou quando você escalona sua infraestrutura.

  • Implantação em uma única zona: os MIGs zonais não são compatíveis com recursos de flexibilidade e não são recomendados. Para adotar a flexibilidade de tipo de máquina em um design de zona única, crie um MIG regional e selecione explicitamente apenas uma zona.

A seguir