Monitorar a distribuição de instâncias em MIGs

Este documento descreve os benefícios, os casos de uso e os procedimentos para monitorar a distribuição de instâncias de máquina virtual (VM) em grupos gerenciados de instâncias (MIGs). Os procedimentos incluem como visualizar, personalizar e consultar o painel Monitoramento da distribuição de instâncias do MIG do GCE no Cloud Monitoring.

Quando o MIG usa a flexibilidade de local para distribuir instâncias em várias zonas, a flexibilidade de instância para especificar vários tipos de máquina compatíveis ou ambos, o MIG seleciona e provisiona instâncias de maneira dinâmica com base na disponibilidade de recursos em tempo real. Para observar esse comportamento dinâmico no ambiente de execução em todos os MIGs, use o painel Monitoramento da distribuição de instâncias do MIG do GCE. Esse painel pré-configurado oferece visibilidade em tempo real de como as instâncias são distribuídas entre zonas e tipos de máquina ao longo do tempo. O painel também mostra as instâncias em execução (ativas) e não em execução (inativas) e a contagem total de instâncias durante o período. Por exemplo, é possível interpretar as métricas do painel para diagnosticar a alocação de capacidade, o equilíbrio zonal e o comportamento de fallback.

Benefícios do monitoramento da distribuição de instâncias em MIGs

Quando o MIG implanta instâncias em várias zonas em um grupo regional ou quando você especifica vários tipos de máquina e classificações em uma política de flexibilidade de instância, a distribuição real de locais e tipos de máquina muda dinamicamente, dependendo da disponibilidade de recursos.

O monitoramento da distribuição de instâncias do ambiente de execução ajuda você a fazer o seguinte:

  • Melhorar a capacidade de obtenção e atenuar as restrições de capacidade: verifique se o seu MIG está recebendo recursos ao fazer o escalonamento horizontal. A criação de instâncias em classificações de fallback mostra que a política de flexibilidade de instância está atenuando com eficiência as restrições temporárias de capacidade. No entanto, se o grupo tiver dificuldades para atingir o tamanho desejado, considere expandir os tipos de máquina permitidos ou adicionar mais zonas para reduzir a probabilidade de erros futuros de disponibilidade de recursos.

  • Verificar a flexibilidade de local e o equilíbrio zonal: confirme se um MIG regional está equilibrando a capacidade entre as zonas conforme o esperado (EVEN ou BALANCED) ou observe como a capacidade muda dinamicamente entre as zonas ao usar ANY ou ANY_SINGLE_ZONE formatos de distribuição de destino.

  • Equilibrar custo e desempenho: ao acompanhar quais tipos de máquina são selecionados para MIGs com flexibilidade de instância, você pode entender melhor seus gastos e desempenho, além de procurar oportunidades de melhoria. Por exemplo, se as instâncias estiverem oferecendo um desempenho consistentemente maior do que o exigido pela carga de trabalho, investigue se ela pode tolerar a priorização de opções com custos mais baixos. Como alternativa, se você notar problemas de desempenho, com base na capacidade de obtenção, considere priorizar tipos de máquina de alto desempenho em vez de dividir a carga de trabalho em mais máquinas.

Para saber mais sobre como o painel de monitoramento ajuda com perguntas de observabilidade, consulte Interpretar o painel neste documento.

Monitorar a distribuição de instâncias do MIG

É possível monitorar a distribuição de instâncias em um MIG usando uma das seguintes maneiras:

  • Use o painel do Cloud Monitoring para conferir uma representação visual da distribuição de instâncias. Para mais informações, consulte Sobre o painel de monitoramento neste documento.

  • Consulte as métricas subjacentes de maneira programática usando o PromQL como uma alternativa baseada em código que permite integrar os dados de distribuição de instâncias aos painéis de observabilidade personalizados ou ferramentas de monitoramento externas, como o Grafana. Para mais informações, consulte Consultar de maneira programática usando o PromQL neste documento.

Sobre o painel de monitoramento

O Cloud Monitoring oferece painéis pré-configurados na categoria Serviços do Google. Para MIGs, o painel Monitoramento da distribuição de instâncias do MIG do GCE oferece os quatro gráficos especializados a seguir:

  • Distribuição de instâncias por zona: um gráfico que mostra a contagem de instâncias agrupadas por zona, mostrando a flexibilidade de local e a distribuição zonal nas regiões.

  • Distribuição de instâncias por tipo de máquina: um gráfico que mostra a contagem de instâncias agrupadas por tipo de máquina, mostrando como o grupo aloca capacidade em diferentes tipos e tamanhos de máquina.

  • Instâncias ativas x inativas: um gráfico que mostra o número de instâncias agrupadas por estarem ativas ou inativas. Uma instância ativa está totalmente operacional e em execução (RUNNING). Uma instância inativa é aquela que não está em execução, mas não foi excluída. Isso inclui instâncias que estão sendo criadas (PROVISIONING, STAGING), pausadas (SUSPENDED) ou desligadas (STOPPED, TERMINATED).

  • Contagem total de instâncias: um gráfico que mostra o número total de instâncias no MIG durante o período.

Por padrão, o painel agrega dados de todos os MIGs no seu projeto. Para visualizar um único MIG, filtre por MIGs (instance_group). Se o projeto contiver MIGs com nomes idênticos em vários locais, aplique um filtro de região (region) ou zona (zone) para segmentar um MIG específico.

Os gráficos no painel Monitoramento da distribuição de instâncias do MIG do GCE dependem de rótulos e métricas de metadados do sistema do Compute Engine padrão, como compute.googleapis.com/instance/cpu/utilization e metadata.system_labels.machine_type. Esses rótulos de métricas e metadados do sistema são coletados automaticamente pelo Cloud Monitoring para todas as instâncias do Compute Engine. Não é necessário instalar o Agente de operações nem configurar a telemetria de convidado personalizada nas instâncias para visualizar os gráficos de distribuição de instâncias, zona, tipo de máquina ou estado nesse painel.

Funções exigidas

Visualizar e personalizar o painel

É possível visualizar o painel Monitoramento da distribuição de instâncias do MIG do GCE no Google Cloud console e, opcionalmente, copiá-lo e personalizá-lo para monitorar regiões, zonas ou MIGs específicos.

  1. Para visualizar o painel pré-configurado Monitoramento da distribuição de instâncias do MIG do GCE, faça o seguinte:

    1. No Google Cloud console, acesse a página Monitoring > Painéis.

      Ir para "Painéis"

    2. No Filtro, pesquise o painel Monitoramento da distribuição de instâncias do MIG do GCE e selecione-o. Também é possível encontrar esse painel no menu Tipo > categoria Serviços do Google.

    É possível usar o painel como está ou copiá-lo para personalizar ainda mais.

  2. Opcional: para personalizar o painel, primeiro copie-o e edite-o da seguinte maneira:

    1. Para copiar, clique em Copiar painel.

    2. Edite o painel copiado e modifique o nome, os gráficos, aplique filtros e configure estruturas de layout personalizadas conforme necessário.

    É possível visualizar o painel copiado ou personalizado no menu Tipo > categoria Personalizado.

Para mais informações sobre como personalizar o painel, consulte as seguintes páginas na documentação do Cloud Monitoring:

Aplicar filtros do painel

O painel Monitoramento da distribuição de instâncias do MIG do GCE inclui variáveis de filtro integradas que permitem detalhar subconjuntos específicos do MIG:

  • Região (region): filtre os gráficos para mostrar instâncias em uma ou mais regiões específicas Google Cloud .

  • Zona (zone): filtre os gráficos para observar a distribuição zonal e verificar se as instâncias estão equilibradas ou mudando a capacidade em zonas específicas.

  • Grupo de instâncias (instance_group): filtre os gráficos para isolar um único MIG quando o projeto contém vários MIGs.

Para aplicar um filtro no Google Cloud console, clique no botão Filtrar na parte de cima do painel copiado, selecione a propriedade do filtro (como region, zone ou instance_group) e selecione os valores escolhidos.

Para mais informações sobre como usar filtros, consulte Adicionar filtros temporários a um painel personalizado na documentação do Cloud Monitoring.

Configurar anotações de eventos

Ao analisar as mudanças na distribuição de instâncias em zonas e tipos de máquina, a configuração de anotações para eventos ou implantações de ciclo de vida ajuda a correlacionar mudanças de capacidade com atividades operacionais específicas. Por exemplo, é possível adicionar anotações às linhas do tempo do gráfico para destacar eventos, como os seguintes:

  • Atualizações de configuração do MIG, como modificar o formato de distribuição de destino, instanceSelections ou a ordem rank.

  • Atualizações contínuas ou reparos de instâncias iniciados no grupo.

  • Eventos de interrupção zonal simulados ou reais.

  • Decisões de escalonamento automático.

Para mais informações sobre os tipos de eventos disponíveis e como adicionar anotações, consulte as seguintes páginas na documentação do Cloud Monitoring:

Interpretar o painel

Ao visualizar o painel de distribuição de instâncias do MIG, use as orientações a seguir para responder a perguntas comuns de observabilidade e interpretar o comportamento dinâmico de local e tipo de máquina.

Por que minhas instâncias estão em execução em zonas específicas ou mudando entre zonas?

Se o gráfico Distribuição de instâncias por zona indicar uma distribuição desigual entre as zonas em um MIG regional ou mudanças repentinas de capacidade entre locais, verifique os seguintes fatores de flexibilidade de local:

  • Formato de distribuição de destino: verifique o formato de distribuição de destino configurado. Se o MIG estiver configurado com ANY ou ANY_SINGLE_ZONE, o MIG prioriza as zonas em que a capacidade ou as reservas não utilizadas estão mais disponíveis, em vez de equilibrar as instâncias uniformemente. Se o MIG usar BALANCED, o grupo vai tentar manter a contagem de instâncias equilibrada entre as zonas, mas poderá colocar instâncias temporariamente em zonas alternativas se uma zona específica tiver uma escassez temporária de capacidade.

  • Redistribuição de capacidade regional: durante uma escassez temporária de capacidade, devido a eventos como uma interrupção zonal localizada, um MIG regional configurado para alta disponibilidade encontra e aloca automaticamente instâncias de substituição em zonas alternativas na região. O painel vai refletir essa flexibilidade de local como uma queda na contagem de instâncias da zona afetada e um aumento correspondente em zonas alternativas.

Por que meu MIG está em execução em tipos de máquina de fallback?

Se o MIG usar a flexibilidade de instância e o gráfico Distribuição de instâncias por tipo de máquina mostrar que o grupo está criando e executando instâncias ativamente em tipos de máquina de preferência mais baixa (valor de classificação mais alto) em vez da seleção principal, considere as seguintes causas possíveis:

  • Restrições temporárias de recursos: se os tipos de máquina principais tiverem alta demanda ou restrições temporárias de recursos, o MIG vai fazer o fallback automaticamente para seleções secundárias para garantir que a capacidade de destino seja obtida. Mesmo quando os tipos de máquina preferenciais estiverem disponíveis novamente, o MIG vai continuar usando os tipos de máquina de fallback e não vai mudar proativamente para os preferenciais.

  • Limitações de cota: verifique se o Google Cloud projeto tem cota de vCPU e recursos suficiente para a série de máquina preferencial na região selecionada. Se a cota estiver esgotada para o tipo de máquina principal, o MIG vai provisionar as seleções secundárias disponíveis.

Para mais informações, consulte Como um MIG seleciona tipos de máquina.

Consultar de maneira programática usando o PromQL

Para monitorar a distribuição de instâncias em um MIG, também é possível consultar as métricas subjacentes de maneira programática usando o PromQL para Cloud Monitoring. A consulta programática permite integrar os dados de distribuição de instâncias aos painéis de observabilidade personalizados ou ferramentas de monitoramento externas, como o Grafana. É possível usar o PromQL para consultar instâncias por zona ou por tipo de máquina.

Execute as consultas do PromQL no editor de código, conforme descrito na seção a seguir.

Acessar o editor de código

É possível acessar o PromQL nas seguintes páginas do Google Cloud console:

  • Metrics Explorer
  • Adicionar widget ao criar painéis

Para abrir o editor de código ao usar o Metrics Explorer, faça o seguinte:

  1. No Google Cloud console, acesse a  página Metrics Explorer:

    Acesse o Metrics Explorer

    Se você usar a barra de pesquisa para encontrar essa página, selecione o resultado com o subtítulo Monitoring.

  2. Na barra de ferramentas do painel do criador de consultas, selecione o  PromQL botão.

  3. Digite sua consulta no campo de texto e clique em Executar consulta. As seções a seguir fornecem exemplos de consultas.

Para mais informações sobre o editor de código, consulte Usar o editor de código para PromQL em a documentação do Cloud Monitoring.

Consultar instâncias ativas por zona

Para consultar instâncias ativas por zona, execute a seguinte consulta no editor de código:

count by (zone) (compute_googleapis_com:instance_cpu_utilization{metadata_system_instance_group="YOUR_MIG_NAME"})

Substitua YOUR_MIG_NAME pelo nome do MIG.

Consultar instâncias ativas por tipo de máquina

Para consultar instâncias ativas por tipo de máquina, execute a seguinte consulta no editor de código:

count by (metadata_system_machine_type) (compute_googleapis_com:instance_cpu_utilization{metadata_system_instance_group="YOUR_MIG_NAME"})

Substitua YOUR_MIG_NAME pelo nome do MIG.

A seguir