Vista geral

Este documento oferece uma vista geral das operações de recuperação após desastre (DR) no Google Distributed Cloud (GDC) air-gapped. Descreve as diferentes tarefas a ter em conta quando realiza atividades relacionadas com a DR. As operações de recuperação após desastre são essenciais para manter a continuidade da atividade e a proteção de dados quando implementa projetos num ambiente de nuvem distribuída.

Esta página destina-se a programadores em grupos de administradores da plataforma ou operadores de aplicações que gerem operações de recuperação após desastre. Para mais informações, consulte o artigo Públicos-alvo para a documentação do GDC air-gapped.

Planeamento da recuperação após desastre

Tem de ter capacidade suficiente para fazer uma cópia de segurança dos dados da carga de trabalho, dado o tamanho dos dados e o respetivo período de retenção. O GDC oferece capacidades de cópia de segurança para cargas de trabalho de clientes em buckets de armazenamento de objetos compatíveis com o S3. buckets de armazenamento de objetos compatíveis com o S3.

Estas cópias de segurança são incrementais. A primeira é uma cópia de segurança completa e todas as cópias de segurança subsequentes são incrementais, captando apenas as alterações feitas desde a última cópia de segurança. O armazenamento que contém as cópias de segurança tem de ter capacidade suficiente para acomodar a cópia de segurança completa inicial e as alterações acumuladas (deltas) entre as cópias de segurança para a frequência de cópia de segurança e os períodos de retenção indicados. Tem de ter em conta o potencial crescimento dos dados dos quais está a fazer uma cópia de segurança para garantir que as cópias de segurança não excedem a capacidade de armazenamento.

Se planeia usar o armazenamento de objetos numa instância do GDC remota, tem de criar os buckets de armazenamento na mesma organização na instância de destino onde as cargas de trabalho estão a ser executadas na instância de origem, para que a faturação funcione corretamente. O plano de controlo da organização numa instância do GDC tem de ter uma cópia de segurança em buckets alojados na mesma organização noutra instância. Também pode criar buckets para fazer uma cópia de segurança das cargas de trabalho na mesma organização na instância de cópia de segurança do plano de controlo.

Também tem de ter capacidade suficiente, como computação e armazenamento, para executar quaisquer cargas de trabalho com falhas numa instância do GDC separada para a qual quer poder fazer um restauro em caso de desastre. Por exemplo, se tiver duas instâncias do GDC e quiser poder executar todas as cargas de trabalho enquanto apenas uma das instâncias está disponível, a capacidade de ambas as instâncias individualmente tem de ser superior ou igual à capacidade geral necessária para executar todas as cargas de trabalho. No entanto, se apenas algumas cargas de trabalho tiverem de ser recuperadas durante uma falha do sistema, o planeamento pode incluir a desativação temporária de aplicações menos críticas para libertar recursos até que os sistemas com falhas estejam a funcionar novamente.

Restaurar cargas de trabalho do utilizador

As cargas de trabalho do utilizador são uma coleção de serviços que interagem entre si com base na lógica empresarial que define. O GDC não consegue oferecer uma automatização completa pronta a usar para restaurar cargas de trabalho do utilizador. No entanto, o serviço Backup4GDC pode recuperar um cluster inteiro de uma vez ou recuperar um espaço de nomes de cada vez, se for necessária mais granularidade.

Para automatizar o restauro de uma carga de trabalho, um utilizador final pode estruturar pods como contentores init, que são contentores especializados que são executados antes dos contentores de apps num pod. Em seguida, um pod valida as dependências antes de iniciar o respetivo contentor de execução prolongada, o que resulta numa estrutura auto-orquestrada.

Adicione a lógica de arranque diretamente às cargas de trabalho como código para restaurar um cluster inteiro de uma vez e fazer com que a aplicação verifique e valide automaticamente os pré-requisitos antes de iniciar. Por exemplo, inicie o servidor Web depois de confirmar que os servidores de base de dados e de cartões de crédito estão a apresentar tráfego.

Gerir diferenças de versões

As versões do GDC de diferentes clusters podem ser diferentes. A recuperação após desastre requer que ambos os sites estejam a executar a mesma versão do GDC para todos os clusters correspondentes. Tem de controlar manualmente o processo de sincronização.

Os clusters que estão a ser restaurados podem ter versões diferentes quando ocorre um desastre. Tenha em atenção as diferenças de versões quando transfere cargas de trabalho. O GDC é retrocompatível, mas não é compatível com versões futuras.

É possível restaurar uma cópia de segurança com uma versão mais antiga num cluster com uma versão mais recente. No entanto, não é possível restaurar uma cópia de segurança com uma versão mais recente num cluster com uma versão mais antiga. Tem de encontrar cópias de segurança compatíveis quando transfere cargas de trabalho.

Fazer uma cópia de segurança e restaurar

A funcionalidade de cópia de segurança e restauro no GDC permite fazer uma cópia de segurança e restaurar cargas de trabalho de clusters do Kubernetes, instâncias do registo do Harbor e instâncias de máquinas virtuais (VMs) em buckets de armazenamento de objetos compatíveis com o S3.

Vista geral da cópia de segurança de clusters

As cópias de segurança de clusters do Kubernetes protegem os seus dados captando o estado das suas aplicações, oferecendo consistência de falhas e consistência de aplicações. Pode personalizar o processo de cópia de segurança com hooks de pré e pós-execução e várias estratégias de aplicações protegidas.

As cópias de segurança são armazenadas em repositórios compatíveis com o S3 e geridas através de planos de cópia de segurança, que definem o respetivo âmbito e agendamento. Os planos de restauro oferecem cenários de recuperação pré-configurados, permitindo um restauro rápido e eficiente do cluster.

Para mais informações, consulte o artigo Vista geral da cópia de segurança de clusters.

Vista geral da cópia de segurança de VMs

As cópias de segurança de VMs do GDC permitem-lhe fazer uma cópia de segurança das cargas de trabalho de máquinas virtuais, incluindo as respetivas configurações, imagens de disco e volumes persistentes. Faça a gestão das cópias de segurança através de planos de cópia de segurança, agendando-as regularmente ou criando-as a pedido. Restaure VMs para um estado anterior ou recupere snapshots de discos individuais.

Para mais informações, consulte o artigo Vista geral da cópia de segurança de VMs.

Vista geral da cópia de segurança do Harbor

As cópias de segurança do Harbor oferecem uma proteção abrangente para as instâncias do registo do Harbor, protegendo contra a perda de dados e garantindo a continuidade da atividade. Agende cópias de segurança automáticas ou crie-as manualmente.

Defina políticas de retenção para a gestão de dados a longo prazo. Em caso de desastre, restaure a instância do Harbor, incluindo todos os artefactos e metadados, a partir de uma cópia de segurança criada anteriormente.

Para mais informações, consulte o artigo Vista geral da cópia de segurança do Harbor.