Introducción

En este documento se ofrece una descripción general de las operaciones de recuperación tras fallos (DR) en Google Distributed Cloud (GDC) air-gapped. Describe las diferentes tareas que se deben tener en cuenta al realizar actividades relacionadas con la recuperación tras fallos. Las operaciones de recuperación tras fallos son fundamentales para mantener la continuidad del negocio y la protección de datos al desplegar proyectos en un entorno de Distributed Cloud.

Esta página está dirigida a los desarrolladores de los grupos de administradores de plataformas u operadores de aplicaciones que gestionan las operaciones de recuperación tras fallos. Para obtener más información, consulta el artículo Audiencias para la documentación de GDC air-gapped.

Planificación de la recuperación tras fallos

Debes tener capacidad suficiente para hacer copias de seguridad de los datos de las cargas de trabajo, teniendo en cuenta el tamaño de los datos y su periodo de retención. GDC ofrece funciones de copia de seguridad para las cargas de trabajo de los clientes en segmentos de almacenamiento de objetos compatibles con S3.

Estas copias de seguridad son incrementales. La primera es una copia de seguridad completa y todas las posteriores son incrementales, ya que solo capturan los cambios realizados desde la última copia de seguridad. El almacenamiento que contiene las copias de seguridad debe tener capacidad suficiente para la copia de seguridad completa inicial y para los cambios acumulados (deltas) entre las copias de seguridad, teniendo en cuenta la frecuencia de las copias de seguridad y los periodos de conservación. Debes tener en cuenta el posible crecimiento de los datos de los que se hace una copia de seguridad para asegurarte de que las copias de seguridad no superen la capacidad de almacenamiento.

Si tienes previsto usar el almacenamiento de objetos en una instancia de GDC remota, debes crear los segmentos de almacenamiento en la misma organización de la instancia de destino en la que se ejecutan las cargas de trabajo de la instancia de origen para que la facturación funcione correctamente. El plano de control de la organización de una instancia de GDC debe tener una copia de seguridad en segmentos alojados en la misma organización de otra instancia. También puedes crear segmentos para hacer copias de seguridad de las cargas de trabajo de la misma organización en la instancia de copia de seguridad del plano de control.

También debes tener capacidad suficiente, como recursos de computación y almacenamiento, para ejecutar las cargas de trabajo que hayan fallado en una instancia de GDC independiente a la que quieras poder restaurar en caso de desastre. Por ejemplo, si tienes dos instancias de GDC y quieres poder ejecutar todas las cargas de trabajo aunque solo una de las instancias esté disponible, la capacidad de cada instancia debe ser mayor o igual que la capacidad total necesaria para ejecutar todas las cargas de trabajo. Sin embargo, si solo se deben recuperar algunas cargas de trabajo durante un fallo del sistema, puedes planificar el cierre temporal de las aplicaciones menos críticas para liberar recursos hasta que los sistemas que fallan vuelvan a funcionar.

Restaurar cargas de trabajo de usuario

Las cargas de trabajo de usuario son un conjunto de servicios que interactúan entre sí en función de la lógica empresarial que definas. GDC no puede proporcionar una automatización completa lista para usar para restaurar las cargas de trabajo de usuario. Sin embargo, el servicio Backup4GDC puede recuperar un clúster completo a la vez o recuperar un espacio de nombres cada vez si se necesita más granularidad.

Para automatizar la restauración de una carga de trabajo, un usuario final puede diseñar pods como contenedores init, que son contenedores especializados que se ejecutan antes que los contenedores de aplicaciones en un pod. A continuación, un pod valida las dependencias antes de iniciar su contenedor de larga duración, lo que da como resultado una estructura autoorquestada.

Añade la lógica de inicio directamente a tus cargas de trabajo como código para restaurar un clúster completo a la vez y hacer que tu aplicación compruebe y valide los requisitos previos antes de que se inicie. Por ejemplo, inicia el servidor web después de confirmar que tus servidores de bases de datos y de tarjetas de crédito están sirviendo tráfico.

Gestionar las diferencias de versión

Las versiones de GDC de los diferentes clústeres pueden ser distintas. Para la recuperación tras fallos, ambos sitios deben ejecutar la misma versión de GDC en todos los clústeres correspondientes. Debes controlar manualmente el proceso de sincronización.

Los clústeres que se están restaurando pueden tener versiones diferentes cuando se produce un desastre. Ten en cuenta las diferencias de versión al transferir cargas de trabajo. GDC es compatible con versiones anteriores, pero no con versiones posteriores.

Se puede restaurar una copia de seguridad con una versión anterior en un clúster con una versión más reciente. Sin embargo, no se puede restaurar una copia de seguridad con una versión más reciente en un clúster con una versión anterior. Debes buscar copias de seguridad compatibles al transferir cargas de trabajo.

Copia de seguridad y restauración

La función de copia de seguridad y restauración de GDC permite hacer copias de seguridad y restaurar cargas de trabajo de clústeres de Kubernetes, instancias de registros de Harbor e instancias de máquinas virtuales (VM) en segmentos de almacenamiento de objetos compatibles con S3.

Descripción general de las copias de seguridad de clústeres

Las copias de seguridad de clústeres de Kubernetes protegen tus datos capturando el estado de tus aplicaciones, lo que proporciona coherencia en caso de fallos y coherencia de las aplicaciones. Puedes personalizar el proceso de copia de seguridad mediante hooks de preejecución y postejecución, así como varias estrategias de aplicaciones protegidas.

Las copias de seguridad se almacenan en repositorios compatibles con S3 y se gestionan mediante planes de copia de seguridad, que definen su alcance y programación. Los planes de restauración ofrecen escenarios de recuperación preconfigurados, lo que permite restaurar los clústeres de forma rápida y eficiente.

Para obtener más información, consulta el artículo Descripción general de las copias de seguridad de clústeres.

Descripción general de las copias de seguridad de máquinas virtuales

Las copias de seguridad de máquinas virtuales de GDC te permiten hacer copias de seguridad de las cargas de trabajo de máquinas virtuales, incluidas sus configuraciones, imágenes de disco y volúmenes persistentes. Gestiona las copias de seguridad mediante planes de copia de seguridad, programándolas periódicamente o creándolas a petición. Restaura las máquinas virtuales a un estado anterior o recupera capturas de disco individuales.

Para obtener más información, consulta el artículo Descripción general de las copias de seguridad de máquinas virtuales.

Descripción general de las copias de seguridad de Harbor

Las copias de seguridad de Harbor proporcionan una protección completa para tus instancias de registros de Harbor, lo que evita la pérdida de datos y garantiza la continuidad del negocio. Programa copias de seguridad automáticas o créalas manualmente.

Define políticas de conservación para la gestión de datos a largo plazo. En caso de desastre, restaura tu instancia de Harbor, incluidos todos los artefactos y metadatos, a partir de una copia de seguridad creada anteriormente.

Para obtener más información, consulta el artículo Descripción general de las copias de seguridad de Harbor.