Protección de datos con almacenamiento multizona

Para proteger los datos de las aplicaciones en un universo multizona aislado de Google Distributed Cloud (GDC) y mantener aplicaciones de alta disponibilidad, puedes implementar una estrategia de protección de datos que sea resistente a las interrupciones o los fallos locales. GDC proporciona estrategias de replicación de datos para el almacenamiento de objetos y el almacenamiento en bloques, de modo que puedas mantener procedimientos de conmutación por error para las zonas principales y secundarias de tu universo.

Este documento está dirigido a los siguientes grupos de usuarios:

  • Administradores de plataformas, como los administradores de TI, que son responsables de desarrollar flujos de trabajo de recuperación tras fallos.
  • Operadores de aplicaciones, como los desarrolladores de aplicaciones, que son responsables de desarrollar y mantener aplicaciones en un universo de GDC.

Para obtener más información, consulta el artículo Audiencias de la documentación de GDC aislado.

Replicación de almacenamiento para la recuperación tras fallos

Puedes configurar una protección de datos sólida para el almacenamiento de aplicaciones en un universo multizona mediante la replicación de datos asíncrona para la recuperación tras fallos. Este enfoque consiste en copiar datos de una zona principal a una zona secundaria a intervalos periódicos. Este mecanismo mantiene tus datos protegidos y accesibles si la zona principal sufre una interrupción.

La replicación de datos para el almacenamiento de objetos utiliza buckets de doble zona para replicar automáticamente tus datos y no requiere intervención manual. Para obtener más información sobre cómo crear un bucket de doble zona, consulta el artículo Crear buckets de almacenamiento.

La replicación de datos para el almacenamiento en bloques utiliza volúmenes persistentes de doble zona para replicar tus datos y requiere un procedimiento de conmutación por error de volumen. Para obtener más información, consulta Replicar volúmenes de forma asíncrona.

Una vez que hayas configurado la replicación de datos, tus datos seguirán un procedimiento de conmutación por error secuencial cuando la zona principal esté sin conexión. Los procedimientos de conmutación por error son distintos para la replicación de almacenamiento en bloques y de objetos. Sin embargo, ambas estrategias de replicación de datos siguen estas fases críticas:

  1. Verificar la interrupción de la zona principal.
  2. Detener la replicación desde la zona principal.
  3. Promocionar la zona secundaria de copia de seguridad para que asuma el rol de la zona principal mediante una intervención manual o una conmutación por error preconfigurada.
  4. Verificar el estado operativo de la nueva zona principal.

Ponte en contacto con un miembro del grupo de operadores de infraestructura para confirmar que tus dos zonas están configuradas para la replicación de datos asíncrona.

El retraso inherente a la replicación de datos asíncrona significa que esta configuración es más útil para los sistemas que requieren un objetivo de punto de recuperación (RPO) bajo, pero no nulo. Si tu sistema requiere una pérdida de datos mínima, pero puede tolerar una pequeña cantidad máxima predefinida de pérdida de datos medida en tiempo, normalmente relacionada con los datos generados justo antes de un evento de desastre que podría ser irrecuperable, la replicación de datos asíncrona es una función valiosa que puedes implementar en tus aplicaciones.

Un ejemplo de RPO bajo no nulo podría ser una plataforma de negociación financiera con un RPO de cinco minutos, donde la replicación de datos asíncrona está configurada para copiar los datos de las operaciones en una zona secundaria de recuperación tras fallos cada dos minutos:

  • Este es un escenario de RPO bajo porque los cinco minutos representan la ventana de pérdida de datos mínima aceptable para el sistema de alto volumen.
  • Es un escenario de RPO no nulo porque el retraso inherente a la replicación asíncrona de intervalos de dos minutos significa que hay una pequeña ventana de tiempo en la que los datos aún no se han copiado, lo que puede provocar una pérdida.

Debes trabajar con tu grupo de operadores de infraestructura para definir tu flujo de trabajo de replicación de almacenamiento asíncrona de doble zona y verificar que las capacidades de replicación de datos de la infraestructura admiten tus requisitos de RPO.

Limitaciones

La replicación de datos síncrona no se admite en GDC aislado. La replicación de datos síncrona mantiene una coherencia estricta entre los datos de dos zonas duplicando inmediatamente todos los datos escritos desde una zona principal a la zona secundaria, lo que proporciona un RPO de cero en escenarios de desastre.

Siguientes pasos