Ce document présente les opérations de reprise après sinistre dans Google Distributed Cloud (GDC) sous air gap. Il décrit les différentes tâches à prendre en compte lors de la réalisation d'activités liées à la reprise après sinistre. Les opérations de reprise après sinistre sont essentielles pour assurer la continuité des activités et la protection des données lors du déploiement de projets dans un environnement Distributed Cloud.
Cette page est destinée aux développeurs des groupes d'administrateurs de plate-forme ou d'opérateurs d'application qui gèrent les opérations de reprise après sinistre. Pour en savoir plus, consultez la documentation sur les audiences pour GDC sous air gap.
Planification de la reprise après sinistre
Vous devez disposer d'une capacité suffisante pour sauvegarder les données de la charge de travail, en fonction de la taille des données et de leur période de conservation. GDC fournit des fonctionnalités de sauvegarde pour les charges de travail des clients dans des buckets de stockage d'objets compatibles.
Ces sauvegardes sont incrémentielles. La première est une sauvegarde complète, et toutes les suivantes sont incrémentielles, ne capturant que les modifications apportées depuis la dernière sauvegarde. Le stockage contenant les sauvegardes doit avoir une capacité suffisante pour accueillir la sauvegarde complète initiale et les modifications cumulées (deltas) entre les sauvegardes pour la fréquence de sauvegarde et les périodes de conservation données. Vous devez tenir compte de la croissance potentielle des données sauvegardées pour vous assurer que les sauvegardes ne dépassent pas la capacité de stockage.
Si vous prévoyez d'utiliser le stockage d'objets sur une instance GDC distante, vous devez créer les buckets de stockage dans la même organisation sur l'instance cible où les charges de travail s'exécutent dans l'instance source, afin que la facturation fonctionne correctement. Le plan de contrôle de l'organisation sur une instance GDC doit être sauvegardé dans des buckets hébergés dans la même organisation sur une autre instance. Vous pouvez également créer des buckets pour sauvegarder les charges de travail dans la même organisation sur l'instance de sauvegarde du plan de contrôle.
Vous devez également disposer d'une capacité suffisante, telle que le calcul et le stockage, pour exécuter les charges de travail ayant échoué sur une instance GDC distincte que vous souhaitez pouvoir restaurer en cas de sinistre. Par exemple, si vous disposez de deux instances GDC et que vous souhaitez pouvoir exécuter toutes les charges de travail alors qu'une seule des instances est disponible, la capacité de chaque instance doit être supérieure ou égale à la capacité globale nécessaire pour exécuter toutes les charges de travail. Toutefois, si seules certaines charges de travail doivent être récupérées en cas de défaillance du système, votre planification peut inclure l'arrêt temporaire des applications moins critiques pour libérer des ressources jusqu'à ce que les systèmes défaillants fonctionnent à nouveau.
Restaurer les charges de travail des utilisateurs
Les charges de travail des utilisateurs sont un ensemble de services qui interagissent en fonction de la logique métier que vous définissez. GDC n'est pas en mesure de fournir une automatisation complète prête à l'emploi pour restaurer les charges de travail des utilisateurs. Toutefois, le service Backup4GDC peut récupérer un cluster entier à la fois, ou récupérer un espace de noms à la fois si une plus grande granularité est nécessaire.
Pour automatiser la restauration d'une charge de travail, un utilisateur final peut concevoir des pods en tant que conteneurs init, qui sont des conteneurs spécialisés qui s'exécutent avant les conteneurs d'application dans un pod. Un pod valide ensuite les dépendances avant de démarrer son conteneur à longue durée d'exécution, ce qui entraîne une structure auto-orchestrée.
Ajoutez votre logique de démarrage directement dans vos charges de travail sous forme de code pour restaurer un cluster entier à la fois et permettre à votre application de s'auto-vérifier et de valider les prérequis avant de démarrer. Par exemple, démarrez le serveur Web après avoir confirmé que vos serveurs de base de données et de cartes de crédit diffusent du trafic.
Gérer les différences de version
Les versions GDC de différents clusters peuvent être différentes. La reprise après sinistre nécessite que les deux sites exécutent la même version GDC pour tous les clusters correspondants. Vous devez contrôler manuellement le processus de synchronisation.
Les clusters en cours de restauration peuvent avoir des versions différentes en cas de sinistre. Tenez compte des différences de version lors du transfert des charges de travail. GDC est rétrocompatible, mais pas compatible avec les versions ultérieures.
Une sauvegarde avec une version antérieure peut être restaurée dans un cluster avec une version plus récente. Toutefois, une sauvegarde avec une version plus récente ne peut pas être restaurée dans un cluster avec une version antérieure. Vous devez trouver des sauvegardes compatibles lorsque vous transférez des charges de travail.
Sauvegarde et restauration
La sauvegarde et la restauration dans GDC permettent de sauvegarder et de restaurer les charges de travail des clusters Kubernetes, les instances de registre Harbor et les instances de machines virtuelles (VM) dans des buckets de stockage d'objets compatibles avec S3.
Présentation de la sauvegarde de cluster
Les sauvegardes de cluster Kubernetes protègent vos données en capturant l'état de vos applications, en assurant à la fois la cohérence en cas de plantage et la cohérence des applications. Vous pouvez personnaliser le processus de sauvegarde à l'aide de hooks de pré-exécution et de post-exécution, ainsi que de plusieurs stratégies d'application protégées.
Les sauvegardes sont stockées dans des dépôts compatibles avec S3 et gérées via des plans de sauvegarde, qui définissent leur étendue et leur planification. Les plans de restauration proposent des scénarios de récupération préconfigurés, ce qui permet une restauration rapide et efficace des clusters.
Pour en savoir plus, consultez Présentation de la sauvegarde de cluster.
Présentation de la sauvegarde de VM
Les sauvegardes de VM GDC vous permettent de sauvegarder les charges de travail des machines virtuelles, y compris leurs configurations, leurs images de disque et leurs volumes persistants. Gérez les sauvegardes via des plans de sauvegarde, en les planifiant régulièrement ou en les créant à la demande. Restaurez les VM à un état antérieur ou récupérez des instantanés de disque individuels.
Pour en savoir plus, consultez Présentation de la sauvegarde de VM.
Présentation de la sauvegarde Harbor
Les sauvegardes Harbor offrent une protection complète pour vos instances de registre Harbor, en protégeant contre la perte de données et en assurant la continuité des activités. Planifiez des sauvegardes automatiques ou créez-les manuellement.
Définissez des règles de conservation pour la gestion des données à long terme. En cas de sinistre, restaurez votre instance Harbor, y compris tous les artefacts et métadonnées, à partir d'une sauvegarde créée précédemment.
Pour en savoir plus, consultez Présentation de la sauvegarde Harbor.