Informazioni sulla replica tra regioni e sul ripristino di emergenza

La replica tra regioni e il ripristino di emergenza per il catalogo del runtime di Lakehouse proteggono dalle interruzioni a livello regionale. Nell'ambito di Lakehouse senza confini, questa funzionalità consente il failover per le tabelle che utilizzano l'endpoint del catalogo REST di Apache Iceberg.

Quando gestisci i failover, puoi scegliere tra failover soft per i test pianificati o failover hard per ripristinare rapidamente il servizio.

Come funziona

Il catalogo del runtime di Lakehouse seleziona automaticamente le regioni primaria e secondaria per i metadati del catalogo. La regione primaria elabora tutti i metadati di commit della tabella e li replica nella regione secondaria per il backup.

In qualsiasi momento, soprattutto durante un disastro, puoi scambiare le regioni primaria e secondaria per il catalogo utilizzando l'operazione di failover. Questa azione scambia la regione primaria per il catalogo e tutti gli spazi dei nomi e le tabelle in esso contenuti.

Replica tra regioni

La replica tra regioni prevede due componenti principali: la replica dei dati e la replica del metastore. La funzionalità di ripristino di emergenza si basa sulla replica tra regioni per abilitare il failover.

  • Replica dei dati: Cloud Storage replica automaticamente i dati del catalogo in più regioni quando utilizzi un bucket a due regioni o a più regioni. In caso di interruzione a livello regionale, i dati rimangono accessibili senza modifiche ai percorsi di archiviazione.

  • Replica del metastore: per gli endpoint del catalogo REST Iceberg, il catalogo del runtime di Lakehouse replica automaticamente il metastore quando utilizzi un bucket a due regioni (o a due regioni personalizzato). La replica del metastore inizia quando crei il catalogo. Il catalogo del runtime di Lakehouse seleziona una regione primaria e una secondaria tra le regioni definite nella configurazione di Cloud Storage. La regione primaria gestisce tutti i metadati di commit della tabella e li replica nella regione secondaria per il backup.

Disaster recovery con failover

La funzionalità di ripristino di emergenza ti consente di scambiare le regioni primaria e secondaria per un catalogo. L'operazione di failover scambia la regione primaria per il catalogo e tutti gli spazi dei nomi e le tabelle in esso contenuti. I failover hanno due modalità: failover soft e failover hard.

  • Failover soft: un failover soft impedisce la perdita di dati. In questa modalità, la nuova regione primaria inizia ad accettare le scritture solo dopo che tutti i dati precedenti sono stati sincronizzati dalla regione primaria precedente. Utilizza un failover soft per i test di ripristino di emergenza o altri scenari pianificati.

  • Failover hard: un failover hard dà la priorità alla disponibilità rispetto alla coerenza dei dati ed è progettato per ripristinare il servizio. In questa modalità, la regione primaria assume sempre il controllo e accetta il traffico di scrittura, indipendentemente dallo stato attuale della regione primaria. Ad esempio, quando utilizzi un failover hard, la nuova regione primaria può assumere il controllo anche se la regione primaria precedente non è raggiungibile.

Limitazioni

Durante l'anteprima di questa funzionalità, REPLICATION_TIMESTAMP tiene traccia solo dei metadati del catalogo, anziché dei file di Cloud Storage. Per mantenere la perdita di dati con un limite inferiore, consulta la documentazione Disponibilità e durabilità dei dati di Cloud Storage.

Passaggi successivi