Replikationsjob aktualisieren

Auf dieser Seite wird beschrieben, wie Sie einen Replikationsjob aktualisieren, nachdem Sie eine Cloud Data Fusion-Instanz aktualisiert haben. Der Vorgang unterscheidet sich, wenn Sie ein Upgrade auf Version 6.6.0 oder niedriger durchführen.

Version 6.7.0 und höher

Wenn Sie ein Upgrade eines Replikationsjobs auf Version 6.7.0 oder höher durchführen möchten, folgen Sie dazu derselben Anleitung wie beim Upgrade von Batch-Pipelines.

Version 6.6.0 und früher

So sichern Sie den Replikationsjob und führen ein Upgrade auf Version 6.6.0 oder früher durch:

  1. Replikationsjob beenden

  2. Rufen Sie die Generierungs-ID ab, indem Sie eine HTTP-GET()-Anfrage in der Cloud Data Fusion-Weboberfläche oder REST API stellen. Der Pfad sieht etwa so aus:

    namespaces/NAMESPACE_ID/apps/REPLICATION_JOB_ID</workers/DeltaWorker
    

    Ersetzen Sie Folgendes:

    • NAMESPACE_ID: Der Stringname des Namespace für den Replikationsjob. Wenn Ihre Pipeline zu einer Instanz der Basic-Version gehört, ist die ID immer default.

    • REPLICATION_JOB_ID: Der Stringname des Replikationsjobs.

    Schnittstelle

    So stellen Sie die HTTP-GET()-Anfrage über die Cloud Data Fusion-Benutzeroberfläche:

    1. Rufen Sie Ihre Instanz auf:
      1. Rufen Sie in der Google Cloud Console die Seite „Cloud Data Fusion“ auf.

      2. Wenn Sie die Instanz in Cloud Data Fusion Studio öffnen möchten, klicken Sie auf Instanzen und dann auf Instanz anzeigen.

        Zur Seite „VM-Instanzen“

    2. Klicken Sie auf Systemadministrator > Konfiguration.
    3. Klicken Sie auf HTTP-Aufrufe ausführen.
    4. Wählen Sie GET aus und geben Sie den Pfad ein, der zuvor in Schritt 2 beschrieben wurde.
    5. Klicken Sie auf Senden und suchen Sie in der Antwort auf den Aufruf nach der Generierungs-ID.

    REST API

    Informationen zum Stellen der GET()-Anfrage in der API finden Sie in der CDAP API-Referenz.

  3. Sichern Sie das vorhandene Cloud Storage-Verzeichnis.

    1. Wenn Sie das Verzeichnis in der Google Cloud Console bearbeiten möchten, rufen Sie die Seite Buckets auf.

      Buckets aufrufen

    2. Klicken Sie auf den Bucket-Namen, um die Seite Bucket-Details zu öffnen. Der Bucket-Name ist die Generierungs-ID-Nummer.

    Der Cloud Storage-Bucket-Pfad in der Google Cloud -Konsole hat ein Format, das dem folgenden ähnelt:

    Buckets > OFFSET_BASE_PATH > NAMESPACE_ID > REPLICATION_JOB_ID

    Sie können den Bucket anhand des offsetBasePath-Werts für den Job finden. Um den Wert abzurufen, stellen Sie in Cloud Data Fusion eine GET()-Anfrage mit dem folgenden Pfad:

    namespaces/NAMESPACE_ID/apps/REPLICATION_JOB_ID
    
  4. Führen Sie das Upgrade mit denselben Schritten wie beim Aktualisieren von Batch-Pipelines durch.

  5. Der aktualisierte Job hat eine neue Generation-ID. Verwenden Sie die neue ID als Namen des Cloud Storage-Verzeichnisses.

  6. Replikationsjob starten

Nächste Schritte