Mettre à niveau une tâche de réplication

Cette page explique comment mettre à niveau une tâche de réplication après avoir mis à niveau une instance Cloud Data Fusion. La procédure diffère selon que vous effectuez une mise à niveau vers la version 6.6.0 ou une version antérieure.

Version 6.7.0 et versions ultérieures

Pour mettre à niveau une tâche de réplication vers la version 6.7.0 ou une version ultérieure, procédez comme pour mettre à niveau des pipelines par lot.

Version 6.6.0 et versions antérieures

Pour sauvegarder et mettre à niveau la tâche de réplication vers la version 6.6.0 ou une version antérieure, procédez comme suit :

  1. Arrêtez la tâche de réplication.

  2. Obtenez l'ID de génération en envoyant une requête HTTP GET() dans l'interface Web Cloud Data Fusion ou l'API REST. Le chemin d'accès est semblable à celui-ci :

    namespaces/NAMESPACE_ID/apps/REPLICATION_JOB_ID</workers/DeltaWorker
    

    Remplacez les éléments suivants :

    • NAMESPACE_ID: nom de chaîne de l'espace de noms pour la tâche de réplication. Si votre pipeline appartient à une instance de l'édition de base, l'ID est toujours default.

    • REPLICATION_JOB_ID: nom de chaîne de la tâche de réplication.

    Interface

    Pour envoyer la requête HTTP GET() dans l'interface Cloud Data Fusion, procédez comme suit :

    1. Accédez à votre instance :
      1. Dans la console Google Cloud , accédez à la page Cloud Data Fusion.

      2. Pour ouvrir l'instance dans Cloud Data Fusion Studio, cliquez sur Instances, puis sur Afficher l'instance.

        Accéder à la page "Instances"

    2. Cliquez sur Administrateur système > Configuration.
    3. Cliquez sur Envoyer des appels HTTP.
    4. Sélectionnez GET et saisissez le chemin d'accès décrit précédemment à l'étape 2.
    5. Cliquez sur Envoyer et recherchez l'ID de génération dans la réponse à l'appel.

    API REST

    Pour envoyer la requête GET() dans l'API, consultez la documentation de référence de l'API CDAP.

  3. Sauvegardez le répertoire Cloud Storage existant.

    1. Pour modifier le répertoire dans la Google Cloud console, accédez à la page Buckets.

      Accéder à la page "Buckets"

    2. Cliquez sur le nom du bucket pour ouvrir la page Détails du bucket. Le nom du bucket correspond au numéro d'ID de génération.

    Le chemin d'accès au bucket Cloud Storage dans la Google Cloud console est semblable à celui-ci :

    Buckets > OFFSET_BASE_PATH > NAMESPACE_ID > REPLICATION_JOB_ID

    Vous pouvez trouver le bucket à l'aide de la valeur offsetBasePath de la tâche. Pour obtenir la valeur, envoyez une requête GET() dans Cloud Data Fusion avec le chemin d'accès suivant :

    namespaces/NAMESPACE_ID/apps/REPLICATION_JOB_ID
    
  4. Effectuez la mise à niveau en suivant la même procédure que pour mettre à niveau des pipelines par lot.

  5. La tâche mise à niveau possède un nouvel ID de génération. Utilisez le nouvel ID comme nom de répertoire Cloud Storage.

  6. Démarrez la tâche de réplication.

Étape suivante