Importar metadados do PostgreSQL

Neste documento, descrevemos como importar metadados do PostgreSQL para o Knowledge Catalog (antigo Dataplex Universal Catalog) usando um conector do Knowledge Catalog.

Este conector é compatível com instâncias do PostgreSQL hospedadas no local, no Cloud SQL ou em outros ambientes de nuvem.

Antes de começar

Antes de importar metadados do PostgreSQL, conclua as seguintes tarefas:

  1. Conceda os papéis e as permissões necessários.
  2. Ative as APIs Knowledge Catalog e serviço de transferência de dados do BigQuery.
  3. Atenda aos pré-requisitos do PostgreSQL.
  4. Atenda aos pré-requisitos de rede.

Permissões e papéis do IAM

Para criar e gerenciar um job de conector do Knowledge Catalog, você precisa de papéis do Identity and Access Management (IAM) que concedam permissões para o Knowledge Catalog e o serviço de transferência de dados do BigQuery.

Para receber as permissões necessárias para configurar um conector do PostgreSQL, peça ao administrador para conceder a você os seguintes papéis do IAM:

Além disso, é necessário conceder ao agente de serviço do serviço de transferência de dados do BigQuery (service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) a permissão dataplex.entryGroups.import ou o papel Importador de grupo de entradas do Dataplex (roles/dataplex.entryGroupImporter). É possível conceder esse papel no nível do projeto ou do grupo de entradas.

Para mais informações sobre como conceder papéis, consulte Gerenciar acesso.

Ativar APIs

Ative as APIs Knowledge Catalog e serviço de transferência de dados do BigQuery.

Ativar as APIs

Pré-requisitos do PostgreSQL

Verifique se você atende aos pré-requisitos para transferências do PostgreSQL. Para mais detalhes, consulte Pré-requisitos do PostgreSQL na documentação do serviço de transferência de dados do BigQuery.

Pré-requisitos de rede

Um anexo de rede para conexão pelo Private Service Connect é necessário ao se conectar com segurança a bancos de dados externos ou fontes de dados de nuvem de terceiros com um endereço IP privado em uma rede privada, para permitir que o serviço de transferência de dados do BigQuery acesse seu banco de dados.

Se você se conectar a um ambiente local ou a uma instância hospedada na nuvem usando um endereço IP público, não será necessário um anexo de rede.

Configurar um conector do PostgreSQL

Configure um conector do PostgreSQL usando o console Google Cloud ou a API.

Console

  1. No console Google Cloud , acesse a página Knowledge Catalog.

    Acessar o Knowledge Catalog

  2. No menu de navegação, na seção Gerenciar, clique em Conectores.

  3. Clique em Adicionar conexão.

  4. Na lista Conectores, selecione o card PostgreSQL.

  5. Na seção Detalhes da fonte de dados, forneça os detalhes da conexão para sua instância do PostgreSQL:

    • Em Anexo de rede, selecione um anexo de rede existente, se necessário, ou crie um.
    • Insira o Host, a Porta, o Nome do banco de dados, o Nome de usuário e a Senha.
    • Se estiver usando TLS, selecione um Modo TLS e forneça um Certificado PEM confiável.
    • Em Objetos de metadados do PostgreSQL para importar, clique em Procurar para selecionar objetos.
  6. Na seção Configurações de destino:

    • Clique em Procurar e selecione um Grupo de entradas do Knowledge Catalog para armazenar os metadados importados ou clique em Criar novo grupo de entradas.
    • Escolha se você quer definir permissões no grupo de entrada agora ou depois. Recomendamos definir permissões para que os usuários possam ver os metadados importados. Se você não concedeu o papel de importador de grupos de entradas do Dataplex (roles/dataplex.entryGroupImporter) ou a permissão dataplex.entryGroups.import ao agente de serviço do serviço de transferência de dados do BigQuery (service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) no nível do projeto, conceda no nível do grupo de entradas.
  7. No campo Nome de exibição da seção Nome da configuração do conector, insira um nome para o job de importação de metadados.

  8. Na seção Opções de programação, configure a frequência do job de importação de metadados. Se você selecionar Sob demanda, o job será executado apenas quando você o acionar manualmente.

  9. Opcional: na seção Opções de notificação, configure notificações por e-mail ou Pub/Sub para falhas de jobs.

  10. Opcional: na seção Opções avançadas, configure as opções de criptografia. Se você selecionar uma chave de criptografia gerenciada pelo cliente (CMEK), observe que a chave será usada para criptografar todos os dados temporários armazenados antes de iniciar os jobs de importação de metadados do Catálogo do Knowledge. Ele não é usado para criptografar os metadados no grupo de entradas de destino do Knowledge Catalog.

  11. Clique em Salvar.

REST

Use o método projects.locations.transferConfigs.create. No recurso TransferConfig, configure os seguintes campos:

  • Defina o campo dataSourceId como "postgresql"
  • No campo metadataDestination, preencha o objeto dataplexConfiguration com o caminho do recurso do grupo de entradas de destino do Knowledge Catalog: projects/<var>PROJECT_ID</var>/locations/<var>LOCATION</var>/entryGroups/<var>ENTRY_GROUP_ID</var>

Depois de criar o job, o catálogo de dados do Knowledge Catalog programa a primeira execução de acordo com sua configuração, ou você pode iniciá-la manualmente.

A seguir