Neste documento, descrevemos como importar metadados do PostgreSQL para o Knowledge Catalog (antigo Dataplex Universal Catalog) usando um conector do Knowledge Catalog.
Este conector é compatível com instâncias do PostgreSQL hospedadas no local, no Cloud SQL ou em outros ambientes de nuvem.
Antes de começar
Antes de importar metadados do PostgreSQL, conclua as seguintes tarefas:
- Conceda os papéis e as permissões necessários.
- Ative as APIs Knowledge Catalog e serviço de transferência de dados do BigQuery.
- Atenda aos pré-requisitos do PostgreSQL.
- Atenda aos pré-requisitos de rede.
Permissões e papéis do IAM
Para criar e gerenciar um job de conector do Knowledge Catalog, você precisa de papéis do Identity and Access Management (IAM) que concedam permissões para o Knowledge Catalog e o serviço de transferência de dados do BigQuery.
Para receber as permissões necessárias para configurar um conector do PostgreSQL, peça ao administrador para conceder a você os seguintes papéis do IAM:
- Para criar e gerenciar grupos de entradas:
Administrador do catálogo do Dataplex
(
roles/dataplex.catalogAdmin), Editor do catálogo do Dataplex (roles/dataplex.catalogEditor) ou Proprietário do grupo de entradas do Dataplex (roles/dataplex.entryGroupOwner) no projeto. - Para criar e gerenciar jobs de transferência do serviço de transferência de dados do BigQuery:
Administrador do BigQuery
(
roles/bigquery.admin) no projeto. - Para ver os registros no Cloud Logging, acesse o Visualizador de registros
(
roles/logging.viewer) no projeto.
Além disso, é necessário conceder ao agente de serviço do serviço de transferência de dados do BigQuery (service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) a permissão dataplex.entryGroups.import ou o papel Importador de grupo de entradas do Dataplex (roles/dataplex.entryGroupImporter). É possível conceder esse papel no nível do projeto ou do grupo de entradas.
Para mais informações sobre como conceder papéis, consulte Gerenciar acesso.
Ativar APIs
Ative as APIs Knowledge Catalog e serviço de transferência de dados do BigQuery.
Pré-requisitos do PostgreSQL
Verifique se você atende aos pré-requisitos para transferências do PostgreSQL. Para mais detalhes, consulte Pré-requisitos do PostgreSQL na documentação do serviço de transferência de dados do BigQuery.
Pré-requisitos de rede
Um anexo de rede para conexão pelo Private Service Connect é necessário ao se conectar com segurança a bancos de dados externos ou fontes de dados de nuvem de terceiros com um endereço IP privado em uma rede privada, para permitir que o serviço de transferência de dados do BigQuery acesse seu banco de dados.
Se você se conectar a um ambiente local ou a uma instância hospedada na nuvem usando um endereço IP público, não será necessário um anexo de rede.
Configurar um conector do PostgreSQL
Configure um conector do PostgreSQL usando o console Google Cloud ou a API.
Console
No console Google Cloud , acesse a página Knowledge Catalog.
No menu de navegação, na seção Gerenciar, clique em Conectores.
Clique em Adicionar conexão.
Na lista Conectores, selecione o card PostgreSQL.
Na seção Detalhes da fonte de dados, forneça os detalhes da conexão para sua instância do PostgreSQL:
- Em Anexo de rede, selecione um anexo de rede existente, se necessário, ou crie um.
- Insira o Host, a Porta, o Nome do banco de dados, o Nome de usuário e a Senha.
- Se estiver usando TLS, selecione um Modo TLS e forneça um Certificado PEM confiável.
- Em Objetos de metadados do PostgreSQL para importar, clique em Procurar para selecionar objetos.
Na seção Configurações de destino:
- Clique em Procurar e selecione um Grupo de entradas do Knowledge Catalog para armazenar os metadados importados ou clique em Criar novo grupo de entradas.
- Escolha se você quer definir permissões no grupo de entrada agora ou depois.
Recomendamos definir permissões para que os usuários possam ver os metadados importados. Se você não concedeu o papel de importador de grupos de entradas do Dataplex (roles/dataplex.entryGroupImporter) ou a permissão dataplex.entryGroups.import ao agente de serviço do serviço de transferência de dados do BigQuery (
service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) no nível do projeto, conceda no nível do grupo de entradas.
No campo Nome de exibição da seção Nome da configuração do conector, insira um nome para o job de importação de metadados.
Na seção Opções de programação, configure a frequência do job de importação de metadados. Se você selecionar Sob demanda, o job será executado apenas quando você o acionar manualmente.
Opcional: na seção Opções de notificação, configure notificações por e-mail ou Pub/Sub para falhas de jobs.
Opcional: na seção Opções avançadas, configure as opções de criptografia. Se você selecionar uma chave de criptografia gerenciada pelo cliente (CMEK), observe que a chave será usada para criptografar todos os dados temporários armazenados antes de iniciar os jobs de importação de metadados do Catálogo do Knowledge. Ele não é usado para criptografar os metadados no grupo de entradas de destino do Knowledge Catalog.
Clique em Salvar.
REST
Use o método projects.locations.transferConfigs.create. No recurso TransferConfig, configure os seguintes campos:
- Defina o campo
dataSourceIdcomo"postgresql" - No campo
metadataDestination, preencha o objetodataplexConfigurationcom o caminho do recurso do grupo de entradas de destino do Knowledge Catalog:projects/<var>PROJECT_ID</var>/locations/<var>LOCATION</var>/entryGroups/<var>ENTRY_GROUP_ID</var>
Depois de criar o job, o catálogo de dados do Knowledge Catalog programa a primeira execução de acordo com sua configuração, ou você pode iniciá-la manualmente.
A seguir
- Saiba como gerenciar jobs de conector.