Este documento descreve como importar metadados do MySQL para o Knowledge Catalog (antigo Dataplex Universal Catalog) usando um conector do Knowledge Catalog.
Esse conector oferece suporte a instâncias do MySQL hospedadas no local, no Cloud SQL ou em outros ambientes de nuvem.
Antes de importar metadados do MySQL, conclua as seguintes tarefas:
- Conceda os papéis e permissões necessários.
- Ative as APIs do Knowledge Catalog e do serviço de transferência de dados do BigQuery.
- Atenda aos pré-requisitos do MySQL.
- Atenda aos pré-requisitos de rede.
Permissões e papéis do IAM
Para criar e gerenciar um job de conector do Knowledge Catalog, você precisa de papéis do Identity and Access Management (IAM) que concedam permissões para o Knowledge Catalog e o serviço de transferência de dados do BigQuery.
Para receber as permissões necessárias para configurar um conector do MySQL, peça ao administrador para conceder a você os seguintes papéis do IAM:
- Para criar e gerenciar grupos de entradas: administrador do catálogo do Dataplex
(
roles/dataplex.catalogAdmin), editor do catálogo do Dataplex (roles/dataplex.catalogEditor), ou proprietário do grupo de entradas do Dataplex (roles/dataplex.entryGroupOwner) no projeto. - Para criar e gerenciar jobs de transferência do serviço de transferência de dados do BigQuery: administrador do BigQuery
(
roles/bigquery.admin) no projeto. - Para visualizar registros no Cloud Logging: leitor de registros
(
roles/logging.viewer) no projeto.
Além disso, é necessário conceder ao agente de serviço de transferência de dados do BigQuery
(service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) a
dataplex.entryGroups.import permissão ou o papel de importador de grupos de entradas do Dataplex
(roles/dataplex.entryGroupImporter). É possível conceder esse papel no nível do projeto ou do grupo de entradas.
Para mais informações sobre como conceder papéis, consulte Gerenciar acesso.
Ativar APIs
Ative as APIs do Knowledge Catalog e do serviço de transferência de dados do BigQuery.
Pré-requisitos do MySQL
Verifique se você atende aos pré-requisitos para transferências do MySQL. Para mais detalhes, consulte Pré-requisitos do MySQL na documentação do serviço de transferência de dados do BigQuery.
Além dos pré-requisitos do serviço de transferência de dados do BigQuery, seu banco de dados MySQL precisa atender aos seguintes requisitos para extração de metadados:
- Versão mínima:MySQL versão 8.0 ou mais recente.
- Permissões mínimas necessárias:a ferramenta de extração exige permissões específicas para consultar
INFORMATION_SCHEMAe coletar metadados.
Essas permissões garantem a seguinte cobertura de metadados:
- Informações da instância e do banco de dados:nome do host, porta, versão e configurações de esquema.
- Tabelas e colunas:estrutura principal, tipos de dados e metadados operacionais, como tamanhos e contagens de linhas.
- Índices e partições:índices secundários, métodos de partição e expressões.
- Visualizações:estruturas e definições de tabelas virtuais.
- Rotinas:procedimentos armazenados, funções e parâmetros.
- Restrições:chave primária detalhada, chave externa, restrições exclusivas e de verificação.
- Gatilhos:definições de gatilho e tempo de evento.
Para conceder essas permissões, execute os seguintes scripts SQL.
Crie o usuário:
CREATE USER 'USERNAME'@'%' IDENTIFIED BY 'PASSWORD';Conceda acesso aos metadados. É possível conceder acesso a um único banco de dados de destino ou a todos os bancos de dados na instância.
Para conceder acesso a um único banco de dados ou esquema de destino:
GRANT SELECT, SHOW VIEW, REFERENCES, EXECUTE, TRIGGER ON DATABASE_NAME.* TO 'USERNAME'@'%';Como alternativa, para conceder acesso a todos os bancos de dados na instância:
GRANT SELECT, SHOW VIEW, REFERENCES, EXECUTE, TRIGGER ON *.* TO 'USERNAME'@'%';Permita que a ferramenta de extração liste todos os bancos de dados disponíveis na instância:
GRANT SHOW DATABASES ON *.* TO 'USERNAME'@'%';Aplique as alterações:
FLUSH PRIVILEGES;
Substitua:
USERNAME: o usuário do banco de dados que você quer configurar.PASSWORD: a senha do usuário do banco de dados.DATABASE_NAME: o nome do banco de dados MySQL que você quer acessar.
Pré-requisitos de rede
Um anexo de rede para conexão pelo Private Service Connect é necessário ao se conectar com segurança a bancos de dados externos ou fontes de dados de nuvem de terceiros com um endereço IP privado dentro de uma rede privada, para permitir que o serviço de transferência de dados do BigQuery acesse seu banco de dados.
Se você se conectar a um ambiente local ou a uma instância hospedada na nuvem usando um endereço IP público, um anexo de rede não será necessário.
Configurar um conector do MySQL
No Google Cloud console, acesse a página Knowledge Catalog.
No menu de navegação, na seção Gerenciar, clique em Conectores.
Clique em Adicionar conexão.
Na lista Conectores, selecione o card MySQL.
Na seção Detalhes da fonte de dados, forneça os detalhes da conexão para sua instância do MySQL:
- Em Anexo de rede, selecione um anexo de rede existente, se necessário, ou crie um.
- Insira o host, a porta, o nome do banco de dados, o nome de usuário e a senha.
- Se você estiver usando o TLS, selecione um modo TLS e forneça um certificado PEM confiável.
- Em Objetos de metadados do MySQL a serem importados, clique em Procurar para selecionar objetos.
Na seção Configurações de destino:
- Clique em Procurar e selecione um grupo de entradas do Knowledge Catalog para armazenar os metadados importados ou clique em Criar novo grupo de entradas.
- Escolha se quer definir permissões no grupo de entradas agora ou mais tarde. Defina permissões para que os usuários possam visualizar os metadados importados. Se você não
concedeu o papel de importador de grupos de entradas do Dataplex
(
roles/dataplex.entryGroupImporter) ou a permissãodataplex.entryGroups.importao agente de serviço de transferência de dados do BigQuery (service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) no nível do projeto, conceda-o no nível do grupo de entradas.
No campo Nome de exibição da seção Nome de configuração do conector, insira um nome para o job de importação de metadados.
Na seção Opções de programação, configure a frequência do job de importação de metadados. Se você selecionar Sob demanda, o job será executado apenas quando você o acionar manualmente.
Opcional: na seção Opções de notificação, configure notificações por e-mail ou Pub/Sub para falhas de job.
Opcional: na seção Opções avançadas, configure as configurações de criptografia. Se você selecionar uma chave de criptografia gerenciada pelo cliente (CMEK), observe que a chave será usada para criptografar todos os dados temporários preparados antes de iniciar os jobs de importação de metadados do Knowledge Catalog. Ela não é usada para criptografar os metadados no grupo de entradas de destino do Knowledge Catalog.
Clique em Salvar.
Depois de criar o job, o Knowledge Catalog programa a primeira execução de acordo com sua configuração ou você pode iniciá-la manualmente.
A seguir
- Saiba como gerenciar jobs de conector.