In diesem Dokument wird beschrieben, wie Sie Metadaten aus MySQL mit einem Knowledge Catalog-Connector (ehemals Dataplex Universal Catalog) in Knowledge Catalog importieren.
Dieser Connector unterstützt MySQL-Instanzen, die lokal, in Cloud SQL oder in anderen Cloud-Umgebungen gehostet werden.
Bevor Sie Metadaten aus MySQL importieren können, müssen Sie die folgenden Aufgaben ausführen:
- Erteilen Sie die erforderlichen Rollen und Berechtigungen.
- Aktivieren Sie die Knowledge Catalog API und die BigQuery Data Transfer Service API.
- Erfüllen Sie die MySQL-Voraussetzungen.
- Erfüllen Sie die Netzwerkvoraussetzungen.
IAM-Rollen und -Berechtigungen
Zum Erstellen und Verwalten eines Knowledge Catalog-Connector-Jobs benötigen Sie IAM-Rollen (Identity and Access Management), die Berechtigungen für Knowledge Catalog und BigQuery Data Transfer Service gewähren.
Bitten Sie Ihren Administrator, Ihnen die folgenden IAM-Rollen zuzuweisen, um die Berechtigungen zu erhalten, die Sie zum Konfigurieren eines MySQL-Connectors benötigen:
- Zum Erstellen und Verwalten von Eintragsgruppen: Dataplex Catalog-Administrator
(
roles/dataplex.catalogAdmin), Dataplex Catalog-Bearbeiter (roles/dataplex.catalogEditor) oder Dataplex-Eintragsgruppeninhaber (roles/dataplex.entryGroupOwner) für das Projekt. - Zum Erstellen und Verwalten von BigQuery Data Transfer Service-Übertragungsjobs: BigQuery-Administrator
(
roles/bigquery.admin) für das Projekt. - Zum Aufrufen von Logs in Cloud Logging: Loganzeiger
(
roles/logging.viewer) für das Projekt.
Außerdem müssen Sie dem Dienst-Agent für BigQuery Data Transfer Service
(service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) die
dataplex.entryGroups.import Berechtigung oder die Dataplex-Eintragsgruppen
importeur
(roles/dataplex.entryGroupImporter) Rolle gewähren. Sie können diese Rolle entweder auf Projekt- oder Eintragsgruppenebene zuweisen.
Weitere Informationen zum Zuweisen von Rollen finden Sie unter Zugriff verwalten.
APIs aktivieren
Aktivieren Sie die Knowledge Catalog API und die BigQuery Data Transfer Service API.
MySQL-Voraussetzungen
Erfüllen Sie die Voraussetzungen für MySQL-Übertragungen. Weitere Informationen finden Sie unter MySQL-Voraussetzungen in der BigQuery Data Transfer Service-Dokumentation.
Zusätzlich zu den BigQuery Data Transfer Service-Voraussetzungen muss Ihre MySQL-Datenbank die folgenden Anforderungen für die Metadatenextraktion erfüllen:
- Mindestversion:MySQL-Version 8.0 oder höher.
- Mindestens erforderliche Berechtigungen:Das Extraktionstool benötigt bestimmte Berechtigungen, um
INFORMATION_SCHEMAabzufragen und Metadaten zu erfassen.
Diese Berechtigungen sorgen für die folgende Metadatenabdeckung:
- Instanz- und Datenbankinformationen:Hostname, Port, Version und Schemakonfigurationen.
- Tabellen und Spalten:Kernstruktur, Datentypen und betriebliche Metadaten wie Größen und Zeilenanzahlen.
- Indizes und Partitionen:Sekundäre Indizes, Partitionierungsmethoden und Ausdrücke.
- Ansichten:Virtuelle Tabellenstrukturen und Definitionen.
- Routinen:Gespeicherte Prozeduren, Funktionen und ihre Parameter.
- Beschränkungen:Detaillierte Beschränkungen für Primärschlüssel, Fremdschlüssel, eindeutige und Prüfbeschränkungen.
- Trigger:Triggerdefinitionen und Ereigniszeitpunkt.
Führen Sie die folgenden SQL-Skripts aus, um diese Berechtigungen zu erteilen.
Erstellen Sie den Nutzer:
CREATE USER 'USERNAME'@'%' IDENTIFIED BY 'PASSWORD';Gewähren Sie Zugriff auf Metadaten. Sie können den Zugriff für eine einzelne Zieldatenbank oder für alle Datenbanken in der Instanz gewähren.
So gewähren Sie Zugriff für eine einzelne Zieldatenbank oder ein einzelnes Schema:
GRANT SELECT, SHOW VIEW, REFERENCES, EXECUTE, TRIGGER ON DATABASE_NAME.* TO 'USERNAME'@'%';Alternativ können Sie den Zugriff für alle Datenbanken in der Instanz gewähren:
GRANT SELECT, SHOW VIEW, REFERENCES, EXECUTE, TRIGGER ON *.* TO 'USERNAME'@'%';Erlauben Sie dem Extraktionstool, alle verfügbaren Datenbanken in der Instanz aufzulisten:
GRANT SHOW DATABASES ON *.* TO 'USERNAME'@'%';Übernehmen Sie die Änderung:
FLUSH PRIVILEGES;
Ersetzen Sie Folgendes:
USERNAME: Der Datenbanknutzer, den Sie konfigurieren möchten.PASSWORD: Das Passwort für den Datenbanknutzer.DATABASE_NAME: Der Name der MySQL-Datenbank, auf die Sie zugreifen möchten.
Netzwerkvoraussetzungen
Ein Netzwerkanhang für die Verbindung über Private Service Connect ist erforderlich, wenn Sie eine sichere Verbindung zu externen Datenbanken oder Cloud-Datenquellen von Drittanbietern mit einer privaten IP-Adresse in einem privaten Netzwerk herstellen, damit BigQuery Data Transfer Service auf Ihre Datenbank zugreifen kann.
Wenn Sie über eine öffentliche IP-Adresse eine Verbindung zu einer lokalen Umgebung oder einer in der Cloud gehosteten Instanz herstellen, ist kein Netzwerkanhang erforderlich.
MySQL-Connector konfigurieren
Konfigurieren Sie einen MySQL-Connector mit der Google Cloud Console oder der API.
Console
Rufen Sie in der Google Cloud Console die Knowledge Catalog Seite auf.
Klicken Sie im Navigationsmenü im Bereich Verwalten auf Connectors.
Klicken Sie auf Verbindung hinzufügen.
Wählen Sie in der Liste Connectors die Karte MySQL aus.
Geben Sie im Bereich Details zur Datenquelle die Verbindungsdetails für Ihre MySQL-Instanz an:
- Wählen Sie unter Netzwerkanhang gegebenenfalls einen vorhandenen Netzwerkanhang aus oder erstellen Sie einen.
- Geben Sie Host, Port, Datenbankname, Nutzername und Passwort ein.
- Wenn Sie TLS verwenden, wählen Sie einen TLS-Modus aus und geben Sie ein vertrauenswürdiges PEM-Zertifikat an.
- Klicken Sie unter Zu importierende MySQL-Metadatenobjekte auf Durchsuchen, um Objekte auszuwählen.
Im Bereich Zieleinstellungen:
- Klicken Sie auf Durchsuchen und wählen Sie eine vorhandene Knowledge Catalog-Eintragsgruppe aus, in der die importierten Metadaten gespeichert werden sollen, oder klicken Sie auf Neue Eintragsgruppe erstellen.
- Wählen Sie aus, ob Sie Berechtigungen für die Eintragsgruppe jetzt oder später festlegen möchten. Legen Sie Berechtigungen fest, damit Nutzer die importierten Metadaten ansehen können. Wenn Sie dem Dienst-Agent für BigQuery Data Transfer Service
(
service-PROJECT_NUMBER@gcp-sa-bigquerydatatransfer.iam.gserviceaccount.com) die Rolle Dataplex-Eintragsgruppen importeur (roles/dataplex.entryGroupImporter) oder diedataplex.entryGroups.importBerechtigung nicht auf Projektebene gewährt haben, müssen Sie sie auf Eintragsgruppenebene gewähren.
Geben Sie im Bereich Name der Connector-Konfiguration unter Anzeigename einen Namen für den Metadatenimportjob ein.
Konfigurieren Sie im Bereich Zeitplanoptionen die Häufigkeit für den Metadatenimportjob. Wenn Sie On demand auswählen, wird der Job nur ausgeführt, wenn Sie ihn manuell auslösen.
Optional: Konfigurieren Sie im Bereich Benachrichtigungsoptionen E-Mail- oder Pub/Sub-Benachrichtigungen für Jobfehler.
Optional: Konfigurieren Sie im Bereich Erweiterte Optionen die Verschlüsselungseinstellungen. Wenn Sie einen vom Kunden verwalteten Verschlüsselungsschlüssel (Customer-Managed Encryption Key, CMEK) auswählen, wird der Schlüssel verwendet, um alle temporären Daten zu verschlüsseln, die vor dem Start der Knowledge Catalog-Metadatenimportjobs bereitgestellt werden. Er wird nicht verwendet, um die Metadaten in der Ziel-Knowledge Catalog-Eintragsgruppe zu verschlüsseln.
Klicken Sie auf Speichern.
REST
Verwenden Sie die projects.locations.transferConfigs.create
Methode. Konfigurieren Sie in der TransferConfig
Ressource die folgenden Felder:
- Setzen Sie das
dataSourceIdFeld auf"mysql". - Füllen Sie im Feld
metadataDestinationdasdataplexConfigurationObjekt mit dem Ressourcenpfad der Ziel-Knowledge Catalog-Eintragsgruppe aus:projects/<var>PROJECT_ID</var>/locations/<var>LOCATION</var>/entryGroups/<var>ENTRY_GROUP_ID</var>
Nachdem Sie den Job erstellt haben, plant Knowledge Catalog die erste Ausführung gemäß Ihrer Konfiguration oder Sie können sie manuell starten.
MySQL-Metadaten suchen und ansehen
Rufen Sie in der Google Cloud Console die Seite Knowledge Catalog Suchen auf.
Im Bereich Filter können Sie nach MySQL-Assets filtern. Verwenden Sie dazu die Bereiche Projekt, System und Aliasse für Typen. Wählen Sie im Bereich System die Option Importierter Kontext aus. Wenn Sie diesen Filter auswählen, wird ein Unterbereich Verwaltete Connectors geöffnet. Wählen Sie MySQL aus, um nach allen MySQL-Metadaten zu filtern.
Sie können das Suchfeld verwenden, um Suchanfragen auszuführen. Sie können eine Suche nach Keywords oder in natürlicher Sprache durchführen. Wenn Sie beispielsweise alle MySQL-Tabellen über die Suche nach Keywords aufrufen möchten, geben Sie
system=MYSQL AND type=TABLEein.Weitere Informationen zum Suchen nach Ressourcen finden Sie unter Nach Ressourcen in Knowledge Catalog suchen. Weitere Informationen zu den Ausdrücken, die Sie im Suchfeld verwenden können, finden Sie unter Suchsyntax für Knowledge Catalog.
Sie können auch die LookupContext API verwenden, um LLM-Kontext für bestimmte MySQL-Ressourcen abzurufen.
Nächste Schritte
- Informationen zum Verwalten von Connector-Jobs