In diesem Dokument finden Sie Antworten auf häufig gestellte Fragen zu Google CloudKnowledge Catalog (ehemals Dataplex Universal Catalog).
Weitere Informationen zu Knowledge Catalog finden Sie in der Knowledge Catalog-Übersicht.
Allgemeine Konzepte
Hier finden Sie häufig gestellte Fragen zu Knowledge Catalog-Funktionen und der Beziehung zu Data Catalog.
Was ist Knowledge Catalog?
Google Knowledge Catalog ist eine intelligente Governance-Lösung für Daten- und KI-Assets in Google Cloud. Es bietet ein zentrales Inventar, in dem Sie Ihre Daten aus Google Cloud Datenquellen wie BigQuery, Cloud Storage, Pub/Sub und Spanner ermitteln, verwalten und steuern können.
Knowledge Catalog nutzt KI, um die Datenermittlung, die Metadatenanreicherung und die Datenqualität zu automatisieren. Mit seinem verwalteten Datenkatalog bietet Knowledge Catalog die wesentliche Grundlage, die KI-Agenten benötigen, um hochwertige Inhalte zu generieren.
Was ist Data Catalog?
Data Catalog war der ursprüngliche Name des Metadatendienstes von Google Cloud. Im Laufe der Zeit hat es sich zu Dataplex Universal Catalog entwickelt und wurde nun in Knowledge Catalog umbenannt und weiterentwickelt.
Der Begriff „Data Catalog“ wird zwar weiterhin verwendet, um diese Art der Datenindexierung zu beschreiben, bezieht sich im Kontext von Google Cloudjedoch auf unser altes Produkt. Verwenden Sie Knowledge Catalog für alle neuen Projekte, um von KI-gestützten Funktionen und einer verbesserten Governance zu profitieren.
Unterscheidet sich Knowledge Catalog von Data Catalog?
Ja, Knowledge Catalog ist die KI-gestützte Plattform für die Datenverwaltung, die den vorhandenen Data Catalog ersetzen wird. Knowledge Catalog basiert auf ähnlichen Konzepten wie Data Catalog, bietet aber einige Verbesserungen:
KI-basierter Kontext:Im Gegensatz zu Data Catalog verwendet Knowledge Catalog Gemini, um automatisch Geschäftskontext zu extrahieren, Beschreibungen in natürlicher Sprache zu generieren und SQL-„Golden Queries“ bereitzustellen, um KI-Agenten zu fundieren.
Unterstützung für umfangreiche Metadaten:Knowledge Catalog unterstützt komplexere Metadatentypen wie verschachtelte Arrays, Maps und Datensätze.
Agentenzugriff:KI-Agenten können Knowledge Catalog-Tools über einen lokalen oder Remote-MCP-Server erkennen und adaptiv verwenden.
Datenermittlung:Knowledge Catalog kann Metadaten automatisch aus einer größeren Anzahl von Google Cloud Diensten und externen Datenquellen aufnehmen.
Governance im großen Maßstab:Dataplex bietet erweiterte Funktionen für die Datenprofilerstellung, automatische Datenqualität und zentralisierte Governance.
Wofür wird Knowledge Catalog verwendet?
Google Knowledge Catalog löst das Problem des „Datenkaltstarts“ – die Zeit, die mit der Suche nach Daten, dem Verständnis und der Vertrauensbildung in Daten verschwendet wird, bevor Sie sie tatsächlich verwenden können. Die wichtigsten Anwendungsfälle sind:
Schnellere Datensuche: Anstatt komplexe Organisationsstrukturen durchsuchen zu müssen, um Daten zu finden, können Sie die Suche in natürlicher Sprache verwenden, z. B. „Zeige mir die neuesten Daten zum Kundenabgang“. So lassen sich Assets inGoogle Cloud -Ressourcen sofort finden, was die Produktivität der Datennutzer steigert.
KI-Agenten auf Unternehmensdaten stützen: Sie fungiert als „Source of Truth“ für generative KI oder das ADK. Durch die Verknüpfung von physischen Daten mit Geschäftsdefinitionen wird sichergestellt, dass KI-Agenten (z. B. solche, die auf Vertex AI basieren) hochwertige Daten verwenden. Dadurch werden KI-Halluzinationen deutlich reduziert und das Vertrauen in KI-generierte Statistiken gestärkt.
Automatisierte Data Governance: Ihre Daten werden automatisch gescannt, um sensible Informationen (personenidentifizierbare Informationen) zu erkennen. Außerdem wird nachverfolgt, woher die Daten stammen (Lineage), und ihre Genauigkeit wird überwacht (automatische Datenqualität). Diese Funktionen tragen dazu bei, das Vertrauen in Daten, die Sicherheit und die Compliance mit weniger manuellem Aufwand zu verbessern.
„Dark Data“ aufdecken: Die Funktion kann unstrukturierte Dateien (z. B. PDFs oder Bilder in Cloud Storage) scannen, die darin enthaltenen Informationen extrahieren und in BigQuery durchsuchbar und abfragbar machen. So können Sie Erkenntnisse aus bisher nicht zugänglichen Daten gewinnen.
Knowledge Catalog-Anwendungsfälle
Welche Arten von Metadaten werden in Knowledge Catalog gespeichert?
Knowledge Catalog speichert drei Arten von Metadaten:
Technische Metadaten: Schemas, Tabellennamen und Systemeigenschaften werden automatisch erfasst.
Geschäftsmetadaten: Nutzerdefinierter Kontext wie Geschäftsbeschreibungen, Glossarbegriffe und Eigentümerschaft.
Laufzeitmetadaten: Informationen zur Datenherkunft, zu Datenqualitätsbewertungen und zu Statistiken zur Datenprofilerstellung.
Migration von Data Catalog
Hier finden Sie häufig gestellte Fragen zu Übergangszeitplänen, Auswirkungen und Anleitungen zum Migrieren von Metadaten-Workflows von Data Catalog zu Knowledge Catalog.
Wie migriere ich Daten aus Data Catalog?
Die Umstellung auf Knowledge Catalog soll nahtlos erfolgen. Es ist keine manuelle Datenübertragung erforderlich. Je nach Ihrer aktuellen Nutzung umfasst der Prozess zwei Hauptphasen:
Vorbereitungsphase: Wenn Sie benutzerdefinierte Metadaten haben (z. B. Tags, Tag-Vorlagen oder benutzerdefinierte Einträge), werden diese Inhalte automatisch als schreibgeschützt in Knowledge Catalog übernommen. In dieser Phase führen Sie Konfigurationsaufgaben aus, um Ihre vorhandenen Data Catalog-Inhalte gleichzeitig in der neuen Benutzeroberfläche verfügbar zu machen.
Übertragungsphase: Nachdem Sie die Metadaten vorbereitet haben, übertragen Sie den aktiven Status, damit sie in Knowledge Catalog gelesen und geschrieben werden können. Sie sollten diesen Schritt mit der Aktualisierung aller programmatischen Arbeitslasten (APIs, Clientbibliotheken oder Terraform-Module) koordinieren, damit sie auf die neuen Knowledge Catalog-Endpunkte verweisen.
Wenn Sie keine benutzerdefinierten Metadaten haben oder neu auf der Plattform sind, können Sie die Umstellung abschließen, indem Sie Knowledge Catalog als Standard-UI in der Google Cloud Konsole festlegen.
Weitere Informationen finden Sie unter Von Data Catalog auf Knowledge Catalog umstellen.
Abrechnung von Data Insights
Hier finden Sie häufig gestellte Fragen zur tokenbasierten Abrechnung, zur Nutzungsmessung und zu den administrativen Steuerelementen für die Funktion „Datenstatistiken“ im Knowledge Catalog.
Ab wann wird mir die Nutzung von Datenstatistiken in Rechnung gestellt?
Die aktive Abrechnung für Datenstatistiken beginnt am 27. Oktober 2026.
Wie wird die Nutzung von Daten-Insights abgerechnet?
Die Nutzung wird in Datentokens gemessen. Datentokens stellen die Grundeinheiten von Text und Metadaten dar, die vom Gemini-Modell verarbeitet werden. Diese Tokens sind in zwei Kategorien unterteilt:
- Eingabetokens:Der Kontext, die Anweisungen und der Verlauf, die an das Modell gesendet werden.
- Ausgabetokens:Die generierten Beschreibungen, Beziehungen und Anfragen in natürlicher Sprache, die vom Modell zurückgegeben werden.
Weitere Informationen finden Sie unter Data Cloud Agent – Preise.
Erhalten Dienstkonten ein kostenloses Kontingent für Datenstatistiken?
Nein. Dienstkonten erhalten kein kostenloses Kontingent pro Nutzer. Die Nutzung wird jedoch auf dieselbe Weise gemessen wie bei Standardnutzern.
Wie kann ich verhindern, dass Datenstatistiken automatisch in Rechnung gestellt werden?
Um Gebühren zu vermeiden, sollten Sie Ihre laufenden Scans überprüfen und keine neuen Scans auslösen. Administratoren können die Funktion für Datenstatistiken auch deaktivieren, indem sie die Dataplex API im entsprechenden Projekt deaktivieren.
Wie kann ich herausfinden, wie viel mir für Datenstatistiken berechnet wird?
Google Cloud bietet eine Abrechnung für Datentokens. Mit dieser Messung können Administratoren und Inhaber von KI-Agenten ihren Tokenverbrauch im Blick behalten. Diese Messfunktion ist verfügbar, bevor die aktive Abrechnung im Oktober 2026 beginnt.
Abrechnung und Kostenmonitoring
Wie kann ich die Kosten für Dataplex-DCUs für Datenqualität, Datenprofilerstellung und Data Lineage überwachen und zuordnen?
Dataplex DataScan-Compute-Einheiten (Auto Data Quality und Datenprofilerstellung) und Data Lineage Data Compute Units (DCUs) werden auf serverlosem Compute in der von Dataplex verwalteten Infrastruktur ausgeführt und veröffentlichen keine Zeitreihenmesswerte unter dataplex.googleapis.com/* in Cloud Monitoring.
Wenn Sie die Dataplex-DCU-Kosten projekt- und scanübergreifend überwachen, Benachrichtigungen dazu einrichten und sie zuordnen möchten, exportieren Sie Ihre Cloud Billing-Daten nach BigQuery und fragen Sie Systemlabels ab, die an Dataplex-Abrechnungsdatensätze angehängt sind:
- Verwenden Sie für Datenqualitäts- und Datenprofilscans die
goog-dataplex-datascan-*-Labels (z. B.goog-dataplex-datascan-id,goog-dataplex-datascan-data-source-projectundgoog-dataplex-datascan-data-source-bigquery-table). - Verwenden Sie für die Verarbeitung von Data Lineage das Label
goog-dataplex-workload-typemit dem WertLINEAGE.
Detaillierte Labeldefinitionen und Beispiel-SQL-Abfragen für BigQuery finden Sie unter Dataplex-DCU-Kosten mit Cloud Billing-Export überwachen und zuordnen.