Mit Knowledge Catalog können Sie die Daten Ihrer Organisation erkennen, zentral katalogisieren, verwalten und nachvollziehen. Mit leistungsstarken Suchanfragen können Sie bestimmte Daten-Assets in Ihrem Data Catalog effizient finden. Die Syntax für Suchanfragen umfasst:
- Einfache Suche: Daten-Assets mit einem einzelnen Suchbegriff finden.
- Freitextsuche: Sie können Daten-Assets mit Formulierungen in natürlicher Sprache oder mit Keywords finden.
- Qualifizierte Prädikate: Sie können Ihre Suche mithilfe bestimmter Metadatenfelder wie Name, Ort, System oder Typ verfeinern.
- Aspektsuche: Suche nach Einträgen auf Grundlage der zugehörigen geschäftlichen und technischen Metadaten.
- Logische Operatoren: Mehrere Suchkriterien mit den Operatoren
AND,ORoderNOTkombinieren, um komplexe Abfragen zu erstellen. Wenn Sie diese Syntax kennen, können Sie die benötigten Daten schnell finden.
Qualifizierte Prädikate
Mit einem qualifizierten Prädikat können Sie die Suchergebnisse eingrenzen, indem Sie die Suche anweisen, ein bestimmtes Metadatenfeld auszuwerten, z. B. einen Asset-Namen, ‑Typ oder ‑System.
Sie können ein Prädikat qualifizieren, indem Sie ihm einen Schlüssel voranstellen, der die Übereinstimmung auf ein bestimmtes Metadatenelement einschränkt:
- Ein Gleichheitszeichen (
=), um die Suche auf eine genaue Übereinstimmung zu beschränken. - Ein Doppelpunkt (
:) nach dem Schlüssel, um das Prädikat mit einem Teilstring oder einem Token innerhalb des Werts in den Suchergebnissen abzugleichen.
Bei der Tokenisierung wird der Textfluss in eine Reihe von Tokens unterteilt, wobei jedes Token in der Regel einem einzelnen Wort entspricht.
Beispiel:
- Mit
name:foowerden Ressourcen mit Namen ausgewählt, die den Teilstringfooenthalten, z. B.foo1undbarfoo. - Mit
description:foowerden Ressourcen mit dem Tokenfooin der Beschreibung ausgewählt, z. B.barundfoo. location=foostimmt mit Ressourcen an einem angegebenen Standort überein, wobeifooder Name des Standorts ist.
Unterstützte Qualifizierer
Die Knowledge Catalog-Suche unterstützt die folgenden Qualifier:
| Kennzeichner | Beschreibung |
|---|---|
name:x |
Führt zu Übereinstimmung von x mit einem Teilstring der Ressourcen-ID oder des Anzeigenamens der Ressource. |
displayname:x |
Führt zu Übereinstimmung von x mit einem Teilstring des Anzeigenamens der Ressource. |
column:x |
Führt zu Übereinstimmung von x mit einem Teilstring des Spaltennamens (oder des verschachtelten Spaltennamens) im Schema der Ressource. |
description:x |
Führt zu Übereinstimmung von x mit einem Token in der Ressourcenbeschreibung. Beispiel:
|
labels:bar |
Führt zu Übereinstimmung mit Ressourcen, die ein Label haben (mit einem Wert) und deren Labelschlüssel bar als Teilstring hat. |
labels=bar |
Führt zu Übereinstimmung mit Ressourcen, die ein Label haben (mit einem Wert) und deren Labelschlüssel bar als String entspricht. |
labels.bar:x |
Führt zu Übereinstimmung von x als Teilstring im Wert eines Labels mit dem Schlüssel bar, das an eine Ressource angehängt ist. |
labels.foo=bar |
Gleicht Ressourcen ab, bei denen der Schlüssel foo und der Schlüsselwert bar ist. |
type=TYPE |
Führt zu Übereinstimmung mit Ressourcen eines bestimmten Eintrags oder seines Typalias. Erfordert den Qualifier =. |
projectid:bar |
Führt zu Übereinstimmung mit Ressourcen in Google Cloud -Projekten, die bar als Teilstring in der ID enthalten. |
parent:x |
Führt zu Übereinstimmung von x mit einem Teilstring des hierarchischen Pfads einer Ressource. |
system=SYSTEM |
Führt zu Übereinstimmung mit Ressourcen aus einem angegebenen System. Erfordert den Qualifier =. |
location=LOCATION |
Führt zu Übereinstimmung mit Ressourcen an einem angegebenen Standort mit einem genauen Namen. Erfordert den Qualifier BigQuery Omni-Assets unterstützen diesen Qualifikator mit dem BigQuery Omni-Standortnamen.
Beispiel: |
createtime |
Findet Ressourcen, die an bzw. zu, vor oder nach einem bestimmten Datum, Zeitstempel oder relativen Zeitraum in Tagen erstellt wurden. Informationen zu unterstützten Formaten und Operatoren finden Sie unter Zeitfilter. |
updatetime |
Findet Ressourcen, die an bzw. zu, vor oder nach einem bestimmten Datum, Zeitstempel oder relativen Zeitraum in Tagen aktualisiert wurden. Informationen zu unterstützten Formaten und Operatoren finden Sie unter Zeitfilter. |
Qualifizierer für genaue Übereinstimmung
Die Prädikatschlüssel type, system, location und die Aspektsuche (ohne has) unterstützen nur den Qualifikator „genau passend“ (=), nicht den Qualifikator „Teilstring“ (:).
Verwenden Sie für diese Prädikate die folgende Syntax für den genauen Abgleich:
| Prädikatschlüssel | Richtige Syntax | Falsche Syntax |
|---|---|---|
type |
type=table (oder type=view, type=dataset) |
type:table oder type:tab |
system |
system=bigquery (oder system=spanner) |
system:bigquery oder system:big |
location |
location=us-central1 (oder location=europe-west1) |
location:us-central1 oder location:us |
Teilstring-Qualifizierer
Prädikate wie name, displayname, column, projectid und parent unterstützen den Abgleich von Teilstrings mit dem Qualifizierer Doppelpunkt (:):
name:transactionsentspricht Ressourcen, deren ID oder Anzeigenametransactionsenthält. Beispiele:daily_transactions_rawundtransactions_v2.column:customer_identspricht Ressourcen mit einem Spaltennamen, dercustomer_identhält.projectid:prodentspricht Ressourcen in Projekten, deren IDprodenthält. Beispiel:finance-prod-2026
Zeitfilter
Sie können Ressourcen nach Erstellungszeit (createtime) oder letzter Aktualisierungszeit (updatetime) filtern.
Unterstützte Operatoren und Formate
- Unterstützte Operatoren:
:,=,<,>,<=,>=,=>,=< - Relative Tage (
-Nd): Filtern Sie nach einer relativen Anzahl von Tagen in der Vergangenheit, z. B.-30d,-7doder-1d. - Kalenderdaten (
YYYY-MM-DDoderYYYY/MM/DD): Filtern Sie nach einem bestimmten Datum in GMT/UTC. - Vollständige Zeitstempel (
YYYY-MM-DDTHH:MM:SSoderYYYY-MM-DDTHH:MM:SSZ): Filtern Sie nach einem genauen Zeitstempel in GMT/UTC. Teilzeitstempel wieYYYY-MM-DDTHH:MModerYYYY-MM-DDTHHwerden ebenfalls unterstützt.
Syntax für Zeitfilter
In der folgenden Tabelle wird die Syntax für Zeitfilter erläutert:
| Formatkategorie | Gültige Syntax | Ungültige Syntax | Beschreibung |
|---|---|---|---|
| Relative Zeiteinheiten |
|
|
|
| Kalenderdaten |
|
|
|
| Zeitstempel und Zeitzonen |
|
|
|
| Tageszeitbereiche |
|
|
|
| Datumsangaben in natürlicher Sprache |
|
|
|
Labelfilter
Verwenden Sie das labels-Prädikat, um Ressourcen nach angehängten Labels zu filtern. Sie können nach Labelschlüssel, Labelwert oder beidem filtern:
| Abfragemuster | Beispiel | Beschreibung |
|---|---|---|
labels=KEY |
labels=environment |
Entspricht Ressourcen, die ein Label mit dem genauen Schlüssel environment haben, unabhängig vom Wert. |
labels:KEY_SUBSTRING |
labels:tier |
Führt zu Übereinstimmung mit Ressourcen, deren Labelschlüssel tier als Teilstring enthält (z. B. service_tier oder storage_tier). |
labels.KEY=VALUE |
labels.env=prod |
Entspricht Ressourcen, bei denen der Labelschlüssel env und der Wert genau prod ist. |
labels.KEY:VALUE_SUBSTRING |
labels.owner:analytics |
Stimmt mit Ressourcen mit dem Labelschlüssel owner überein, deren Wert analytics als Teilstring enthält (z. B. analytics-team oder data-analytics). |
| Mehrere Labels (UND) | labels.env=prod labels.data_tier=tier1 |
Entspricht Ressourcen, denen sowohl das Label env=prod als auch das Label data_tier=tier1 zugewiesen ist. |
| Kombiniert mit System und Typ | system=bigquery type=table labels.env=prod labels.confidentiality=high |
Entspricht BigQuery-Tabellen, die mit env=prod und confidentiality=high gekennzeichnet sind. |
Aspektsuche
Sie können mit der Abfragesyntax nach Einträgen anhand der zugehörigen Aspekte suchen.
Beim Teilstring-Abgleich wird versucht, eine Übereinstimmung mit einer begrenzten Anzahl von Aspekten zu finden. Wenn Sie den Eintrag nicht über ein Fragment des Pfads finden, verwenden Sie den vollständigen Pfad, um die Suche einzugrenzen und die Erinnerung zu erhöhen.
| Kennzeichner | Beschreibung |
|---|---|
aspect:xoder has:x |
Gleicht x als Teilstring des vollständigen Pfads zum Aspekttyp eines Aspekts ab, der an den Eintrag angehängt ist, im Format projectid.location.ASPECT_TYPE_ID. |
aspect=xoder has=x |
Entspricht x als vollständigem Pfad zum Aspekttyp eines Aspekts, der an den Eintrag angehängt ist, im Format projectid.location.ASPECT_TYPE_ID. |
x |
Sucht nach Werten für das Feld „Seitenverhältnis“. Entspricht
Es können nur Felder der obersten Ebene des Aspekts durchsucht werden. |
Logische Operatoren
In einer Abfrage können mehrere Prädikate mit logischen Operatoren kombiniert werden.
Hinweis: Bei den logischen Operatoren AND, OR und NOT wird zwischen Groß- und Kleinschreibung unterschieden. Sie müssen großgeschrieben werden.
Operator AND
Wenn Sie mehrere Suchbegriffe oder ‑prädikate durch ein Leerzeichen trennen, wird implizit „UND“ verwendet. Sie müssen es also nicht explizit schreiben.
Die folgenden Beispiele zeigen, wie Sie Abfragen mit dem Operator AND erstellen.
Nach BigQuery-Tabellen suchen
system=bigquery type=tableSuche nach Ressourcen im Projekt
banking-prodmit einer Spalte namenscustomer_idprojectid:banking-prod column:customer_idBei Bedarf können Sie den expliziten
AND-Operator verwenden:system=bigquery AND type=table AND location=us-central1
Operator OR
Mit dem Operator OR können Sie eine oder mehrere Bedingungen abgleichen. Wenn Sie OR mit anderen Kriterien kombinieren, verwenden Sie Klammern ( ), um die Ausdrücke zu gruppieren und die Rangfolge zu definieren.
Die folgenden Beispiele zeigen, wie Sie Abfragen mit dem Operator OR erstellen.
Nach BigQuery-Tabellen und -Ansichten suchen
system=bigquery (type=table OR type=view)Tabellen in mehreren Systemen suchen
(system=bigquery OR system=spanner) type=tableNach Einträgen in Marketing- oder Finanzdatensätzen suchen
system=bigquery (parent:marketing_analytics OR parent:finance_analytics)
Operator NOT
Ein Prädikat kann negiert werden, indem ihm ein NOT (Bindestrich) oder ein - vorangestellt wird.
Die folgenden Beispiele zeigen, wie Sie Abfragen mit dem Operator NOT erstellen.
Alle Tabellen außer denen in einem Sandbox-Projekt suchen
NOT-Operator verwenden
type=table NOT projectid:sandbox-project- Bindestrich verwenden
type=table -projectid:sandbox-projectAlle BigQuery-Ressourcen suchen, deren Name nicht
testenthältsystem=bigquery -name:test
Abgekürzte Syntax
Wenn Sie die abgekürzte Syntax verwenden möchten, verwenden Sie | (senkrechter Strich) für OR-Operatoren und , (Komma) für AND-Operatoren in Klammern.
Diese abgekürzte Syntax funktioniert für die qualifizierten Prädikate.
Über mehrere Projekt-IDs hinweg suchen
- Verwenden Sie den Operator
OR:
projectid:(finance-prod|sales-prod|analytics-prod)- Klammern verwenden:
projectid:finance-prod OR projectid:sales-prod OR projectid:analytics-prod- Verwenden Sie den Operator
Nach Einträgen suchen, die mehreren Spaltennamen entsprechen (
AND)column:(customer_id,transaction_date,amount)Nach Einträgen suchen, die mit einem von mehreren Spaltennamen übereinstimmen (
OR)column:(customer_id|user_id|client_id)
Platzhalterrichtlinie
Die Suchsyntax von Knowledge Catalog unterstützt keine Platzhalter wie * oder ? in Abfragestrings oder ‑prädikaten.
Wenn Sie ein Sternchen (*) oder Fragezeichen (?) in eine Anfrage einfügen, wird es als Literalzeichen und nicht als Platzhalter für den Musterabgleich behandelt.
So suchen Sie beispielsweise nach Tabellen, deren Namen mit _masked enden:
- Unterstützt:
name:_masked– verwendet den Qualifikator für die Teilstringübereinstimmung:, um alle Ressourcen zu finden, deren Name_maskedenthält, z. B.customer_records_maskedodertransactions_masked. - Nicht unterstützt:
name:*_masked: Das*wird als Literalzeichen und nicht als Platzhalter für ein Muster behandelt.
Klammern
Klammern in Suchanfragen haben bestimmte technische Funktionen. Wenn Sie Klammern zu häufig verwenden oder sie auf Anfragen in natürlicher Sprache anwenden, kann das den Suchparser verwirren und die Qualität der Ergebnisse beeinträchtigen.
Einfache natürliche Sprache
Wenn Sie eine geschäftliche Frage stellen, übergeben Sie die Anfrage als Nur-Text. Setzen Sie es nicht in Klammern. Geben Sie beispielsweise Folgendes ein:
Find customer orders containing email addresses
Abgekürzte Prädikatsyntax
Klammern sind sehr effektiv, wenn sie mit Attributschlüsseln verwendet werden, um mehrere OR- und AND-Bedingungen in einem kompakten Format aufzulisten.
Gruppieren von Vorhersageschlüsseln mit
OR(|)Mit (
|) nach Einträgen in einem der aufgeführten Projekte suchenprojectid:(finance-prod|finance-test|analytics-raw)Mit (
OR) nach Einträgen in einem der aufgeführten Projekte suchen
projectid:finance-prod OR projectid:finance-test OR projectid:finance-rawGruppieren von Vorhersageschlüsseln mit
AND(,)- Mit (
,) nach Einträgen suchen, die alle angegebenen Spalten enthalten
column:(customer_id, order_date, total_amount)- Mit (
AND) nach Einträgen suchen, die alle angegebenen Spalten enthalten
column:customer_id AND column:order_date AND column:total_amount- Mit (
Hybridsuche
Sie können eine Abfrage in natürlicher Sprache mit kompakten Filtern kombinieren.
Wenn Sie beispielsweise Tabellen mit monatlich aktiven Nutzern finden, die Suche aber auf die angegebenen Projekte beschränken möchten, verwenden Sie die folgende Abfrage:
monthly active users type=table projectid:(data-warehouse|analytical-tier)
Best Practices für die Verwendung von Klammern
Setzen Sie nicht die gesamte Frage in Klammern, da die semantische Engine die Klammern möglicherweise als Literalzeichen behandelt, was zu Ergebnissen mit geringer Relevanz führt.
- Falsch:
(Show me datasets about US population by state) - Richtig:
Show me datasets about US population by state
- Falsch:
Vermeiden Sie es, komplexe, verschachtelte boolesche Bäume mit Klammern im Feld für natürliche Sprache zu mischen. Die Suche ist für die Intention in natürlicher Sprache optimiert. Wenn Sie die Abfrage mit Klammern und expliziten Logikblöcken überkomplizieren, wird der Parser verwirrt.
- Falsch:
(revenue data) AND system=BIGQUERY AND projectid:(data-warehouse | analytical-tier) - Richtig:
revenue data system=bigquery projectid:(data-warehouse|analytical-tier)
- Falsch:
Fügen Sie nicht willkürlich Leerzeichen ein, es sei denn, sie sind Teil des Werts.
- Falsch:
column:( email | id ) - Richtig:
column:(email|id).
- Falsch:
Nächste Schritte
- Weitere Informationen zum Suchen nach Ressourcen in Knowledge Catalog
- Weitere Informationen zur Metadatenverwaltung in Knowledge Catalog
- Einträge und Eintragslinks mithilfe von Aspekten mit Metadaten anreichern
- Einträge verwalten und benutzerdefinierte Quellen aufnehmen