Sintassi di ricerca per Knowledge Catalog

Questo documento descrive la sintassi per la ricerca in Knowledge Catalog.

Knowledge Catalog consente di scoprire, catalogare centralmente, gestire e comprendere i dati della tua organizzazione. Per trovare in modo efficiente asset di dati specifici all'interno del catalogo dati, puoi utilizzare query di ricerca avanzate. La sintassi delle query di ricerca include:

  • Ricerca semplice: come trovare asset di dati utilizzando un singolo termine di ricerca.
  • Predicati qualificati: come perfezionare la ricerca utilizzando campi di metadati specifici come nome, località o descrizione.
  • Ricerca di aspetti: come cercare voci in base ai metadati aziendali e tecnici allegati.
  • Operatori logici: come combinare più criteri di ricerca utilizzando AND e OR per creare query complesse. Comprendendo questa sintassi, puoi individuare rapidamente i dati di cui hai bisogno.

Prima di iniziare

Comprendi i gruppi di voci, le voci, i collegamenti di voci, gli aspetti, i tipi di voci, i tipi di collegamento di voci e i tipi di aspetto di Knowledge Catalog. Consulta Informazioni sulla gestione dei metadati in Knowledge Catalog.

Knowledge Catalog offre una ricerca che sfrutta l'AI per comprendere le query in linguaggio naturale e il significato semantico. Ti consente di trovare le risorse utilizzando il linguaggio di tutti i giorni, eliminando la necessità di una sintassi complessa, supportando al contempo la corrispondenza delle parole chiave e i filtri.

Puoi trovare gli asset inserendo un termine o una frase senza una sintassi specifica. Knowledge Catalog esegue una ricerca ampia mettendo a confronto la query con diversi campi di metadati, tra cui i seguenti:

  • Nome, nome visualizzato o descrizione di una risorsa
  • Tipo di risorsa
  • ID progetto
  • Descrizione della panoramica
  • Nome della colonna (o nome della colonna nidificata) nello schema di una risorsa
  • Descrizione colonna
  • Nome completo
  • Contatti
  • Aspetti

Utilizzare la sintassi delle query

Per ricerche più precise, puoi creare una query utilizzando una sintassi specifica, inclusi qualificatori, operatori logici e ricerche di aspetti.

Predicati qualificati

Puoi qualificare un predicato anteponendogli una chiave che limita la corrispondenza a una parte specifica dei metadati:

  • Un segno di uguale (=) limita la ricerca a una corrispondenza esatta.
  • Un due punti (:) dopo la chiave fa corrispondere il predicato a una sottostringa o a un token all'interno del valore nei risultati di ricerca.

La tokenizzazione suddivide il flusso di testo in una serie di token, ognuno dei quali corrisponde in genere a una singola parola.

Ad esempio:

  • name:foo seleziona le risorse con nomi che contengono la sottostringa foo, ad esempio foo1 e barfoo.
  • description:foo seleziona le risorse con il token foo nella descrizione, ad esempio bar e foo.
  • location=foo trova le risorse in una località specificata con foo come nome della località.

Il comportamento di questi qualificatori può variare leggermente tra le modalità di ricerca, come descritto nelle sezioni seguenti.

Le chiavi dei predicati type, system, location e description, e la ricerca di aspetti (escluso has) supportano solo il qualificatore di corrispondenza esatta (=), non il qualificatore di sottostringa (:). Ad esempio, type=foo.

La ricerca in Knowledge Catalog supporta i seguenti qualificatori:

Qualificatore Descrizione
name:x Trova x come sottostringa dell'ID risorsa o del nome visualizzato della risorsa.
displayname:x Trova x come sottostringa del nome visualizzato della risorsa.
column:x Trova x come sottostringa del nome della colonna (o del nome della colonna nidificata) nello schema della risorsa.
description:x Trova x come token nella descrizione della risorsa.
labels:bar Trova le risorse BigQuery che hanno un'etichetta (con un valore) e la chiave di etichetta ha bar come sottostringa.
labels=bar Trova le risorse BigQuery che hanno un'etichetta (con un valore) e la chiave di etichetta è uguale a bar come stringa.
labels.bar:x Trova x come sottostringa nel valore di un'etichetta con chiave bar collegata a una risorsa BigQuery.
labels.foo=bar Trova le risorse BigQuery in cui la chiave è uguale a foo e il valore della chiave è uguale a bar.
type=TYPE Trova le risorse di un tipo di voce specifico o del relativo alias di tipo.
projectid:bar Trova le risorse all'interno di Google Cloud progetti che corrispondono a bar come sottostringa nell'ID.
parent:x Trova x come sottostringa del percorso gerarchico di una risorsa.
system=SYSTEM Trova le risorse di un sistema specificato.
location=LOCATION

Trova le risorse in una località specificata con un nome esatto. Ad esempio, location=us-central1 trova gli asset ospitati in Iowa.

Gli asset BigQuery Omni supportano questo qualificatore utilizzando il nome della località BigQuery Omni. Ad esempio, location=aws-us-east-1 trova gli asset BigQuery Omni nella Virginia del Nord.

createtime

Trova le risorse create entro, prima o dopo una data o un'ora specificata.

Ad esempio:

  • createtime:2019-01-01 trova tutte le risorse create il 01/01/2019.
  • createtime<2019-02 trova tutte le risorse create prima del 01/02/2019 alle 00:00:00.
  • createtime>2019-02 trova tutte le risorse create dopo il 01/02/2019 alle 00:00:00.
  • createtime>-30d trova tutte le risorse create negli ultimi 30 giorni.
  • createtime<=-30d trova tutte le risorse create 30 giorni fa o prima.
  • createtime<=-1d trova tutte le risorse create il giorno precedente.

Formato del timestamp: YYYY-MM-DDThh:mm:ss

Tutti i timestamp devono essere in GMT; i fusi orari non sono supportati. Sono supportati i timestamp parziali , i separatori di date con trattino (-) e i separatori di date con barra (/).

Ad esempio:

  • 2010-10-22T05:36:24
  • 2010-10-22T05:36
  • 2010-10-22T05
  • 2010-10-22
  • 2010-10
  • 2010
  • 2010/10/22
updatetime

Trova le risorse aggiornate entro, prima o dopo una data o un'ora specificata.

Ad esempio:

  • updatetime:2019-01-01 trova tutte le risorse aggiornate il 01/01/2019.
  • updatetime<2019-02 trova tutte le risorse aggiornate prima del 01/02/2019 alle 00:00:00.
  • updatetime>2019-02 trova tutte le risorse aggiornate dopo il 01/02/2019 alle 00:00:00.
  • updatetime>-30d trova tutte le risorse aggiornate negli ultimi 30 giorni.
  • updatetime<-30d trova tutte le risorse aggiornate 30 giorni fa o prima.
  • updatetime=-1d trova tutte le risorse aggiornate il giorno precedente.
  • updatetime>=-30d trova tutte le risorse aggiornate negli ultimi 30 giorni.
  • updatetime<=-30d trova tutte le risorse aggiornate 30 giorni fa o prima.

Formato del timestamp: YYYY-MM-DDThh:mm:ss

Tutti i timestamp devono essere in GMT; i fusi orari non sono supportati. Sono supportati i timestamp parziali , i separatori di date con trattino (-) e i separatori di date con barra (/).

Ad esempio:

  • 2010-10-22T05:36:24
  • 2010-10-22T05:36
  • 2010-10-22T05
  • 2010-10-22
  • 2010-10
  • 2010
  • 2010/10/22

Puoi utilizzare la sintassi delle query per cercare le voci in base agli aspetti allegati.

La corrispondenza di sottostringa tenta di trovare una corrispondenza con un numero limitato di aspetti. Se non riesci a trovare la voce utilizzando un frammento del percorso, utilizza il percorso completo per restringere la ricerca e aumentare il richiamo.

Qualificatore Descrizione
aspect:x
or
has:x
Trova x come sottostringa del percorso completo al tipo di aspetto di un aspetto collegato alla voce, nel formato projectid.location.ASPECT_TYPE_ID
aspect=x
or
has=x
Trova x come percorso completo al tipo di aspetto di un aspetto collegato alla voce, nel formato projectid.location.ASPECT_TYPE_ID
x
OPERATOR
value

Cerca i valori dei campi degli aspetti. Trova x come sottostringa del percorso completo al tipo di aspetto e al nome del campo di un aspetto collegato alla voce, nei seguenti formati:

  • Sintassi per i tipi di aspetti di sistema:

    • ASPECT_TYPE_ID.FIELD_NAME
    • dataplex-types.ASPECT_TYPE_ID.FIELD_NAME
    • dataplex-types.LOCATION.ASPECT_TYPE_ID.FIELD_NAME

    Ad esempio, le seguenti query trovano le voci in cui il valore del campo type nell'aspetto bigquery-dataset è default:

    • bigquery-dataset.type=default
    • dataplex-types.bigquery-dataset.type=default
    • dataplex-types.global.bigquery-dataset.type=default
  • Sintassi per i tipi di aspetti personalizzati:

    • Se l'aspetto viene creato nella regione globale: PROJECT_ID.ASPECT_TYPE_ID.FIELD_NAME
    • Se l'aspetto viene creato in una regione specifica: PROJECT_ID.REGION.ASPECT_TYPE_ID.FIELD_NAME

    Ad esempio, le seguenti query trovano le voci in cui il valore del campo is-enrolled nell'employee-info aspetto è true.

    • example-project.us-central1.employee-info.is-enrolled=true
    • example-project.employee-info.is-enrolled=true

    L'elenco degli operatori supportati dipende dal tipo di campo nell' aspetto, come segue:

    • Stringa: = (corrispondenza esatta)
    • Tutti i tipi di numeri: =, :, <, >, <=, >=, =>, =<
    • Enum: =
    • Data e ora: come per i numeri, ma i valori da confrontare vengono trattati come date e ore anziché come numeri
    • Valore booleano: =

È possibile eseguire ricerche solo nei campi di primo livello dell'aspetto.

Operatori logici

Una query può essere composta da più predicati con operatori logici.

  • Se non specifichi un operatore, viene utilizzato l'operatore logico AND. Ad esempio, foo bar restituisce le risorse che corrispondono sia al predicato foo sia al predicato bar.
  • Sono supportati gli operatori logici AND e OR. Ad esempio, foo OR bar.
  • Puoi negare un predicato con un prefisso - (trattino) o NOT. Ad esempio, -name:foo restituisce le risorse con nomi che non corrispondono al predicato foo.

Sintassi abbreviata

È disponibile anche una sintassi di ricerca abbreviata, che utilizza | (barra verticale) per gli operatori OR e , (virgola) per gli operatori AND.

Ad esempio, per cercare le voci all'interno di uno dei tanti progetti utilizzando l'operatore OR, puoi utilizzare la seguente sintassi abbreviata:

projectid:(id1|id2|id3|id4)

La stessa ricerca senza utilizzare la sintassi abbreviata è simile alla seguente:

projectid:id1 OR projectid:id2 OR projectid:id3 OR projectid:id4

Per cercare le voci con nomi di colonne corrispondenti, utilizza quanto segue:

  • AND: column:(name1,name2,name3)
  • OR: column:(name1|name2|name3)

Questa sintassi abbreviata funziona per i predicati qualificati, ad eccezione di label nella ricerca per parole chiave.

Knowledge Catalog fornisce la modalità di ricerca solo per parole chiave per la compatibilità con le versioni precedenti, mentre la modalità di ricerca standard supporta sia la corrispondenza semantica sia la corrispondenza delle parole chiave. Ti consigliamo di utilizzare la modalità di ricerca standard, a meno che non sia necessaria la ricerca solo per parole chiave per la compatibilità con le versioni precedenti.

La tabella seguente riassume le principali differenze nei qualificatori da considerare quando si utilizza la ricerca solo per parole chiave.

Qualificatore Differenze principali
name:x Trova x come sottostringa solo dell'ID risorsa.
Qualificatori label

Utilizza il prefisso label anziché labels. I formati di sintassi supportati includono:

  • label:bar
  • label=bar
  • label:bar:x
  • label=foo:bar
  • label.foo=bar
  • label.foo
orgid=number Trova le risorse all'interno di un' Google Cloud organizzazione con il valore ID esatto di number, supportato solo nella ricerca solo per parole chiave.
fully_qualified_name Supporta fully_qualified_name:x (corrispondenza di sottostringa) e fully_qualified_name=x (corrispondenza esatta) (supportato solo nella ricerca solo per parole chiave).
createtime e updatetime Supporta solo la data esatta (:) e gli operatori di confronto di base (<, >). Non supporta i filtri di tempo relativo (ad esempio -30d o -1d) o gli operatori di confronto come <=, >=, =, =>, =<.
Restrizione di corrispondenza esatta Le chiavi dei predicati type, system, location, e orgid supportano solo la corrispondenza esatta (=), non la corrispondenza di sottostringa (:).

Ricerca di aspetti per la ricerca solo per parole chiave

La tabella seguente riassume le principali differenze nella ricerca di aspetti da considerare quando si utilizza la ricerca solo per parole chiave.

Elemento di ricerca di aspetti Differenze principali
Prefisso del qualificatore Supporta aspect: e aspect=. Non supporta has: o has=.
Sintassi di ricerca del valore del campo dell'aspetto Richiede il aspect: prefisso quando si cercano i valori dei campi degli aspetti (formato: aspect:x OPERATOR value, ad esempio aspect:employee-info.is-enrolled=true o aspect:employee=true).
Operatori di campi stringa I campi stringa supportano sia la corrispondenza esatta (=) sia la corrispondenza di sottostringa match (:).
Abbreviazioni dei tipi di aspetti di sistema Non supporta le abbreviazioni dei tipi di aspetti di sistema, ad esempio ASPECT_TYPE_ID.FIELD_NAME o dataplex-types...).

Passaggi successivi