בעזרת Knowledge Catalog תוכלו לגלות את הנתונים של הארגון, לקטלג אותם באופן מרכזי, לנהל אותם ולהבין אותם. כדי למצוא ביעילות נכסי נתונים ספציפיים ב-Data Catalog, אפשר להשתמש בשאילתות חיפוש מתקדמות. התחביר של שאילתות חיפוש כולל:
- חיפוש פשוט: חיפוש נכסי נתונים באמצעות מונח חיפוש יחיד.
- חיפוש טקסט חופשי: איתור נכסי נתונים באמצעות ביטויים או מילות מפתח בשפה טבעית.
- פסוקיות תנאי מתאימות: צמצום החיפוש באמצעות שדות מטא-נתונים ספציפיים כמו שם, מיקום, מערכת או סוג.
- חיפוש לפי מאפיינים: חיפוש רשומות על סמך המטא-נתונים העסקיים והטכניים שמצורפים אליהן.
- אופרטורים לוגיים: שילוב של כמה קריטריונים לחיפוש באמצעות האופרטורים
AND,ORאוNOTכדי ליצור שאילתות מורכבות. ההבנה של התחביר הזה מאפשרת לכם לאתר במהירות את הנתונים שאתם צריכים.
פסוקיות תנאי כשירות
משתמשים בפרדיקט מוסמך כדי לצמצם את תוצאות החיפוש על ידי הנחיה מפורשת של החיפוש להעריך שדה מטא-נתונים ספציפי, כמו שם נכס, סוג או מערכת.
אפשר להוסיף תנאי למאפיין על ידי הוספת מפתח לפניו שמגביל את ההתאמה לקטע ספציפי של מטא-נתונים:
- סימן שווה (
=) כדי להגביל את החיפוש להתאמה מדויקת. - נקודתיים (
:) אחרי המפתח כדי להתאים את התנאי למחרוזת משנה או לטוקן בתוך הערך בתוצאות החיפוש.
תהליך הטוקניזציה מפצל את זרם הטקסט לסדרה של טוקנים, כאשר כל טוקן בדרך כלל תואם למילה אחת.
לדוגמה:
-
name:fooבוחר משאבים עם שמות שמכילים את מחרוזת המשנהfoo, כמו foo1ו-barfoo. -
description:fooבוחר משאבים עם הטוקןfooבתיאור, כמוbarו-foo. -
location=fooתואם למקורות במיקום שצוין עםfooכשם המיקום.
המסננים הנתמכים
חיפוש ב-Knowledge Catalog תומך במגדירי החיפוש הבאים:
| מגדיר | תיאור |
|---|---|
name:x |
התאמה ל-x כמחרוזת משנה של מזהה המשאב או השם המוצג של המשאב. |
displayname:x |
המחרוזת x תואמת למחרוזת משנה של השם המוצג של המשאב. |
column:x |
המחרוזת x תואמת למחרוזת משנה של שם העמודה (או של שם העמודה המקוננת) בסכימה של המשאב. |
description:x |
התאמות x כטוקן בתיאור המשאב. לדוגמה:
|
labels:bar |
הפונקציה מחזירה התאמה למשאבים שיש להם תווית (עם ערך כלשהו) ומפתח התווית מכיל את המחרוזת bar. |
labels=bar |
הפונקציה מחזירה התאמה למשאבים שיש להם תווית (עם ערך כלשהו) ומפתח התווית שווה ל-bar כמחרוזת. |
labels.bar:x |
המחרוזת x תואמת למחרוזת משנה בערך של תווית עם המפתח bar שמצורפת למשאב. |
labels.foo=bar |
הפונקציה מחפשת משאבים שבהם המפתח שווה ל-foo והערך של המפתח שווה ל-bar. |
type=TYPE |
התאמה למשאבים מסוג רשומה ספציפי או לכינוי הסוג שלה. נדרש התנאי =. |
projectid:bar |
התאמה למשאבים בתוך פרויקטים של Google Cloud שמזהה הפרויקט שלהם מכיל את המחרוזת bar. |
parent:x |
תואם ל-x כמחרוזת משנה של הנתיב ההיררכי של משאב. |
system=SYSTEM |
התאמה של משאבים ממערכת שצוינה. נדרש התנאי =. |
location=LOCATION |
הפונקציה מחפשת משאבים במיקום שצוין עם שם מדויק. נדרש התנאי נכסי BigQuery Omni תומכים במאפיין הזה באמצעות שם המיקום של BigQuery Omni.
לדוגמה,
|
createtime |
חיפוש משאבים שנוצרו בטווח תאריכים מסוים, לפני תאריך מסוים או אחרי תאריך מסוים. אפשר לציין תאריך, חותמת זמן או זמן יחסי בימים. מידע על הפורמטים והאופרטורים הנתמכים זמין במאמר מסנני זמן. |
updatetime |
הפונקציה מחפשת משאבים שעודכנו בטווח של תאריך, חותמת זמן או זמן יחסי בימים שצוינו, או לפני או אחרי הטווח. מידע על הפורמטים והאופרטורים הנתמכים זמין במאמר מסנני זמן. |
הגדרת התאמה מדויקת
מילות המפתח של התנאי type, system, location ו-aspect
search (לא כולל has) תומכות רק במילת המפתח של ההתאמה המדויקת (=), ולא במילת המפתח של המחרוזת המשנית (:).
משתמשים בתחביר הבא של התאמה מדויקת עבור פרדיקטים אלה:
| מפתח פרדיקט | תחביר נכון | תחביר שגוי |
|---|---|---|
type |
type=table (או type=view, type=dataset) |
type:table או type:tab |
system |
system=bigquery (או system=spanner) |
system:bigquery או system:big |
location |
location=us-central1 (או location=europe-west1) |
location:us-central1 או location:us |
מזהים של מחרוזות משנה
פרדיקטים כמו name, displayname, column, projectid ו-parent,
תומכים בהתאמה של מחרוזת משנה עם המאפיין (:) של הנקודתיים:
-
name:transactionsתואם למשאבים שהמזהה או השם לתצוגה שלהם מכילים את המחרוזתtransactions. לדוגמה,daily_transactions_rawו-transactions_v2. -
column:customer_idתואם למשאבים עם שם עמודה שמכיל אתcustomer_id. -
projectid:prodתואם למשאבים בפרויקטים שהמזהה שלהם מכיל אתprod. לדוגמה,finance-prod-2026.
מסננים של זמן
אפשר לסנן משאבים לפי זמן היצירה (createtime) או זמן העדכון האחרון (updatetime).
אופרטורים ופורמטים נתמכים
- אופרטורים נתמכים:
:,=,<,>,<=,>=,=>,=< - ימים יחסיים (
-Nd): סינון לפי מספר ימים יחסי בעבר (לדוגמה,-30d, -7d, -1d). - תאריכים ביומן (
YYYY-MM-DDאוYYYY/MM/DD): סינון לפי תאריך ספציפי בשעון GMT/UTC. - חותמות זמן מלאות (
YYYY-MM-DDTHH:MM:SSאוYYYY-MM-DDTHH:MM:SSZ): סינון לפי חותמת זמן מדויקת ב-GMT או ב-UTC. יש תמיכה גם בחותמות זמן חלקיות, כמוYYYY-MM-DDTHH:MMאוYYYY-MM-DDTHH.
התחביר של מסנן זמן
בטבלה הבאה מוסבר התחביר של מסנן הזמן:
| קטגוריית הפורמט | תחביר תקין | תחביר לא תקין | תיאור |
|---|---|---|---|
| יחידות זמן יחסיות |
|
|
|
| תאריכים ביומן |
|
|
|
| חותמות זמן ואזורי זמן |
|
|
|
| טווחים של שעות ביום |
|
|
|
| תאריכים בשפה טבעית |
|
|
|
מסננים של תוויות
כדי לסנן משאבים לפי תוויות שמצורפות אליהם, משתמשים בפרדיקט labels. אפשר לסנן לפי מפתח תווית, ערך תווית או שניהם:
| מבנה השאילתה | דוגמה | תיאור |
|---|---|---|
labels=KEY |
labels=environment |
התנאי תואם למשאבים שיש להם תווית עם המפתח environment, בלי קשר לערך שלה. |
labels:KEY_SUBSTRING |
labels:tier |
התאמה של משאבים עם מפתח תווית שמכיל את המחרוזת tier (למשל service_tier או storage_tier). |
labels.KEY=VALUE |
labels.env=prod |
התנאי תואם למשאבים שבהם מפתח התווית הוא env והערך שלה הוא בדיוק prod. |
labels.KEY:VALUE_SUBSTRING |
labels.owner:analytics |
הפונקציה מחפשת משאבים עם מפתח התווית owner שבהם הערך מכיל את המחרוזת analytics (למשל analytics-team או data-analytics). |
| כמה תוויות (AND) | labels.env=prod labels.data_tier=tier1 |
התנאי תואם למשאבים ששתי התוויות env=prod ו-data_tier=tier1 מצורפות אליהם. |
| בשילוב עם המערכת והסוג | system=bigquery type=table labels.env=prod labels.confidentiality=high |
התאמה לטבלאות BigQuery עם התוויות env=prod ו-confidentiality=high. |
חיפוש לפי היבט
אפשר להשתמש בתחביר של שאילתות כדי לחפש רשומות לפי ההיבטים שצורפו אליהן.
התאמת מחרוזת המשנה מנסה להתאים למספר מוגבל של היבטים. אם לא הצלחתם למצוא את הרשומה באמצעות קטע מהנתיב, השתמשו בנתיב המלא כדי לצמצם את החיפוש ולהגדיל את ההיזכרות.
| מגדיר | תיאור |
|---|---|
aspect:xאו has:x |
המחרוזת x מופיעה כרצף משנה בנתיב המלא של סוג ההיבט של היבט שמצורף לרשומה, בפורמט
projectid.location.ASPECT_TYPE_ID |
aspect=xאו has=x |
התאמה ל-x כנתיב המלא לסוג ההיבט של היבט שמצורף לרשומה, בפורמט projectid.location.ASPECT_TYPE_ID |
x |
חיפוש ערכים של שדות מאפיינים. התאמה ל-
אפשר לחפש רק בשדות ברמה העליונה של ההיבט. |
אופרטורים לוגיים
אפשר לשלב כמה פרדיקטים בשאילתה באמצעות אופרטורים לוגיים.
הערה: האופרטורים הלוגיים AND, OR ו-NOT הם תלויי רישיות (case-sensitive) וחייבים להיות באותיות רישיות.
AND אופרטור
אם מפרידים בין כמה מונחי חיפוש או פרדיקטים באמצעות רווח, המערכת מניחה שרוצים להשתמש באופרטור הלוגי AND, כך שלא צריך לכתוב אותו במפורש.
בדוגמאות הבאות אפשר לראות איך יוצרים שאילתות באמצעות האופרטור AND.
חיפוש טבלאות BigQuery
system=bigquery type=tableחיפוש משאבים בפרויקט
banking-prodעם עמודה בשםcustomer_idprojectid:banking-prod column:customer_idאם צריך, אפשר להשתמש באופרטור
AND:system=bigquery AND type=table AND location=us-central1
OR אופרטור
משתמשים באופרטור OR כדי להתאים לכל אחד מכמה תנאים. כשמשלבים את OR עם קריטריונים אחרים, משתמשים בסוגריים ( ) כדי לקבץ את הביטויים ולהגדיר את סדר העדיפויות.
בדוגמאות הבאות אפשר לראות איך יוצרים שאילתות באמצעות האופרטור OR.
חיפוש טבלאות ותצוגות מפורטות ב-BigQuery
system=bigquery (type=table OR type=view)חיפוש טבלאות בכמה מערכות
(system=bigquery OR system=spanner) type=tableחיפוש רשומות במערכי נתונים שיווקיים או פיננסיים
system=bigquery (parent:marketing_analytics OR parent:finance_analytics)
NOT אופרטור
אפשר לשלול פרדיקט על ידי הוספת הקידומת NOT באותיות רישיות או - (מקף).
בדוגמאות הבאות אפשר לראות איך יוצרים שאילתות באמצעות האופרטור NOT.
חיפוש כל הטבלאות חוץ מאלה שבפרויקט ארגז חול
- שימוש באופרטור
NOT
type=table NOT projectid:sandbox-project- שימוש במקף
type=table -projectid:sandbox-project- שימוש באופרטור
חיפוש כל המשאבים ב-BigQuery שלא מכילים את המחרוזת
testבשם שלהםsystem=bigquery -name:test
תחביר מקוצר
אם רוצים להשתמש בתחביר המקוצר, משתמשים ב-| (קו אנכי) לאופרטורים OR וב-, (פסיק) לאופרטורים AND בתוך סוגריים.
התחביר המקוצר הזה פועל עבור פרדיקטים מוסמכים.
חיפוש לפי כמה מזהי פרויקטים
- משתמשים באופרטור
OR:
projectid:(finance-prod|sales-prod|analytics-prod)- שימוש בסוגריים:
projectid:finance-prod OR projectid:sales-prod OR projectid:analytics-prod- משתמשים באופרטור
חיפוש רשומות שתואמות לכמה שמות של עמודות (
AND)column:(customer_id,transaction_date,amount)חיפוש רשומות שתואמות לשם של אחת מכמה עמודות (
OR)column:(customer_id|user_id|client_id)
המדיניות בנושא תווים כלליים לחיפוש
תחביר החיפוש ב-Knowledge Catalog לא תומך בתווים כלליים לחיפוש, כמו * או ?, במחרוזות של שאילתות או בפרדיקטים.
אם כוללים כוכבית (*) או סימן שאלה (?) בשאילתה, המערכת מתייחסת אליהם כאל תווים מילוליים ולא כאל תווים כלליים לחיפוש תבניות.
לדוגמה, כדי לחפש טבלאות שהשמות שלהן מסתיימים ב-_masked:
- נתמך:
name:_masked: נעשה שימוש במאפיין המסווג:של התאמת מחרוזת משנה כדי למצוא את כל המשאבים שהשם שלהם מכיל את המחרוזת_masked, כמוcustomer_records_maskedאוtransactions_masked. - לא נתמך:
name:*_masked: התו*מטופל כתו מילולי ולא כתו כללי לחיפוש.
סוגריים
לסוגריים בשאילתות חיפוש יש פונקציות טכניות ספציפיות. אם משתמשים בסוגריים יותר מדי או מחילים אותם על שאילתות בשפה טבעית, יכול להיות שיהיה בלבול בניתוח החיפוש ואיכות התוצאות תרד.
שפה טבעית פשוטה
כששואלים שאלה על עסק, מעבירים את השאילתה בטקסט פשוט. אל תקיפו אותו בסוגריים. לדוגמה, כותבים:
Find customer orders containing email addresses
תחביר מקוצר של פסוקית תיאור
השימוש בסוגריים יעיל מאוד כשמשתמשים בהם עם מפתחות של פסוקיות כדי לפרט כמה תנאים של OR ו-AND בפורמט קומפקטי.
קיבוץ של מפתחות פרדיקט עם
OR(|)חיפוש רשומות שנמצאות באחד מהפרויקטים שמופיעים ברשימה באמצעות (
|)projectid:(finance-prod|finance-test|analytics-raw)חיפוש רשומות שנמצאות באחד מהפרויקטים שמופיעים ברשימה באמצעות (
OR)
projectid:finance-prod OR projectid:finance-test OR projectid:finance-rawקיבוץ של מפתחות פרדיקט עם
AND(,)- חיפוש רשומות שמכילות את כל העמודות שצוינו באמצעות (
,)
column:(customer_id, order_date, total_amount)- חיפוש רשומות שמכילות את כל העמודות שצוינו באמצעות (
AND)
column:customer_id AND column:order_date AND column:total_amount- חיפוש רשומות שמכילות את כל העמודות שצוינו באמצעות (
חיפוש היברידי
אפשר לשלב שאילתה בשפה טבעית עם מסננים קומפקטיים.
לדוגמה, כדי למצוא טבלאות שבהן מצוינים משתמשים פעילים בחודש, אבל להגביל את החיפוש לפרויקטים שצוינו, משתמשים בשאילתה הבאה:
monthly active users type=table projectid:(data-warehouse|analytical-tier)
שיטות מומלצות לשימוש בסוגריים
אל תקיפו את כל השאלה בסוגריים, כי המנוע הסמנטי עלול להתייחס לסוגריים כאל תווים מילוליים, וכתוצאה מכך התוצאות לא יהיו רלוונטיות.
- לא נכון:
(Show me datasets about US population by state) - נכון:
Show me datasets about US population by state
- לא נכון:
מומלץ להימנע משילוב של עצים בוליאניים מורכבים ומקוננים עם סוגריים בשדה השפה הטבעית. החיפוש מותאם לכוונה בשפה טבעית. הוספת סוגריים ובלוקים לוגיים מפורשים לשאילתה מסבכת אותה ומבלבלת את מנתח התוכן.
- לא נכון:
(revenue data) AND system=BIGQUERY AND projectid:(data-warehouse | analytical-tier) - נכון:
revenue data system=bigquery projectid:(data-warehouse|analytical-tier)
- לא נכון:
לא מוסיפים רווחים באופן שרירותי, אלא אם הם חלק מהערך.
- לא נכון:
column:( email | id ) - נכון:
column:(email|id).
- לא נכון:
המאמרים הבאים
- איך מחפשים משאבים ב-Knowledge Catalog
- מידע נוסף על ניהול מטא-נתונים ב-Knowledge Catalog
- איך משתמשים בהיבטים כדי להוסיף מטא-נתונים לרשומות ולקישורים לרשומות
- איך מנהלים רשומות ומייבאים מקורות בהתאמה אישית