קבלת פרטים על מאגר נתונים וישויות

בדף הזה מוסבר איך לאחזר פרטי משאבים של מאגרי נתונים של Gemini Enterprise והישויות הבסיסיות שלהם באמצעות Google Cloud המסוף או Discovery Engine API בארכיטקטורת REST.

כשמבצעים אינטראקציה עם מאגרי נתונים באמצעות ממשקי API – למשל, כשמגדירים אמצעי בקרה לגישת IAM ברמת המשאב, שולחים שאילתות לנקודות קצה של חיפוש או מבצעים אוטומציה של צינורות להטמעת נתונים – צריך את מזהי המשאבים הייחודיים של מאגרי הנתונים של היעד והישויות הבסיסיות שלהם.

מושגים שקשורים למאגרי נתונים

כדי להבין את המבנה של משאבי מאגר הנתונים ב-Discovery Engine API, כדאי להכיר את המושגים הבאים:

קונספט תיאור
מאגר נתונים מאגר לנתונים שמתקבלים מ-Google או ממקורות נתונים של צד שלישי. מאגרי נתונים עצמאיים שייכים לאוסף ברירת המחדל (default_collection). מידע נוסף זמין במאמרים מושגים ב-Gemini Enterprise ומידע על אפליקציות ומאגרי נתונים.
איסוף נתונים משאב של קיבוץ לוגי בתוך Google Cloud פרויקט ומיקוםprojects/{project}/locations/{location}/collections/{collection}.

מאגרי נתונים של צד שלישי עם כמה ישויות (כמו Jira,‏ Salesforce או SharePoint Online) יוצרים אוסף ייעודי שמייצג את מופע מאגר הנתונים.

ישות במאגר נתונים כשמקשרים מקור נתונים של צד שלישי שמכיל כמה סוגים של ישויות (למשל, בעיות ב-Jira, פרויקטים ב-Jira או קבצים ב-SharePoint), Gemini Enterprise יוצר באופן אוטומטי מאגר נתונים נפרד מסוג צאצא לכל סוג של ישות.

מאגרי הנתונים של הישויות האלה נמצאים כמשאבי צאצא מתחת ל-collections/default_collection/dataStores/{DATA_STORE_ENTITY_ID}.

מידע נוסף זמין במאמרים בנושא נתונים מובְנים במאגרי נתונים של צד שלישי ומבוא למחברים ולמאגרי נתונים.

אחזור פרטים של מאגר נתונים וישויות

בוחרים באחת מהאפשרויות הבאות:

המסוף

כדי לאחזר פרטים של מאגר נתונים וישויות במסוף Google Cloud :

  1. במסוף Google Cloud , נכנסים לדף Gemini Enterprise >‏ Data Stores.

    מעבר לדף Data Stores

  2. לוחצים על השם של מאגר נתוני היעד.

  3. בדף הפרטים של מאגר הנתונים, רואים את מזהה מאגר הנתונים שמוצג בכותרת.

  4. אם מאגר הנתונים מכיל ישויות, לוחצים על הכרטיסייה ישויות כדי לראות את רשימת הישויות שהוגדרו, את השמות המוצגים שלהן ואת המזהים התואמים של מאגר נתוני הישויות (לדוגמה, DataConnector3_entityA ו-DataConnector3_entityB).

REST

כדי לאחזר מזהים של מאגרי נתונים וישויות באמצעות API בארכיטקטורת REST, פועלים לפי השלבים הבאים:

  1. רשימת מזהי איסוף נתונים של מאגר נתונים (למאגרי נתונים של כמה ישויות):

    במאגרי נתונים של צד שלישי עם כמה ישויות (כמו Jira או Salesforce), ‏ Gemini Enterprise יוצר אוסף ייעודי שמייצג את מופע המחבר. קוראים לנקודת הקצה collections list כדי לאחזר מזהי אוספים בפרויקט:

    curl -X GET \
      -H "Authorization: Bearer $(gcloud auth print-access-token)" \
      "https://ENDPOINT_LOCATION-discoveryengine.googleapis.com/v1alpha/projects/PROJECT_ID/locations/LOCATION/collections"
    

    מחליפים את מה שכתוב בשדות הבאים:

    • ‫PROJECT_ID: מזהה הפרויקט ב-Google Cloud .
    • ‫ENDPOINT_LOCATION: האזור הרב-אזורי של בקשת ה-API. מציינים אחד מהערכים הבאים:
      • ‫us לאזור הגיאוגרפי בארה"ב שכולל מספר אזורים
      • ‫eu עבור מספר אזורים באיחוד האירופי
      • ‫global Global location
      מידע נוסף זמין במאמר בנושא ציון אזור מרובה עבור מאגר הנתונים.
    • ‫LOCATION: האזור המרובה של מאגר הנתונים: ‫global,‏ us או eu.

    התשובה תכיל את רשימת הקולקציות:

    {
      "collections": [
        {
          "name": "projects/123456789/locations/global/collections/DataConnector3",
          "displayName": "Jira Production Data Store"
        }
      ]
    }
    

    בדוגמה הזו, מזהה הקולקציה הוא DataConnector3. משתמשים במזהה הזה כשמגדירים אמצעי בקרה לגישה ברמת האוסף עבור מופע המחבר.

  2. רשימת המזהים של ישויות ומאגרי נתונים עצמאיים בקטע default_collection:

    ב-Gemini Enterprise, כל המשאבים של מאגרי הנתונים, כולל מאגרי נתונים עצמאיים וישויות צאצא של מחברים מרובי ישויות, נמצאים ב-default_collection. למרות שלמאגר נתונים מרובה ישויות יש מזהה אוסף ייעודי (למשל, DataConnector3), מאגרי הנתונים של ישויות הצאצא שלו רשומים תחת default_collection ומופיע לפניהם מזהה המחבר.

    מתקשרים אל dataStores נקודת הקצה של הרשימה ב-default_collection כדי לאתר את מזהי מאגר הנתונים והישויות:

    curl -X GET \
      -H "Authorization: Bearer $(gcloud auth print-access-token)" \
      "https://ENDPOINT_LOCATION-discoveryengine.googleapis.com/v1/projects/PROJECT_ID/locations/LOCATION/collections/default_collection/dataStores"
    

    מחליפים את מה שכתוב בשדות הבאים:

    • ‫PROJECT_ID: מזהה הפרויקט ב-Google Cloud .
    • ‫ENDPOINT_LOCATION: האזור הרב-אזורי של בקשת ה-API. מציינים אחד מהערכים הבאים:
      • ‫us לאזור הגיאוגרפי בארה"ב שכולל מספר אזורים
      • ‫eu עבור מספר אזורים באיחוד האירופי
      • ‫global Global location
      מידע נוסף זמין במאמר בנושא ציון אזור מרובה עבור מאגר הנתונים.
    • ‫LOCATION: האזור המרובה של מאגר הנתונים: ‫global,‏ us או eu.

    התשובה מכילה את רשימת מאגרי הנתונים:

    {
      "dataStores": [
        {
          "name": "projects/123456789/locations/global/collections/default_collection/dataStores/DataConnector3_entityA",
          "displayName": "Jira Issues Entity"
        },
        {
          "name": "projects/123456789/locations/global/collections/default_collection/dataStores/DataConnector3_entityB",
          "displayName": "Jira Projects Entity"
        }
      ]
    }
    

    בדוגמה הזו, מזהי מאגר נתוני הישויות הם DataConnector3_entityA ו-DataConnector3_entityB. משתמשים במזהים האלה כשמגדירים בקרת גישה לכל מאגרי הנתונים הבסיסיים של ישויות במאגר נתונים מרובה ישויות באמצעות API בארכיטקטורת REST.

המאמרים הבאים