התחברות ל-Cloud SQL

במאמר הזה מוסבר איך ליצור מאגר נתונים שמתחבר לנתונים ב-Cloud SQL. אתם יכולים לקשר את מאגר הנתונים הזה לאפליקציית Gemini Enterprise כדי לאפשר לסוכנים לנתח את הנתונים שלכם.

כדי להתחבר לנתוני Cloud SQL באמצעות מאגר נתונים של Gemini Enterprise, אפשר להשתמש באחד מהמצבים הבאים:

  • שאילתה לכמה מסדי נתונים (מומלץ) [גרסת טרום-השקה (Preview)]: מתחברים לנתוני Cloud SQL במקום בלי לשלם על תעבורת נתונים יוצאת (egress) לצורך העתקה והעברה של הנתונים. שאילתת פדרציה שולחת את השאילתה ישירות ל-Cloud SQL בכל המכונות, מסדי הנתונים והטבלאות שלזהות שלכם יש הרשאה לניהול זהויות והרשאות גישה (IAM) לגשת אליהם. זה יעיל יותר לשאילתות אנליטיות. כשמשתמשים במצב שאילתות מאוחדות, קטלוג הידע מופעל אוטומטית בכרטיסייה העוזר הדיגיטלי באפליקציית Gemini Enterprise. כך הסוכן מקבל כלים לחיפוש נתונים שהמשתמש יכול לגשת אליהם ולחיפוש הקשר.

  • העברת נתונים: העתקת נתונים מטבלה ספציפית ב-Cloud SQL למאגר הנתונים של Gemini Enterprise. כדי שהשינויים בטבלה ב-Cloud SQL יבואו לידי ביטוי, צריך לרענן את הנתונים באופן ידני. במצב הזה יש עלויות של תעבורת נתונים יוצאת (egress) על העברת נתונים למיקום חדש, והרשאות IAM קיימות לא משוכפלות למאגר הנתונים.

לפני שמתחילים

כדי ליצור מאגר נתונים של Cloud SQL ב-Gemini Enterprise, צריך להיות לכם תפקיד אדמין של Gemini Enterprise (roles/discoveryengine.agentspaceAdmin) או אדמין של Discovery Engine (roles/discoveryengine.admin). מידע נוסף מופיע במאמר בנושא הענקת הרשאות לאדמינים.

אם הפרויקט שלכם מוגן על ידי היקף של VPC Service Controls או שהופעלה בו אכיפה של מדיניות הארגון, צריך לוודא שמדיניות הארגון מאפשרת את השימוש במחבר:

בנוסף, צריך להשלים את הדרישות המוקדמות ולהגדיר את הרשאות ה-IAM הנדרשות ב-Cloud SQL עבור מצב המחבר שמתכננים להשתמש בו:

שאילתה מאוחדת

כדי להתחבר ל-Cloud SQL באמצעות מצב שאילתות מאוחדות, צריך לבצע את הפעולות המקדימות הבאות ב Google Cloud פרויקט שמכיל את מכונת Cloud SQL:

  1. מפעילים את Data API במופע Cloud SQL:

    gcloud sql instances patch <var>INSTANCE_NAME</var> \
        --project=<var>PROJECT_ID</var> \
        --data-api-access=ALLOW_DATA_API
    
  2. הקצאת הרשאות IAM: מקצים את תפקידי ה-IAM הבאים ב Google Cloud פרויקט שמכיל את מופע Cloud SQL למשתמשים שמבצעים שאילתות או פעולות דרך המחבר:

הטמעת נתונים

כדי להטמיע נתונים מ-Cloud SQL, צריך להגדיר את הרשאות ה-IAM הבאות:

  • גישה לקטגוריית אחסון זמני: כשמבצעים הטמעת נתונים מ-Cloud SQL, הנתונים מאוחסנים קודם בקטגוריה של Cloud Storage. מקצים את התפקיד אדמין אחסון (roles/storage.admin) בחשבון השירות של מופע Cloud SQL (לדוגמה, p9876-abcd33f@gcp-sa-cloud-sql.iam.gserviceaccount.com) בדלי Cloud Storage הביניים.
  • גישה ל-Cloud SQL בין פרויקטים: אם אתם מייבאים נתונים מפרויקט מקור Google Cloud ששונה מפרויקט Google Cloud שמכיל את מאגר הנתונים של Gemini Enterprise שאתם יוצרים, צריך להקצות את התפקיד Cloud SQL Viewer (roles/cloudsql.viewer) בפרויקט המקור של Cloud SQL לחשבון השירות service-PROJECT_NUMBER@gcp-sa-discoveryengine.iam.gserviceaccount.com (כאשר PROJECT_NUMBER הוא מספר הפרויקט של פרויקטGoogle Cloud שמכיל את מאגר הנתונים של Gemini Enterprise).

יצירת מאגר נתונים ב-Cloud SQL

כדי ליצור מאגר נתונים שמקשר נתונים מ-Cloud SQL ל-Gemini Enterprise, פועלים לפי השלבים הבאים:

  1. נכנסים לדף Gemini Enterprise במסוף Google Cloud .

    ‫Gemini Enterprise

  2. עוברים לדף מאגרי נתונים.

  3. לוחצים על יצירת מאגר נתונים.

  4. בדף מקור, בוחרים מקור נתונים למאגר הנתונים. מחפשים את Cloud SQL בשדה החיפוש בחירת מקור נתונים או ברשימת מקורות הנתונים של צד ראשון. לוחצים על הוספה של מקור נתונים.

  5. בדף נתונים, בוחרים את מצב המחבר כדי לקבוע איך להתחבר לנתונים. בוחרים אחת מהכרטיסיות הבאות כדי לקבל הוראות נוספות בהתאם למצב שבחרתם.

    שאילתה מאוחדת

    1. בוחרים באפשרות שאילתה לכמה מסדי נתונים (מומלץ). לוחצים על Continue.
    2. בדף פעולות, בוחרים את הפעולות ב-Cloud SQL שרוצים להפעיל במאגר הנתונים. אפשר לערוך את ההגדרות האלה בהמשך. לוחצים על המשך.

    הטמעת נתונים

    1. לוחצים על העברת נתונים.
    2. מציינים פרטים על הנתונים שרוצים לייבא. בקטע ייבוא נתונים מטבלת Cloud SQL, מציינים את הפרטים הבאים:
      • Project ID: Google Cloud מזהה הפרויקט שמכיל את טבלת Cloud SQL. זהו שדה חובה.
      • Instance ID: מזהה המכונה ב-Cloud SQL שמכילה את הנתונים שרוצים לייבא. זהו שדה חובה.
      • מזהה מסד הנתונים: מזהה מסד הנתונים ב-Cloud SQL שמכיל את הנתונים שרוצים לייבא. זהו שדה חובה.
      • ‫Table ID: מזהה הטבלה ב-Cloud SQL שמכילה את הנתונים שרוצים לייבא. זהו שדה חובה.
      • מזינים את המיקום של הקטגוריה של Google Cloud Storage שבה נמצאים הנתונים. חובה למלא את השדה הזה. אפשר לסמן את האפשרות הפעלת ייצוא ללא שרת כדי להשתמש בייצוא ללא שרת ב-Cloud SQL. הפעלת ייצוא ללא שרת כרוכה בעלות נוספת. ראו תמחור של ייצוא ללא שרת ב-Cloud SQL.
    3. לוחצים על Continue.
  6. בדף Configuration, מגדירים את ההגדרות של מאגר הנתונים.

    • המיקום של מחבר הנתונים: בוחרים אזור לאחסון המטא-נתונים של מאגר הנתונים. אי אפשר לשנות את המיקום אחרי שיוצרים את מאגר הנתונים. מידע חשוב על מספר אזורים זמין במאמר מיקומים של Gemini Enterprise.
    • השם של מחבר הנתונים: בשדה השם של מחבר הנתונים, מזינים שם למחבר הנתונים. אי אפשר לשנות את השם אחרי שיוצרים את מחבר הנתונים. הזנת שם יוצרת מזהה ייחודי למחבר הנתונים. אפשר גם להזין תג למחבר הנתונים בשדה Tag (optional) (תג (אופציונלי)). התג הזה משמש כמזהה יציב למחבר בכל הגרסאות.
    • מדיניות בנושא הגנה על מידע אישי רגיש: בוחרים מדיניות בנושא הגנה על מידע אישי רגיש למאגר הנתונים. הפורמט צריך להיות: projects/{project}/locations/{location}/contentPolicies/{policy}. אפשר לערוך את ההגדרה הזו בהמשך.
  7. לוחצים על יצירה.

עכשיו אפשר לצרף את מאגר הנתונים לאפליקציית Gemini Enterprise. במצב שאילתה לכמה מסדי נתונים, הפעלת שאילתות דרך האפליקציה המצורפת כרוכה בעלויות שימוש ב-Cloud SQL. במצב הטמעת נתונים, ייבוא נתונים כרוך בעלויות אינדוקס של Cloud SQL,‏ Cloud Storage ו-Gemini Enterprise, גם לפני צירוף מאגר הנתונים לאפליקציה. מידע נוסף על החיובים האלה זמין במאמר בנושא תמחור Gemini Enterprise.

השלבים הבאים