מצב ללא שרת

הדרך המומלצת להתחיל להשתמש ב-RAG Engine היא במצב ללא שרת. במצב הזה, תקבלו מסד נתונים בניהול מלא עם יכולת התאמה רחבה, שיגבה את המשאבים של RAG Engine, בלי שתצטרכו להקצות או לנהל הגדרות תשתית. המצב הזה מאפשר התחלה מהירה ומתאים לרוב המשתמשים, כולל משתמשים בארגונים גדולים.

מצב Serverless הוא תכונת תצוגה מקדימה שזמינה רק ב-us-central1. היא זמינה לכולם ולא נדרש רשימת היתרים.

במצב Serverless, תרחיש השימוש המרכזי של מנוע ה-RAG נשאר זהה לזה שבמצב Spanner, למעט ההבדלים העיקריים הבאים:

  1. RagManagedDb לא זמין כאפשרות למסד נתונים וקטורי כשמשתמשים במצב Serverless. במקום זאת, מסד הנתונים הווקטורי החדש שמוגדר כברירת מחדל הוא RagManagedVertexVectorSearch, שהוא מסד נתונים וקטורי ניתן לניהול וניתן להרחבה. מידע נוסף על מסד הנתונים הווקטורי הזה זמין במאמר שימוש בחיפוש וקטורי 2.0 עם RAG.
  2. אין תמיכה במפתחות הצפנה בניהול הלקוח (CMEK) במצב Serverless.

מעבר למצב Serverless

כדי לעבור למצב Serverless כשיטת הפריסה המועדפת, אפשר לעיין בדף החלפת מצבים.

מחיקת הנתונים

כדי למחוק את הנתונים ממצב הפריסה Serverless, פועלים לפי השלבים הבאים:

  1. מוודאים שהמצב הפעיל מוגדר כ'ללא שרת'.
  2. קוראים ל-API‏ ListRagCorpora כדי לראות את המשאבים במצב הזה,
  3. מוחקים כל מאגר מידע באמצעות DeleteRagCorpus API.

תמחור

אין חיוב נוסף על שימוש במצב פריסה ללא שרת. עם זאת, אם יש לכם מצב Spanner פעיל, יכול להיות שתחויבו עליו. בנוסף, יכול להיות שתחויבו על המודלים שתבחרו, על הדירוג מחדש ועל אחסון הווקטורים ב-RAG Engine. למידע נוסף, אפשר לעיין בדף חיוב על RAG Engine בפלטפורמת הסוכנים של Gemini Enterprise.