בדף הזה נסביר על RagManagedDb, על הטכנולוגיה שעומדת בבסיסו ועל אופן השימוש ב-RagManagedDb ב-RAG Engine ב-Gemini Enterprise Agent Platform. בנוסף, בדף הזה מתוארות הרמות השונות שזמינות לשיפור הביצועים, שיכולות להשפיע על העלויות, ומפורטות הוראות למחיקת הנתונים של מנוע RAG, שמפסיקה את החיוב.
סקירה כללית
מנוע RAG ב-Gemini Enterprise Agent Platform משתמש ב-RagManagedDb, שהוא מופע Google Spanner מנוהל במלואו ומוכן לשימוש בארגונים. המופע הזה משמש לאחסון משאבים על ידי מנוע RAG, ואפשר להשתמש בו גם כמסד נתונים וקטורי לבחירתכם עבור מאגרי המידע של RAG.
באמצעות Spanner, RAG Engine מציע מסד נתונים עקבי, זמין מאוד וניתן להרחבה כדי לתמוך באפליקציה שלכם. מידע נוסף על Google Spanner זמין במאמר בנושא Spanner.
מנוע RAG מאחסן את קובץ ה-RAG ואת המטא-נתונים של משאב קובץ ה-RAG ב-RagManagedDb, בלי קשר לבחירה שלכם במסד נתונים וקטורי. מסדי נתונים וקטוריים משמשים רק לאחסון ולאחזור של הטמעות. בנוסף לאחסון משאבים, אפשר להשתמש ב-RagManagedDb גם כדי לאחסן ולנהל ייצוגים וקטוריים של המסמכים. לאחר מכן נעשה שימוש במסד הנתונים הווקטורי כדי לאחזר מסמכים רלוונטיים על סמך הדמיון הסמנטי של המסמך לשאילתה נתונה.
ניהול רמות
RAG Engine בפלטפורמת Gemini Enterprise Agent מאפשר לכם לשנות את גודל המופע של RagManagedDb בהתאם לשימוש ולדרישות הביצועים שלכם, באמצעות בחירה בין שתי רמות. בנוסף, הוא מאפשר לכם למחוק את הנתונים של RAG Engine באמצעות רמה שלישית.
הרמה היא הגדרה ברמת הפרויקט שזמינה במשאב RagEngineConfig שמשפיע על מאגרי המידע של RAG באמצעות RagManagedDb. המינויים הבאים זמינים ב-RagEngineConfig:
רמת Scale: רמה זו מציעה ביצועים בקנה מידה של ייצור, יחד עם פונקציונליות של התאמה אוטומטית לעומס. האפשרות הזו מתאימה ללקוחות עם כמויות גדולות של נתונים או עם עומסי עבודה שרגישים לביצועים. ברמה הפנימית, השכבה הזו מגדירה את מופע Spanner להגדרה של שינוי גודל אוטומטי עם מינימום של צומת אחד (1,000 יחידות עיבוד) ומקסימום של 10 צמתים (10,000 יחידות עיבוד).
מסלול בסיסי (ברירת מחדל): מסלול חסכוני עם דרישות מחשוב נמוכות, שעשוי להתאים לחלק מהמקרים הבאים:
- עריכת ניסוי עם
RagManagedDb. - גודל הנתונים קטן.
- עומס עבודה שלא רגיש לזמן האחזור.
- שימוש ב-RAG Engine רק עם מסדי נתונים וקטוריים אחרים.
כדי להציע את מסלול Basic,
RagManagedDbמגדיר את מופע Spanner הבסיסי להגדרה קבועה של 100 יחידות עיבוד, ששווה ל-0.1 צמתים.- עריכת ניסוי עם
מסלול שלא הוקצה: במסלול הזה, המערכת מוחקת את
RagManagedDbואת מופע Spanner הבסיסי שלו. במסגרת רמת השירות Unprovisioned, שירות RAG Engine מושבת והנתונים ששמורים בו נמחקים, ללא קשר למסד הנתונים הווקטורי שמשמש אתRagCorpora. החיוב על השירות יופסק. מידע נוסף על חיוב זמין במאמר [חיוב של RAG Engine בפלטפורמת הסוכנים של Gemini Enterprise]rag-engine-billing).אחרי שהנתונים נמחקים, אי אפשר לשחזר אותם. כדי להתחיל להשתמש שוב ב-RAG Engine, צריך לעדכן את רמת השימוש באמצעות קריאה ל-
UpdateRagEngineConfigAPI.
קבלת הגדרות הפרויקט
בדוגמאות הקוד הבאות אפשר לראות איך משתמשים ב-API GetRagEngineConfig לכל סוג של רמת שירות:
דוגמאות לקוד של גרסה 1 (v1) של API.
דוגמאות קוד של API בגרסה v1beta1.
עדכון ההגדרה של הפרויקט
בדוגמאות הקוד הבאות אפשר לראות איך להשתמש ב-API UpdateRagEngineConfig לכל סוג של רמת שירות:
גרסה 1 (v1) דוגמאות לקוד API.
דוגמאות קוד של API v1beta1.
המאמרים הבאים
מידע על השימוש ב-RAG API v1, הגרסה שמוגדרת כברירת מחדל, זמין במאמר RAG API v1.
מידע על השימוש ב-RAG API v1beta1 זמין במאמר RAG API v1beta1.
מידע נוסף על
RagManagedDbועל ניהול ההגדרה של רמת השירות וגם על אסטרטגיית השליפה ברמת מאגר הנתונים של RAG זמין במאמר שימוש ב-RagManagedDb עם RAG Engine בפלטפורמת הסוכנים של Gemini Enterprise.