במצב הפריסה של Spanner, מנוע ה-RAG משתמש ב-RagManagedDb, שהוא מופע Spanner מנוהל במלואו ומוכן לשימוש ארגוני. מנוע ה-RAG משתמש בו לאחסון משאבים ב-Gemini Enterprise Agent Platform. אפשר גם להשתמש בו כמאגר וקטורים לבחירתכם עבור קורפוס ה-RAG. Google Cloud
באמצעות Spanner, RAG Engine מציע מסד נתונים ייעודי, עקבי, זמין מאוד וניתן להתאמה רחבה, כדי לתמוך באפליקציה שלכם. מידע נוסף על Google Cloud Spanner זמין במאמר Spanner.
אחסון נתונים וחיפוש וקטורי
מנוע RAG מאחסן את קורפוס RAG ואת המטא-נתונים של משאבי קובץ RAG ב-RagManagedDb, בלי קשר לבחירה שלכם במסד נתונים וקטורי. מסדי נתונים וקטוריים משמשים רק לאחסון ולאחזור של הטמעות. בנוסף לאחסון משאבים, אפשר להשתמש ב-RagManagedDb גם לאחסון ולניהול של ייצוגים וקטוריים של המסמכים שלכם. לאחר מכן, מסד הנתונים הווקטורי משמש לאחזור מסמכים רלוונטיים על סמך הדמיון הסמנטי של המסמך לשאילתה נתונה.
החבילות הזמינות
RAG Engine מאפשר לכם לשנות את גודל המופע של RagManagedDb בהתאם לדרישות השימוש והביצועים שלכם, באמצעות בחירה מבין שתי רמות. אפשר גם להשתמש בו כדי למחוק את הנתונים שלכם ב-RAG Engine באמצעות רמה שלישית.
רמת השירות היא הגדרה ברמת הפרויקט שזמינה במשאב RagEngineConfig ומשפיעה על מאגרי המידע של RAG באמצעות RagManagedDb. אלה הרמות שזמינות ב-RagEngineConfig:
רמת Scale: רמה זו מציעה ביצועים בקנה מידה של ייצור, יחד עם פונקציונליות של התאמה אוטומטית לעומס. הוא מתאים ללקוחות עם כמויות גדולות של נתונים או עם עומסי עבודה שרגישים לביצועים. ברמה הפנימית, הרמה הזו מגדירה את מופע Spanner להגדרה של שינוי גודל אוטומטי עם מינימום של צומת אחד (1,000 יחידות עיבוד) ומקסימום של 10 צמתים (10,000 יחידות עיבוד).
המסלול הבסיסי (ברירת מחדל): המסלול הזה חסכוני ודורש כוח מחשוב נמוך, והוא מתאים לתרחישים הבאים:
- ניסוי עם
RagManagedDb - גדלים קטנים של נתונים
- עומסי עבודה שלא רגישים לזמן אחזור
- שימוש ב-RAG Engine רק עם מסדי נתונים וקטוריים אחרים
- ניסוי עם
כדי להציע את רמת השירות Basic, RagManagedDb מגדיר את מופע Spanner הבסיסי להגדרה קבועה של 100 יחידות עיבוד, ששווה ל-0.1 צמתים.
- רמה לא מוקצית: ברמה הזו, המערכת מוחקת את
RagManagedDbואת מופע Spanner הבסיסי שלו. ברמה לא מוקצית, המערכת משביתה את שירות RAG Engine ומוחקת את הנתונים שלכם שנשמרים בשירות הזה, ללא קשר למסד הנתונים הווקטורי שבו נעשה שימוש ב-RagCorpora. הפעולה הזו מפסיקה את החיוב על השירות. מידע נוסף על חיוב זמין במאמר חיוב על RAG Engine בפלטפורמת Gemini Enterprise Agent.
אחרי שהנתונים נמחקים, אי אפשר לשחזר אותם. כדי להתחיל להשתמש שוב ב-RAG Engine, צריך לעדכן את רמת התמחור באמצעות קריאה ל-UpdateRagEngineConfig API או להעביר את המצב ל-Serverless.
ניהול הרמות
כדי לקרוא ולעדכן את הרמות, משתמשים ב-GetRagEngineConfig וב-UpdateRagEngineConfig API. בדף מעבר בין מצבים מופיעות דוגמאות קוד שמראות איך להשתמש בממשקי ה-API האלה.