本頁面將介紹 RagManagedDb、其基礎技術,以及如何在 Gemini Enterprise Agent Platform 的 RAG Engine 中使用 RagManagedDb。此外,本頁面也會說明可用於調整效能的不同層級 (可能會影響費用),並提供刪除 RAG Engine 資料的相關操作說明 (刪除後系統會停止計費)。
總覽
Gemini Enterprise Agent Platform 上的 RAG Engine 使用 RagManagedDb,這是企業適用的全代管 Google Spanner 執行個體,RAG Engine 會用來儲存資源,您也可以選擇將其做為 RAG 語料庫的向量資料庫。
透過 Spanner,RAG Engine 提供一致、高可用性且高度可擴充的資料庫,支援您的應用程式。如要進一步瞭解 Google Spanner,請參閱 Spanner。
無論您選擇哪種向量資料庫,RAG Engine 都會將 RAG 語料庫和 RAG 檔案資源中繼資料儲存在 RagManagedDb 中。向量資料庫只會用於儲存和擷取嵌入。除了儲存資源,RagManagedDb 也可用於儲存及管理文件的向量表示形式。接著,向量資料庫會根據文件與指定查詢的語意相似度,擷取相關文件。
管理等級
Gemini Enterprise Agent Platform 上的 RAG Engine 提供兩種級別,可供您依據用量和效能需求擴充 RagManagedDb 執行個體,並可選擇使用第三種級別刪除 RAG Engine 資料。
層級是專案層級的設定,可在 RagEngineConfig 資源中使用,會影響使用 RagManagedDb 的 RAG 語料庫。RagEngineConfig 提供下列層級:
調整級別:這個級別提供生產規模的效能,以及自動調度資源功能,適合資料量龐大或對效能要求嚴苛的工作負載。在內部,這個級別會將 Spanner 執行個體設為自動調度資源設定,最少 1 個節點 (1,000 個處理單元),最多 10 個節點 (10,000 個處理單元)。
基本層級 (預設):這個層級的成本效益高,運算資源需求低,可能適合下列情況:
- 使用
RagManagedDb進行實驗。 - 資料量少。
- 不易受延遲影響的工作負載。
- 搭配使用 RAG Engine 與其他向量資料庫。
為提供基本級,
RagManagedDb會將基礎 Spanner 執行個體設為 100 個處理單元的固定設定,相當於 0.1 個節點。- 使用
未佈建層級:這個層級會刪除
RagManagedDb和其基礎 Spanner 執行個體。未佈建層級會停用 RAG Engine 服務,並刪除此服務中保存的資料,無論RagCorpora使用的向量資料庫為何。這會停止服務的計費。如要進一步瞭解計費方式,請參閱「[RAG Engine on Gemini Enterprise Agent Platform billing]rag-engine-billing」。資料刪除後就無法復原。如要再次使用 RAG 引擎,請呼叫
UpdateRagEngineConfigAPI 更新層級。
取得專案設定
下列程式碼範例說明如何針對各層級使用 GetRagEngineConfig API:
第 1 版 (v1) API 程式碼範例。
v1beta1 API 程式碼範例。
更新專案設定
下列程式碼範例說明如何針對各層級使用 UpdateRagEngineConfig API:
第 1 版 (v1) API 程式碼範例。
v1beta1 API 程式碼範例。
後續步驟
如要瞭解如何使用預設的 RAG API v1,請參閱 RAG API v1。
如要瞭解如何使用 RAG API v1beta1,請參閱 RAG API v1beta1。
如要進一步瞭解
RagManagedDb,以及如何管理層級設定和 RAG 語料庫層級的擷取策略,請參閱「在 Gemini Enterprise Agent Platform 上透過 RAG Engine 使用 RagManagedDb」。