本文說明如何建立資料儲存庫,並連結至 Spanner 資料。您可以將這個資料儲存庫連結至 Gemini Enterprise 應用程式,讓代理程式分析您的資料。
如要使用 Gemini Enterprise 資料儲存庫連結至 Spanner 資料,可以採用下列其中一種模式:
聯合查詢 (建議) [預覽版]: 直接連線至 Spanner 資料,不必複製及移動資料,因此不會產生輸出費用。聯合查詢會將查詢直接傳送至 Spanner,查詢範圍涵蓋您身分有 Identity and Access Management (IAM) 權限可存取的所有資料庫和資料表,因此分析查詢的效率更高。使用聯合查詢模式時,系統會自動在 Gemini Enterprise 應用程式的「助理」分頁中啟用 Knowledge Catalog,讓代理程式工具搜尋使用者有權存取的資料,並查詢相關背景資訊。
資料擷取:將特定 Spanner 資料表中的資料複製到 Gemini Enterprise 資料儲存庫。您必須手動重新整理資料,才能反映 Spanner 表格的變更。這個模式會產生將資料移至新位置的輸出費用,且現有的 IAM 權限不會複製到資料存放區。
事前準備
如要在 Gemini Enterprise 中建立 Spanner 資料儲存庫,您必須具備 Gemini Enterprise 管理員 (roles/discoveryengine.agentspaceAdmin) 或 Discovery Engine 管理員 (roles/discoveryengine.admin) 角色。詳情請參閱「授予管理員權限」。
如果專案受到 VPC Service Controls 範圍保護,或已啟用機構政策強制執行功能,請確保機構政策允許連接器執行下列操作:
- 在
discoveryengine.managed.allowedDataSources受管理限制 (限制資料連結器可用的資料來源) 中,將spanner新增至allowedDataSources參數。詳情請參閱「受管理政策限制總覽」 和「設定允許的資料來源」。
此外,請為您打算使用的連接器模式設定必要的 Spanner IAM 權限:
聯合查詢
如要使用聯合查詢模式連線至 Spanner,請在包含 Spanner 資料庫的Google Cloud 專案中,將下列 IAM 角色授予透過連接器查詢或執行動作的使用者:
- 資料庫存取權:
- MCP 工具存取權:
- 在 Spanner 資料庫所在的專案中,MCP 工具使用者 (
roles/mcp.toolUser) 即可叫用 Spanner MCP 工具。
- 在 Spanner 資料庫所在的專案中,MCP 工具使用者 (
資料擷取
如要從來源 Google Cloud 專案 Google Cloud 擷取資料,請在來源 Spanner 專案中,將下列其中一個 IAM 角色授予service-PROJECT_NUMBER@gcp-sa-discoveryengine.iam.gserviceaccount.com服務帳戶 (其中 PROJECT_NUMBER 是包含 Gemini Enterprise 資料儲存庫的Google Cloud 專案編號):
- 不使用 Data Boost:
Cloud Spanner 資料庫讀取者 (
roles/spanner.databaseReader) - 使用 Data Boost:
Cloud Spanner 資料庫管理員 (
roles/spanner.databaseAdmin), 或具有 Cloud Spanner 資料庫讀取者和spanner.databases.useDataBoost權限的自訂角色。詳情請參閱「Data Boost 總覽」。
建立 Spanner 資料儲存庫
如要建立資料儲存庫,將 Spanner 的資料連結至 Gemini Enterprise,請按照下列步驟操作:
前往 Google Cloud 控制台的「Gemini Enterprise」頁面。
前往「Data Stores」(資料儲存庫) 頁面。
按一下「Create data store」(建立資料儲存庫)。
在「來源」頁面中,選擇資料儲存庫的資料來源。在「選取資料來源」搜尋欄中搜尋「Spanner」,或在「第一方資料來源」清單中找到 Spanner。選取「新增資料來源」。
在「資料」頁面中,選取連接器模式,瞭解如何連結至資料。根據您選擇的模式,選取下列分頁標籤查看進一步的操作說明。
聯合查詢
資料擷取
- 選取「資料擷取」。
指定要匯入資料的詳細資料。在「從 Spanner 資料表匯入資料」下方,指定下列資訊:
- 專案 ID:包含 Spanner 表格的 Google Cloud 專案。這是必填欄位。
- 執行個體 ID:包含要匯入資料的 Spanner 執行個體 ID。這是必填欄位。
- 資料庫 ID:包含要匯入資料的 Spanner 資料庫 ID。這是必填欄位。
- 資料表 ID:包含要匯入資料的 Spanner 資料表 ID。這是必填欄位。
視需要選取「啟用 Data Boost」,使用 Spanner Data Boost 加快查詢速度。啟用 Data Boost 會產生額外費用。請參閱「Spanner Data Boost 計費和配額」。
按一下「繼續」。
在「Configuration」(設定) 頁面中,設定資料儲存庫。
- 資料連接器的位置:選擇要儲存資料儲存庫中繼資料的區域。資料儲存庫建立後,就無法變更位置。如要查看多區域的重要資訊,請參閱「Gemini Enterprise 位置」一文。
- 資料連接器名稱:在「資料連接器名稱」欄位中,輸入資料連接器的名稱。資料連接器建立後,名稱就無法變更。輸入名稱後,系統會為資料連接器產生專屬 ID。視需要,在「代碼 (選用)」欄位中輸入資料連接器的代碼,做為所有版本連接器的固定 ID。
- Sensitive Data Protection 政策:為資料儲存庫選取敏感資料保護政策。格式如下:
projects/{project}/locations/{location}/contentPolicies/{policy}。你之後可以編輯這項設定。
點選「建立」。
現在可以將資料儲存庫附加至 Gemini Enterprise 應用程式。在聯合查詢模式中,使用者透過附加的應用程式執行查詢時,會產生 Spanner 使用費用;在資料擷取模式中,即使資料儲存庫尚未附加至應用程式,匯入資料也會產生 Spanner 和 Gemini Enterprise 索引費用。如要進一步瞭解這些費用,請參閱 Gemini Enterprise 定價。
後續步驟
如要將資料儲存庫連結至應用程式,請按照「建立 Gemini Enterprise 應用程式」中的步驟,建立應用程式並選取資料儲存庫。
瞭解 Knowledge Catalog 如何搭配 Data Cloud 連接器 (使用聯合查詢模式時會自動啟用),協助代理程式搜尋使用者有權存取的資料,並查詢機構背景資訊。
如要使用經過驗證的查詢,建構高精確度的範圍代理,請參閱發布 Spanner 資料代理至 Gemini Enterprise。