本頁說明如何使用自動設定流程建立 Spanner 資料流。
自動化串流設定可減少您需要執行的步驟,簡化將資料從 Spanner 資料庫移至 BigQuery 等目的地的程序。這個流程可讓您直接從 Spanner 執行個體或資料庫的總覽頁面建立串流。Datastream 會自動保護串流與來源資料庫之間的連線安全,並建立資料庫設定和串流連線資源。
免費方案
Datastream 可讓您使用免費方案,將資料從 Spanner 串流至 BigQuery,每個月最多可免費擷取 100 GiB 的變更資料擷取資料。詳情請參閱「Datastream 定價」。
事前準備
為 Spanner 設定 Datastream 串流前,請確認您的環境符合下列必要條件:
- 在 Google Cloud 專案中啟用必要的 API:
- Datastream API (
datastream.googleapis.com) - Cloud Spanner API (
spanner.googleapis.com) - BigQuery API (
bigquery.googleapis.com)。
- Datastream API (
- 確認您具備必要的 Identity and Access Management (IAM) 權限,可以建立及管理 Datastream 資源。詳情請參閱「必要權限」。
查看 Spanner 來源限制:
- 系統不支援
PROTO和ENUM資料類型資料欄。 - 不支援
DATE或TIMESTAMP資料類型的陣列。 - 請確認變更串流保留期限設定正確無誤。如果 Datastream 延遲時間超過保留期限,您可能會遺失資料,且串流可能會失敗。
- 系統不支援
所需權限
如要使用自動建立串流的流程,請確認設定串流的使用者或服務帳戶具備下列 IAM 角色或權限:
- Datastream 管理員 (
roles/datastream.admin) 或 Datastream 編輯者 (roles/datastream.editor) 角色,才能建立及管理串流和連線設定檔。 - 來源資料庫的「Spanner 資料庫讀取者」 (
roles/spanner.databaseReader) 或「Spanner 管理員」 (roles/spanner.admin) 角色,可存取資料並追蹤變更。 - 目的地資料集的「BigQuery 資料編輯者」。
建立並啟動串流
如要透過自動化流程建立及啟動串流,請按照下列步驟操作:
控制台
- 前往 Google Cloud 控制台的「Spanner Instances」(Spanner 執行個體) 頁面。
- 選取要從中串流資料的 Spanner 執行個體和資料庫。
透過下列任一方式,自動建立並啟動串流:
- 在執行個體總覽頁面中,按一下「Data replication to BigQuery」(將資料複製到 BigQuery) 下方的「Start stream」(啟動串流)。
- 在資料庫總覽頁面的「整合」分頁中,按一下「將資料複製到 BigQuery」下方的「建立串流」。
「啟動串流來複製資料」窗格隨即開啟。
在「串流設定」下方,查看所建立串流的預設設定。
如果從執行個體總覽頁面建立串流,可以展開對應的下拉式選單並選取其他值,藉此變更來源資料庫。
如要變更資料串流,請展開「變更資料串流」下拉式選單,然後選取其他值。
準備好建立及開始直播時,請按一下「開始直播」。
監控串流
如要透過 Google Cloud 控制台的來源 Spanner 資料庫總覽頁面監控基本串流詳細資料,請按一下「變更串流」分頁,然後點選要查看的串流。
刪除串流
刪除透過自動化流程建立的串流時,Datastream 會刪除串流物件,以及為該串流建立的相關聯連線設定檔。
不過,如果不再需要獨立建立的 Spanner 變更串流或目的地資源,您必須手動刪除。
後續步驟
- 進一步瞭解如何從 Spanner 來源串流資料。
- 瞭解如何設定來源 Spanner 資料庫。
- 進一步瞭解 Datastream 總覽。