選擇預訂類型

本文說明可用於預留容量的預留項目類型,以便建立 Compute Engine 執行個體。如要進一步瞭解建立運算執行個體所需的資源,請參閱「Compute Engine 執行個體」。

預留項目可確保專案在需要建立運算執行個體時,有很高的機率能取得可用區資源。您可以預留核心硬體 (vCPU 和記憶體) 和附加資源 (GPU、TPU、本機 SSD 磁碟和 Hyperdisk 集區)。如果共用保留項目,機構中最多 100 個專案都能獲得相同的容量保障。 Google Cloud 您可以隨時使用預留資源,建立符合預留項目屬性的運算執行個體。

預留項目具有下列優點:

  • 高容量保證:您可以在特定區域保留資源,為日後的需求增加做好準備,例如成長、流量高峰、大型資料庫遷移或災難復原。

  • 專屬存取權:限制預留資源的存取權,確保組織內外其他專案無法使用這些資源。 Google Cloud限制存取權可確保工作負載擁有執行所需的資源。

  • 容量保留:即使停止運算執行個體,您仍可保留 vCPU、記憶體、GPU、TPU、本機 SSD 磁碟和儲存空間容量 (如果預留項目包含這些資源)。這樣一來,您就能重新啟動這些運算執行個體,不會發生資源可用性錯誤。

  • 設定一致:使用預留資源建立的運算執行個體,硬體和儲存空間設定完全相同。這種做法有助於確保運算執行個體效能一致,並避免處理延遲。

Compute Engine 佈建預留資源後,您就必須為這些資源付費,無論是否使用,只要預留項目存在就必須付費。使用預留資源建立運算執行個體時,不會產生額外費用。您只需要為預訂項目以外的資源付費,例如 IP 位址。

限制

所有預訂類型都有下列限制:

  • 預留項目是特定可用區的資源。

  • 您無法使用預留容量建立下列 Compute Engine 資源:

    • 使用 f1-micro 或 g1-small 機型的運算執行個體

    • 彈性啟動型 VM

    • 單一用戶群節點

    • Spot VM 或先占執行個體

選擇預訂類型

下圖有助於根據工作負載需求,選擇最合適的預留項目類型。如要比較不同預訂類型的功能,請參閱本文中的比較表。

流程圖:Compute Engine 提供的不同預留方法。

上圖中的問題如下:

  1. 是否需要立即取得容量?

    • 是:前往下一個問題。

    • 否:請跳到問題 3。

  2. 您是否需要彈性決定保留容量的時間長度?

  3. 您是否需要 GPU 等熱門資源?

  4. 需要超過 90 天的資源嗎?

使用隨需預留項目

透過隨選預留項目,您可以要求預留 vCPU、記憶體和附加資源 (GPU、TPU 和本機 SSD 磁碟),以建立運算執行個體。如果要求成功,Compute Engine 會執行下列操作:

  • Compute Engine 會在幾分鐘內,使用您要求的資源建立隨需預留項目。

  • Compute Engine 會盡力分配您預留的資源。如要將運算執行個體放置在相近位置,盡量縮短網路延遲時間,您可以在建立預訂時,視需要指定密集配置政策。

如要使用預留項目,請建立符合預留項目屬性的運算執行個體,並使用標準佈建模式。你隨時可以查看、修改或刪除預訂。

詳情請參閱「關於預留項目」一文。

使用未來預留項目

透過未來預留項目,您可以要求預留 vCPU、記憶體和附加資源 (GPU、TPU 和本機 SSD 磁碟),以便在未來日期和時間建立運算執行個體。建立預訂要求後,請將要求提交至 Google Cloud 以供審查。如果 Google Cloud 核准您的要求,Compute Engine 會執行下列操作:

  • Compute Engine 會在您選擇的交付日期和時間,建立具有所要求容量的隨選預留項目。

  • Compute Engine 會盡力分配預留資源。

如要使用預留項目,請建立符合預留項目屬性的運算執行個體,並使用標準佈建模式。你隨時可以修改或刪除預訂。即使預留項目到期或遭到刪除,您使用預留項目建立的任何運算執行個體仍會繼續執行。

詳情請參閱「未來預留項目要求簡介」。

使用日曆模式的未來預留項目

在日曆模式中,您可以預留未來的 vCPU、記憶體和附加資源 (GPU、TPU 和本機 SSD 磁碟),最長可預留 90 天。如要建立這類預留項目,請先查看所選數量和類型的資源在某個區域的可用時間。接著,建立並提交預訂要求,其中包含您確認可用的屬性。如果提交的要求有效,Google Cloud 會在 1 分鐘內核准要求。Google Cloud 核准要求後,Compute Engine 會執行下列操作:

  • Compute Engine 會在您選擇的交付日期和時間建立隨需預留項目。

  • Compute Engine 會在實體上相近的位置保留您要求的資源,盡量縮短網路延遲時間,這對於緊密耦合的人工智慧 (AI)、機器學習 (ML) 或高效能運算 (HPC) 工作負載很有幫助。

  • Compute Engine 會透過叢集管理功能預留資源,最適合多節點的大規模工作負載。

如要在預留期間開始時使用預留項目,請建立符合預留項目屬性的 GPU、H4D 或 TPU 執行個體,並使用取決於預留項目的佈建模式。預留項目到期後,Compute Engine 會刪除預留項目,並根據您為運算執行個體指定的終止動作,停止或刪除使用預留項目的運算執行個體。

詳情請參閱「日曆模式的未來預留項目要求簡介」。

使用未來預留項目取得容量區塊

您可以透過容量區塊的未來預留項目,要求預留未來時段的 vCPU、記憶體和附加資源 (GPU、TPU、本機 SSD 磁碟和 Hyperdisk 集區),且預留時間不限。如要建立這類預訂,請聯絡帳戶團隊並要求容量。Google 為您建立預留項目要求草稿後,請審查並提交要求。 Google Cloud 會在幾分鐘內核准要求,然後 Compute Engine 會執行下列操作:

  • Compute Engine 會在您選擇的交貨日期和時間建立隨選預留項目。

  • Compute Engine 會在實體上相近的位置預留您要求的資源,盡量減少網路延遲,這對緊耦合的 AI、機器學習或 HPC 工作負載很有幫助。

  • Compute Engine 會透過叢集管理功能預留資源,最適合多節點的大規模工作負載。

如要在預留期間開始時使用預留項目,請建立符合預留項目屬性的 GPU、TPU 或 H4D 執行個體,並使用取決於預留項目的佈建模式。預留期結束時,Compute Engine 會刪除預留項目,並根據您為運算執行個體設定的終止動作,停止或刪除使用預留項目的運算執行個體。

詳情請參閱下列任一文件:

  • GPU 執行個體:

    • 如要預留 A4X Max、A4X、A4、A3 Ultra、A3 Mega、A3 High (8 個 GPU) 或 A3 Edge 執行個體的容量,以便在 Cluster Toolkit、Compute Engine 或 Google Kubernetes Engine (GKE) 中建立運算執行個體或叢集,請參閱 AI Hypercomputer 說明文件中的「透過帳戶團隊預留容量」。

    • 如要預留 A4X、A4、A3 Ultra 或 A3 Mega 執行個體的容量,以便在 Cluster Director 中建立叢集,請參閱 Cluster Director 說明文件中的「透過帳戶團隊預留容量」。

  • TPU 執行個體:

  • H4D 執行個體:

比較預留項目類型

如要找出適合工作負載的預留類型,請參閱下表,比較各預留類型的技術功能:

隨需預留項目 未來預留項目 日曆模式的未來預留項目 容量區塊的未來預留項目
支援的機器系列 所有機器系列 (A4X Max、A4X、A4、A3 Ultra 和 A3 High 除外,這些機型必須配備至少 8 個 GPU) A3 Mega*、A3 High (搭載 8 個 GPU)*、A3 Edge*、C4、C4A、C4D、C4N、C3、C3D、G4*、H4D*、H3、M4、M4N、M3、N4、N4A、N4D、TPU7x、TPU v6e、TPU v5p、X5、X4、Z4D 和 Z3 A4、A3 Ultra、A3 Mega、A3 High (8 個 GPU)、A3 Edge、H4D、TPU7x、TPU v6e 和 TPU v5p A4X Max、A4X、A4、A3 Ultra、A3 Mega、A3 High (8 個 GPU)、A3 Edge、H4D、TPU7x、TPU v6e 和 TPU v5p
儲存空間預留 否 否 否 選用 (Hyperdisk 集區)
每項要求可建立的運算執行個體數量上限 1,000‡ 不限# GPU 執行個體為 80 個、H4D 執行個體為 256 個,TPU 晶片則為 1,024 個 不限#
時間長度上限 無限制 (直到你刪除為止) 無上限 (直到你刪除為止) 最多 90 天 無限制 (合約期)
查看未來供應情形 否 否 是 (GPU 和 H4D 執行個體最多 60 天;TPU 晶片最多 120 天) 是 (請與帳戶團隊聯絡)
建立方法 建立預留項目 建立預訂要求 建立預訂要求 聯絡帳戶團隊,然後由 Google 為您建立預訂要求
運送時間 立即 未來的特定日期和時間 未來的特定日期和時間 未來的特定日期和時間
資源分配 盡量提供 (密集配置政策為選用) 盡可能取得容量 密集型 密集型
叢集管理功能 否 否 是 是
佈建模式 標準 標準 取決於預留項目 取決於預留項目
配額 需要標準配額 需要標準配額 不需要 GPU 執行個體或 TPU 晶片的配額;需要 H4D 執行個體的標準配額 Google 會在運送前自動提高配額
定價 標準價格 (承諾使用合約可享折扣) 標準價格 (承諾使用合約可享折扣) 最高可享 53% 折扣 (DWS 價格) 標準價格 (承諾使用合約可享折扣)
預留期間結束 手動刪除 手動刪除 自動刪除預留項目;根據終止動作停止或刪除運算執行個體 自動刪除預留項目和 Hyperdisk 集區;根據終止動作停止或刪除運算執行個體

* 提交 A3 Mega、A3 High (含 8 個 GPU)、A3 Edge、G4 或 H4D 執行個體的未來預留要求前,請先與帳戶團隊或銷售團隊聯絡。否則「 Google Cloud 」可能會拒絕您的要求。

‡ 如果您將最大距離值為 2 的密集配置政策套用至隨需預留項目,則最多可預留 256 個 A3 Mega、配備 8 個 GPU 的 A3 High 或 A3 Edge 執行個體,或最多 150 個其他所有支援機器系列的運算執行個體。詳情請參閱「 關於密集配置政策」。

# 如果您在單一預留要求中,要求預留超過 1,000 個運算執行個體,Compute Engine 會在您選擇的交付日期和時間,建立多個隨選預留項目,以交付您要求的容量。