本文說明可用於預留容量的預留項目類型,以便建立 Compute Engine 執行個體。如要進一步瞭解建立運算執行個體所需的資源,請參閱「Compute Engine 執行個體」。
預留項目可確保專案在需要建立運算執行個體時,有很高的機率能取得可用區資源。您可以預留核心硬體 (vCPU 和記憶體) 和附加資源 (GPU、TPU、本機 SSD 磁碟和 Hyperdisk 集區)。如果共用保留項目,機構中最多 100 個專案都能獲得相同的容量保障。 Google Cloud 您可以隨時使用預留資源,建立符合預留項目屬性的運算執行個體。
預留項目具有下列優點:
高容量保證:您可以在特定區域保留資源,為日後的需求增加做好準備,例如成長、流量高峰、大型資料庫遷移或災難復原。
專屬存取權:限制預留資源的存取權,確保組織內外其他專案無法使用這些資源。 Google Cloud限制存取權可確保工作負載擁有執行所需的資源。
容量保留:即使停止運算執行個體,您仍可保留 vCPU、記憶體、GPU、TPU、本機 SSD 磁碟和儲存空間容量 (如果預留項目包含這些資源)。這樣一來,您就能重新啟動這些運算執行個體,不會發生資源可用性錯誤。
設定一致:使用預留資源建立的運算執行個體,硬體和儲存空間設定完全相同。這種做法有助於確保運算執行個體效能一致,並避免處理延遲。
Compute Engine 佈建預留資源後,您就必須為這些資源付費,無論是否使用,只要預留項目存在就必須付費。使用預留資源建立運算執行個體時,不會產生額外費用。您只需要為預訂項目以外的資源付費,例如 IP 位址。
限制
所有預訂類型都有下列限制:
預留項目是特定可用區的資源。
您無法使用預留容量建立下列 Compute Engine 資源:
使用
f1-micro或g1-small機型的運算執行個體彈性啟動型 VM
單一用戶群節點
Spot VM 或先占執行個體
選擇預訂類型
下圖有助於根據工作負載需求,選擇最合適的預留項目類型。如要比較不同預訂類型的功能,請參閱本文中的比較表。
上圖中的問題如下:
是否需要立即取得容量?
是:前往下一個問題。
否:請跳到問題 3。
您是否需要彈性決定保留容量的時間長度?
是:請參閱「使用隨需預留項目」。
否:前往下一個問題。
您是否需要 GPU 等熱門資源?
是:前往下一個問題。
否:請參閱「使用未來預留項目」。
需要超過 90 天的資源嗎?
是:請參閱「使用未來預留項目預留容量區塊」。
否:請參閱「在日曆模式中使用未來預留項目」。
使用隨需預留項目
透過隨選預留項目,您可以要求預留 vCPU、記憶體和附加資源 (GPU、TPU 和本機 SSD 磁碟),以建立運算執行個體。如果要求成功,Compute Engine 會執行下列操作:
Compute Engine 會在幾分鐘內,使用您要求的資源建立隨需預留項目。
Compute Engine 會盡力分配您預留的資源。如要將運算執行個體放置在相近位置,盡量縮短網路延遲時間,您可以在建立預訂時,視需要指定密集配置政策。
如要使用預留項目,請建立符合預留項目屬性的運算執行個體,並使用標準佈建模式。你隨時可以查看、修改或刪除預訂。
詳情請參閱「關於預留項目」一文。
使用未來預留項目
透過未來預留項目,您可以要求預留 vCPU、記憶體和附加資源 (GPU、TPU 和本機 SSD 磁碟),以便在未來日期和時間建立運算執行個體。建立預訂要求後,請將要求提交至 Google Cloud 以供審查。如果 Google Cloud 核准您的要求,Compute Engine 會執行下列操作:
Compute Engine 會在您選擇的交付日期和時間,建立具有所要求容量的隨選預留項目。
Compute Engine 會盡力分配預留資源。
如要使用預留項目,請建立符合預留項目屬性的運算執行個體,並使用標準佈建模式。你隨時可以修改或刪除預訂。即使預留項目到期或遭到刪除,您使用預留項目建立的任何運算執行個體仍會繼續執行。
詳情請參閱「未來預留項目要求簡介」。
使用日曆模式的未來預留項目
在日曆模式中,您可以預留未來的 vCPU、記憶體和附加資源 (GPU、TPU 和本機 SSD 磁碟),最長可預留 90 天。如要建立這類預留項目,請先查看所選數量和類型的資源在某個區域的可用時間。接著,建立並提交預訂要求,其中包含您確認可用的屬性。如果提交的要求有效,Google Cloud 會在 1 分鐘內核准要求。Google Cloud 核准要求後,Compute Engine 會執行下列操作:
Compute Engine 會在您選擇的交付日期和時間建立隨需預留項目。
Compute Engine 會在實體上相近的位置保留您要求的資源,盡量縮短網路延遲時間,這對於緊密耦合的人工智慧 (AI)、機器學習 (ML) 或高效能運算 (HPC) 工作負載很有幫助。
Compute Engine 會透過叢集管理功能預留資源,最適合多節點的大規模工作負載。
如要在預留期間開始時使用預留項目,請建立符合預留項目屬性的 GPU、H4D 或 TPU 執行個體,並使用取決於預留項目的佈建模式。預留項目到期後,Compute Engine 會刪除預留項目,並根據您為運算執行個體指定的終止動作,停止或刪除使用預留項目的運算執行個體。
詳情請參閱「日曆模式的未來預留項目要求簡介」。
使用未來預留項目取得容量區塊
您可以透過容量區塊的未來預留項目,要求預留未來時段的 vCPU、記憶體和附加資源 (GPU、TPU、本機 SSD 磁碟和 Hyperdisk 集區),且預留時間不限。如要建立這類預訂,請聯絡帳戶團隊並要求容量。Google 為您建立預留項目要求草稿後,請審查並提交要求。 Google Cloud 會在幾分鐘內核准要求,然後 Compute Engine 會執行下列操作:
Compute Engine 會在您選擇的交貨日期和時間建立隨選預留項目。
Compute Engine 會在實體上相近的位置預留您要求的資源,盡量減少網路延遲,這對緊耦合的 AI、機器學習或 HPC 工作負載很有幫助。
Compute Engine 會透過叢集管理功能預留資源,最適合多節點的大規模工作負載。
如要在預留期間開始時使用預留項目,請建立符合預留項目屬性的 GPU、TPU 或 H4D 執行個體,並使用取決於預留項目的佈建模式。預留期結束時,Compute Engine 會刪除預留項目,並根據您為運算執行個體設定的終止動作,停止或刪除使用預留項目的運算執行個體。
詳情請參閱下列任一文件:
GPU 執行個體:
如要預留 A4X Max、A4X、A4、A3 Ultra、A3 Mega、A3 High (8 個 GPU) 或 A3 Edge 執行個體的容量,以便在 Cluster Toolkit、Compute Engine 或 Google Kubernetes Engine (GKE) 中建立運算執行個體或叢集,請參閱 AI Hypercomputer 說明文件中的「透過帳戶團隊預留容量」。
如要預留 A4X、A4、A3 Ultra 或 A3 Mega 執行個體的容量,以便在 Cluster Director 中建立叢集,請參閱 Cluster Director 說明文件中的「透過帳戶團隊預留容量」。
TPU 執行個體:
- 如要預留 TPU7x、TPU v6e 或 TPU v5p 執行個體的容量,請參閱 Cloud TPU 說明文件中的「申請預留一年以上的容量」。
H4D 執行個體:
- 如要預留 H4D 執行個體的容量,請參閱 Compute Engine 說明文件中的「透過帳戶團隊預留容量」。
比較預留項目類型
如要找出適合工作負載的預留類型,請參閱下表,比較各預留類型的技術功能:
| 隨需預留項目 | 未來預留項目 | 日曆模式的未來預留項目 | 容量區塊的未來預留項目 | |
|---|---|---|---|---|
| 支援的機器系列 | 所有機器系列 (A4X Max、A4X、A4、A3 Ultra 和 A3 High 除外,這些機型必須配備至少 8 個 GPU) | A3 Mega*、A3 High (搭載 8 個 GPU)*、A3 Edge*、C4、C4A、C4D、C4N、C3、C3D、G4*、H4D*、H3、M4、M4N、M3、N4、N4A、N4D、TPU7x、TPU v6e、TPU v5p、X5、X4、Z4D 和 Z3 | A4、A3 Ultra、A3 Mega、A3 High (8 個 GPU)、A3 Edge、H4D、TPU7x、TPU v6e 和 TPU v5p | A4X Max、A4X、A4、A3 Ultra、A3 Mega、A3 High (8 個 GPU)、A3 Edge、H4D、TPU7x、TPU v6e 和 TPU v5p |
| 儲存空間預留 | 否 | 否 | 否 | 選用 (Hyperdisk 集區) |
| 每項要求可建立的運算執行個體數量上限 | 1,000‡ | 不限# | GPU 執行個體為 80 個、H4D 執行個體為 256 個,TPU 晶片則為 1,024 個 | 不限# |
| 時間長度上限 | 無限制 (直到你刪除為止) | 無上限 (直到你刪除為止) | 最多 90 天 | 無限制 (合約期) |
| 查看未來供應情形 | 否 | 否 | 是 (GPU 和 H4D 執行個體最多 60 天;TPU 晶片最多 120 天) | 是 (請與帳戶團隊聯絡) |
| 建立方法 | 建立預留項目 | 建立預訂要求 | 建立預訂要求 | 聯絡帳戶團隊,然後由 Google 為您建立預訂要求 |
| 運送時間 | 立即 | 未來的特定日期和時間 | 未來的特定日期和時間 | 未來的特定日期和時間 |
| 資源分配 | 盡量提供 (密集配置政策為選用) | 盡可能取得容量 | 密集型 | 密集型 |
| 叢集管理功能 | 否 | 否 | 是 | 是 |
| 佈建模式 | 標準 | 標準 | 取決於預留項目 | 取決於預留項目 |
| 配額 | 需要標準配額 | 需要標準配額 | 不需要 GPU 執行個體或 TPU 晶片的配額;需要 H4D 執行個體的標準配額 | Google 會在運送前自動提高配額 |
| 定價 | 標準價格 (承諾使用合約可享折扣) | 標準價格 (承諾使用合約可享折扣) | 最高可享 53% 折扣 (DWS 價格) | 標準價格 (承諾使用合約可享折扣) |
| 預留期間結束 | 手動刪除 | 手動刪除 | 自動刪除預留項目;根據終止動作停止或刪除運算執行個體 | 自動刪除預留項目和 Hyperdisk 集區;根據終止動作停止或刪除運算執行個體 |
* 提交 A3 Mega、A3 High (含 8 個 GPU)、A3 Edge、G4 或 H4D 執行個體的未來預留要求前,請先與帳戶團隊或銷售團隊聯絡。否則「 Google Cloud 」可能會拒絕您的要求。
‡ 如果您將最大距離值為 2 的密集配置政策套用至隨需預留項目,則最多可預留 256 個 A3 Mega、配備 8 個 GPU 的 A3 High 或 A3 Edge 執行個體,或最多 150 個其他所有支援機器系列的運算執行個體。詳情請參閱「
關於密集配置政策」。
# 如果您在單一預留要求中,要求預留超過 1,000 個運算執行個體,Compute Engine 會在您選擇的交付日期和時間,建立多個隨選預留項目,以交付您要求的容量。