AI Hypercomputer 提供多種計費模式,方便您取得運算資源。這些選項可滿足工作負載時間長度、容錯能力和基礎架構模型等需求。瞭解這些選項,並選擇最適合您用途的選項。
除了手動評估,您也可以在Google Cloud 控制台中提示 Gemini,比較工作負載和預算的用量選項。詳情請參閱「使用 Compute Advisor 設計 AI 基礎架構」。
計費模式總覽
如要比較主要特徵的計費方案,請參閱下表:
| 計費方案 | 佈建模型 | 適用情境 | 容量保證 | 效期 | 先占 | 配額 | 折扣 | 分配模式 |
|---|---|---|---|---|---|---|---|---|
| 彈性啟動 | 彈性啟動 | 最多七天的短期工作負載,可等待運算資源。 | 盡可能取得容量 | 最多七天 | 否 | 先占配額 | 支援的機型可享折扣 (最高 47%) | MIG 規模調整要求會盡量提供密集型 VM,獨立 VM 則不保證。 |
| Spot VM | Spot | 容錯、短時間的一般 GPU 工作負載。 | 盡可能取得容量 | 先占 | 是 | 先占配額 | 大幅折扣 (最高 91%) | 標準 |
| 標準預訂 | 標準 | 需要極高容量保證的一般重要 GPU 工作負載。 | 極高 | 極高 | 使用者定義 | 否 | 未消耗配額 | 承諾使用折扣 (CUD) 的折扣費率 |
| 容量區塊的未來預留項目 | 取決於預留項目 | 在叢集式 GPU 上進行大規模的長時間訓練。 | 極高 | 預訂期間內無限制。 | 否 | 配額會在交貨前增加 | 承諾使用折扣 (最多可享 47 折優惠) | 密集型 |
| 日曆模式的未來預留項目 | 取決於預留項目 | 最多 90 天的叢集 GPU 工作負載,需要預留容量。 | 極高 | 最多 90 天 | 否 | 未消耗配額 | 折扣 (最多 53%) | 密集型 |
| 隨選 VM | 標準 | 一般 GPU 工作負載,沒有特定時間長度。 | 盡可能取得容量 | 無限制 | 否 | 以量計價配額 | 無 (即付即用) | 標準 |
部署基礎架構時使用的計費方案,取決於您使用的是一般 GPU 還是叢集 GPU。
一般 GPU:專為小規模推論、開發及小規模訓練工作負載設計。這類 GPU 可透過非同步維護作業提供作業彈性。如要查看可用的選項,請參閱「一般 GPU 的計費模式」。
叢集式 GPU:專為大規模、緊密耦合的訓練工作負載,以及大規模推論、強化學習和推理模型工作負載設計,可確保高容量並密集分配資源,盡量減少網路延遲。如要查看可用選項,請參閱「叢集式 GPU 的用量選項」。
一般 GPU 的用量選項
如要取得一般 GPU 的容量,請使用下列消耗量選項。
使用彈性啟動
如要執行需要密集分配資源的短期工作負載,可以使用彈性啟動功能,要求最多七天的運算資源。只要有可用資源,Compute Engine 就會建立您要求的 VM 數量。您可以停止獨立的彈性啟動 VM,但無法停止代管執行個體群組 (MIG) 透過大小調整要求建立的彈性啟動 VM。彈性啟動 VM 會一直存在,直到您刪除 VM,或 Compute Engine 在執行時間結束時刪除 VM 為止。
適合的工作負載
- 小型模型預先訓練
- 微調模型
- 高效能運算 (HPC) 模擬
- 批次推論
主要特性
- 佈建模式:彈性啟動。
- 廣泛的硬體支援:要求任何叢集 GPU 機型,但 A4X Max 和 A4X 除外。
- 延遲時間最佳化:對獨立 VM 套用密集配置政策,盡量減少網路延遲時間。
- 成本效益:A4、A3、A2 和 G4 機器系列機型的 vCPU、記憶體、GPU 和本機 SSD 磁碟,最高可享 53% 折扣。其他支援的系列則適用標準隨選費率。詳情請參閱「彈性啟動定價」。
使用 Spot
如要執行容錯工作負載,您可以根據可用性立即取得運算資源。以盡可能最低的價格取得資源。不過,Compute Engine 隨時可能會先占 VM 並取回資源。
適合的工作負載
- 批次處理和資料分析
- 高效能運算 (HPC) 和媒體編碼
主要特性
- 佈建模式:Spot。
- 廣泛的硬體支援:要求任何叢集 GPU 機型,但 A4X Max 和 A4X 除外。
- 延遲時間最佳化:對獨立 VM 套用密集配置政策,盡量減少網路延遲時間。
- 提高成本效益:vCPU、記憶體、GPU 和本機 SSD 磁碟可享高達 91% 的折扣。
按照需求使用
提示:如要提高取得一般 GPU 資源的機率,請使用彈性啟動或 Spot。與隨需價格相比,這些用量選項提供的 GPU 價格較低,且旨在協助您提高取得 GPU 等高需求資源的機會。
如要執行沒有特定時長的工作負載,您可以根據可用性立即取得運算資源。VM 會持續執行,直到您加以停止或刪除。
適合的工作負載
- 推論和提供模型
- 原型設計與實驗
主要特性
- 佈建模型:標準。
- 立即提供:立即建立 VM 執行個體,不必等待容量排程或核准。
- 標準價格:以標準隨選費率支付資源費用,無需長期承諾。
- 廣泛的硬體支援:在一般 GPU 路徑中,可搭配任何支援的 GPU 機器系列使用。
使用標準預留項目
如要執行需要極高容量保證的重要一般 GPU 工作負載,可以使用標準預留項目。
適合的工作負載
- 重要正式環境工作負載
- 需要保證容量的工作負載
主要特性
- 佈建模型:標準。
- 容量保證:提供極高的保證,確保資源可用。
- 價格:適用標準費率,但您可以附加 CUD 來節省費用。
叢集式 GPU 的使用選項
請使用下列消耗選項,取得叢集 GPU 的容量。
使用未來預留項目取得容量區塊
如要執行長期大型分散式工作負載,且需要密集分配資源,您可以要求在未來日期和時間密集分配運算資源。在該期間,您擁有預留資源的獨占存取權,並可使用這些資源建立 VM 或叢集。預留項目期限結束時,Compute Engine 會執行下列動作:
- Compute Engine 會刪除預留項目和所有相關聯的空白儲存集區。
- 根據您為 VM 指定的終止動作,Compute Engine 會停止或刪除使用預留項目的 VM。
適合的工作負載
- 預先訓練基礎模型
- 跨多個主機的基礎模型推論
主要特性
- 佈建模式:取決於預留項目。
- 高階機型支援:預留 A4X Max、A4X、A4、A3 Ultra、A3 Mega 或 A3 High (8 個 GPU) 機型。
- Hyperdisk 預留項目:您可以預留 Hyperdisk 儲存空間集區或 Hyperdisk Exapool,以及運算容量,確保工作負載有足夠的儲存空間資源。Google 會將 Hyperdisk 集區與運算節點放在同一位置,以最佳化儲存空間效能。
- 承諾使用合約規定:預留一年以上的資源時,請附上依資源計算的承諾使用合約,即可享有運算資源和 Hyperdisk 集區折扣。
- 動態修改:在期限開始後,啟用 Vertex AI 工作用量的硬體緊急維護通知。
使用日曆模式的未來預留項目
如要執行需要密集分配資源的短期分散式工作負載,您可以要求運算資源,最長可達 90 天。在該段時間內,您擁有預留資源的獨占存取權,並可使用這些資源建立 VM 或叢集。預留項目期限結束時,Compute Engine 會執行下列操作:
- Compute Engine 會刪除預留項目。
- 根據您為 VM 指定的終止動作,Compute Engine 會停止或刪除使用預留項目的 VM。
適合的工作負載
- 預先訓練和微調
- 大規模模擬和推論
主要特性
- 佈建模式:取決於預留項目。
- 支援的機器系列:預留 A4、A3 Ultra、A3 Mega 或 A3 High (8 個 GPU) 機型。
- 可擴充性限制:最多可預留 80 部 VM,最長 90 天。
- 最佳化佈建:使用與預留項目綁定的模型,提高取得 GPU 的機率。
使用彈性啟動
如需密集分配資源,且時間最多七天,請使用彈性啟動功能,為叢集代管執行個體群組 (MIG) 提出大小調整要求。
適合的工作負載
彈性啟動 VM 非常適合執行可隨時啟動的工作負載,例如:
- 小型模型預先訓練
- 微調模型
- 高效能運算 (HPC) 模擬
- 批次推論
主要特性
- 佈建模式:彈性啟動。
- 資源分配:為 MIG 規模調整要求密集分配資源。
- 成本效益:A4、A3、A2 和 G4 機器系列的 vCPU、記憶體、GPU 和任何附加的本機 SSD 磁碟,最高可享 53% 的折扣。其他支援的機器系列則適用標準隨選費率。
使用 Spot
您可以將 Spot VM 用於密集分配的容錯工作負載,以享有大幅折扣,但請注意,Compute Engine 可能會先占 VM 來回收容量。
適合的工作負載
- 容錯分散式訓練
- 批次處理
主要特性
- 佈建模式:Spot。
- 先占:Compute Engine 隨時可以先占執行個體。
- 成本效益:vCPU、記憶體、GPU 和任何附加的本機 SSD 磁碟,最高可享 91% 的折扣
後續步驟
- 如要查看啟動叢集時的程序和選擇,請參閱「規劃及建立 AI 基礎架構」。
- 如要建立及使用預留項目,請參閱「建立及使用預留項目」。
- 如要進一步瞭解 Spot VM,請參閱「進一步瞭解 Spot VM」。
- 如要建立隨選 VM 執行個體,請參閱「建立隨選 VM 執行個體」。