AI Hypercomputer 的計費模式

AI Hypercomputer 提供多種計費模式,方便您取得運算資源。這些選項可滿足工作負載時間長度、容錯能力和基礎架構模型等需求。瞭解這些選項,並選擇最適合您用途的選項。

除了手動評估,您也可以在Google Cloud 控制台中提示 Gemini,比較工作負載和預算的用量選項。詳情請參閱「使用 Compute Advisor 設計 AI 基礎架構」。

計費模式總覽

如要比較主要特徵的計費方案,請參閱下表:

計費方案 佈建模型 適用情境 容量保證 效期 先占 配額 折扣 分配模式
彈性啟動 彈性啟動 最多七天的短期工作負載,可等待運算資源。 盡可能取得容量 最多七天 否 先占配額 支援的機型可享折扣 (最高 47%) MIG 規模調整要求會盡量提供密集型 VM,獨立 VM 則不保證。
Spot VM Spot 容錯、短時間的一般 GPU 工作負載。 盡可能取得容量 先占 是 先占配額 大幅折扣 (最高 91%) 標準
標準預訂 標準 需要極高容量保證的一般重要 GPU 工作負載。 極高 極高 使用者定義 否 未消耗配額 承諾使用折扣 (CUD) 的折扣費率
容量區塊的未來預留項目 取決於預留項目 在叢集式 GPU 上進行大規模的長時間訓練。 極高 預訂期間內無限制。 否 配額會在交貨前增加 承諾使用折扣 (最多可享 47 折優惠) 密集型
日曆模式的未來預留項目 取決於預留項目 最多 90 天的叢集 GPU 工作負載,需要預留容量。 極高 最多 90 天 否 未消耗配額 折扣 (最多 53%) 密集型
隨選 VM 標準 一般 GPU 工作負載,沒有特定時間長度。 盡可能取得容量 無限制 否 以量計價配額 無 (即付即用) 標準

部署基礎架構時使用的計費方案,取決於您使用的是一般 GPU 還是叢集 GPU。

  • 一般 GPU:專為小規模推論、開發及小規模訓練工作負載設計。這類 GPU 可透過非同步維護作業提供作業彈性。如要查看可用的選項,請參閱「一般 GPU 的計費模式」。

  • 叢集式 GPU:專為大規模、緊密耦合的訓練工作負載,以及大規模推論、強化學習和推理模型工作負載設計,可確保高容量並密集分配資源,盡量減少網路延遲。如要查看可用選項,請參閱「叢集式 GPU 的用量選項」。

一般 GPU 的用量選項

如要取得一般 GPU 的容量,請使用下列消耗量選項。

使用彈性啟動

如要執行需要密集分配資源的短期工作負載,可以使用彈性啟動功能,要求最多七天的運算資源。只要有可用資源,Compute Engine 就會建立您要求的 VM 數量。您可以停止獨立的彈性啟動 VM,但無法停止代管執行個體群組 (MIG) 透過大小調整要求建立的彈性啟動 VM。彈性啟動 VM 會一直存在,直到您刪除 VM,或 Compute Engine 在執行時間結束時刪除 VM 為止。

適合的工作負載

  • 小型模型預先訓練
  • 微調模型
  • 高效能運算 (HPC) 模擬
  • 批次推論

主要特性

  • 佈建模式:彈性啟動。
  • 廣泛的硬體支援:要求任何叢集 GPU 機型,但 A4X Max 和 A4X 除外。
  • 延遲時間最佳化:對獨立 VM 套用密集配置政策,盡量減少網路延遲時間。
  • 成本效益:A4、A3、A2 和 G4 機器系列機型的 vCPU、記憶體、GPU 和本機 SSD 磁碟,最高可享 53% 折扣。其他支援的系列則適用標準隨選費率。詳情請參閱「彈性啟動定價」。

使用 Spot

如要執行容錯工作負載,您可以根據可用性立即取得運算資源。以盡可能最低的價格取得資源。不過,Compute Engine 隨時可能會先占 VM 並取回資源。

適合的工作負載

  • 批次處理和資料分析
  • 高效能運算 (HPC) 和媒體編碼

主要特性

  • 佈建模式:Spot。
  • 廣泛的硬體支援:要求任何叢集 GPU 機型,但 A4X Max 和 A4X 除外。
  • 延遲時間最佳化:對獨立 VM 套用密集配置政策,盡量減少網路延遲時間。
  • 提高成本效益:vCPU、記憶體、GPU 和本機 SSD 磁碟可享高達 91% 的折扣。

按照需求使用

提示:如要提高取得一般 GPU 資源的機率,請使用彈性啟動或 Spot。與隨需價格相比,這些用量選項提供的 GPU 價格較低,且旨在協助您提高取得 GPU 等高需求資源的機會。

如要執行沒有特定時長的工作負載,您可以根據可用性立即取得運算資源。VM 會持續執行,直到您加以停止或刪除。

適合的工作負載

  • 推論和提供模型
  • 原型設計與實驗

主要特性

  • 佈建模型:標準。
  • 立即提供:立即建立 VM 執行個體,不必等待容量排程或核准。
  • 標準價格:以標準隨選費率支付資源費用,無需長期承諾。
  • 廣泛的硬體支援:在一般 GPU 路徑中,可搭配任何支援的 GPU 機器系列使用。

使用標準預留項目

如要執行需要極高容量保證的重要一般 GPU 工作負載,可以使用標準預留項目。

適合的工作負載

  • 重要正式環境工作負載
  • 需要保證容量的工作負載

主要特性

  • 佈建模型:標準。
  • 容量保證:提供極高的保證,確保資源可用。
  • 價格:適用標準費率,但您可以附加 CUD 來節省費用。

叢集式 GPU 的使用選項

請使用下列消耗選項,取得叢集 GPU 的容量。

使用未來預留項目取得容量區塊

如要執行長期大型分散式工作負載,且需要密集分配資源,您可以要求在未來日期和時間密集分配運算資源。在該期間,您擁有預留資源的獨占存取權,並可使用這些資源建立 VM 或叢集。預留項目期限結束時,Compute Engine 會執行下列動作:

  • Compute Engine 會刪除預留項目和所有相關聯的空白儲存集區。
  • 根據您為 VM 指定的終止動作,Compute Engine 會停止或刪除使用預留項目的 VM。

適合的工作負載

  • 預先訓練基礎模型
  • 跨多個主機的基礎模型推論

主要特性

  • 佈建模式:取決於預留項目。
  • 高階機型支援:預留 A4X Max、A4X、A4、A3 Ultra、A3 Mega 或 A3 High (8 個 GPU) 機型。
  • Hyperdisk 預留項目:您可以預留 Hyperdisk 儲存空間集區或 Hyperdisk Exapool,以及運算容量,確保工作負載有足夠的儲存空間資源。Google 會將 Hyperdisk 集區與運算節點放在同一位置,以最佳化儲存空間效能。
  • 承諾使用合約規定:預留一年以上的資源時,請附上依資源計算的承諾使用合約,即可享有運算資源和 Hyperdisk 集區折扣。
  • 動態修改:在期限開始後,啟用 Vertex AI 工作用量的硬體緊急維護通知。

使用日曆模式的未來預留項目

如要執行需要密集分配資源的短期分散式工作負載,您可以要求運算資源,最長可達 90 天。在該段時間內,您擁有預留資源的獨占存取權,並可使用這些資源建立 VM 或叢集。預留項目期限結束時,Compute Engine 會執行下列操作:

  • Compute Engine 會刪除預留項目。
  • 根據您為 VM 指定的終止動作,Compute Engine 會停止或刪除使用預留項目的 VM。

適合的工作負載

  • 預先訓練和微調
  • 大規模模擬和推論

主要特性

  • 佈建模式:取決於預留項目。
  • 支援的機器系列:預留 A4、A3 Ultra、A3 Mega 或 A3 High (8 個 GPU) 機型。
  • 可擴充性限制:最多可預留 80 部 VM,最長 90 天。
  • 最佳化佈建:使用與預留項目綁定的模型,提高取得 GPU 的機率。

使用彈性啟動

如需密集分配資源,且時間最多七天,請使用彈性啟動功能,為叢集代管執行個體群組 (MIG) 提出大小調整要求。

適合的工作負載

彈性啟動 VM 非常適合執行可隨時啟動的工作負載,例如:

  • 小型模型預先訓練
  • 微調模型
  • 高效能運算 (HPC) 模擬
  • 批次推論

主要特性

  • 佈建模式:彈性啟動。
  • 資源分配:為 MIG 規模調整要求密集分配資源。
  • 成本效益:A4、A3、A2 和 G4 機器系列的 vCPU、記憶體、GPU 和任何附加的本機 SSD 磁碟,最高可享 53% 的折扣。其他支援的機器系列則適用標準隨選費率。

使用 Spot

您可以將 Spot VM 用於密集分配的容錯工作負載,以享有大幅折扣,但請注意,Compute Engine 可能會先占 VM 來回收容量。

適合的工作負載

  • 容錯分散式訓練
  • 批次處理

主要特性

  • 佈建模式:Spot。
  • 先占:Compute Engine 隨時可以先占執行個體。
  • 成本效益:vCPU、記憶體、GPU 和任何附加的本機 SSD 磁碟,最高可享 91% 的折扣

後續步驟