容量の概要

AI Hypercomputer は、コンピューティング リソースの取得と使用に役立つ複数の使用オプションをサポートしています。このドキュメントでは、各使用オプションの容量を取得する方法の概要について説明します。

容量の取得方法

次の表に、各使用オプションの容量を取得する方法を示します。

使用オプション 容量取得のプロセス 料金への影響
AI Hypercomputer の将来の予約

将来の予約リソースを取得するプロセスは次のとおりです。

  1. アカウント チームに連絡して容量を予約します。
  2. 容量が提供される前に、割り当てが自動的に増加します。お客様側でのご対応は必要ありません。
  3. Compute Engine インスタンスまたはクラスタを作成するときに、予約にバインドされたプロビジョニング モデルを指定します。コンピューティング インスタンスとクラスタは、予約済み容量からプロビジョニングされます。
予約済みリソースを予約期間全体で使用するかどうかに関係なく、予約期間全体に対して料金が発生します。詳細については、Compute Engine の予約に関するドキュメントの 予約の課金をご覧ください。
90 日未満の将来の予約(カレンダー モード)

将来の予約リソースを取得するプロセスは次のとおりです。

  1. 利用可能な容量を検索してリソースを予約する
  2. 割り当ては課金されません。お客様側での対応は必要ありません。
  3. コンピューティング インスタンスまたはクラスタを作成する場合は、予約にバインドされたプロビジョニング モデルを指定する必要があります。コンピューティング インスタンスとクラスタは、予約済み容量からプロビジョニングされます。
予約済みリソースを予約期間全体で使用するかどうかに関係なく、予約期間全体に対して料金が発生します。詳細については、Dynamic Workload Scheduler の料金をご覧ください。
Flex Start

この消費オプションでは、予約は不要です。Flex Start リソースを取得するプロセスは次のとおりです。

  1. 使用する GPU マシンタイプのプリエンプティブル割り当てをリクエストする必要があります。
  2. 次のいずれかのオプションを使用してコンピューティング インスタンスまたはクラスタを作成する場合は、Flex Start プロビジョニング モデルを指定します。

    リクエストされたリソースが使用可能になると、Compute Engine は VM をプロビジョニングします。VM は最大 7 日間実行されます。

リソースが使用されているときに課金されます。Flex Start を使用してプロビジョニングされたリソースには、Dynamic Workload Scheduler の料金に基づいて自動的に割引が適用されます。
オンデマンド

この使用オプションでは、容量の予約は省略可能です。オンデマンド リソースは、汎用 GPU(N1、G2、G4、A2、A3 Edge など)でのみ使用できます。これらのオンデマンド リソースを取得するプロセスは次のとおりです。

  1. 使用するマシンタイプの標準 GPU 割り当てをリクエストします。詳細については、割り当ての増加をリクエストするをご覧ください。
  2. Compute Engine の 各リージョンとゾーンで利用可能な GPU のリストで、ハードウェアの優先リージョンを確認して可用性を検証します。
  3. コンピューティング インスタンスまたはクラスタを作成し、標準プロビジョニング モデルを指定します。リソースは、利用可能な容量に基づいてすぐにプロビジョニングされます。
リソースの使用中は、標準のオンデマンド料金が適用されます。
オンデマンド予約

オンデマンド予約(予約とも呼ばれます)は、汎用 GPU(G2、G4、A2、A3 Edge など)でのみ使用できます。容量を予約するプロセスは次のとおりです。

  1. マシンタイプの標準 GPU 割り当てをリクエストします。詳細については、割り当ての増加をリクエストするをご覧ください。
  2. Google Cloud コンソール、gcloud CLI、またはその他の方法を使用して、特定の VM と GPU タイプのオンデマンド予約を作成します。予約を作成するすべての方法の詳細については、単一プロジェクトの予約を作成するをご覧ください。
  3. インスタンスまたはクラスタを作成し、特定の予約をターゲットにして、リソースをプロビジョニングします。
予約期間全体に標準料金が適用されます。CUD を適用して、大幅な費用削減を実現します。
標準の将来の予約

この消費オプションでは、将来の日付の容量を予約します。標準の将来の予約では標準のプロビジョニング モデルが使用され、一般的な GPU でのみ使用できます。

  1. マシンタイプの標準 GPU 割り当てをリクエストします。詳細については、割り当ての増加をリクエストするをご覧ください。
  2. 特定の VM と GPU タイプの将来の予約リクエストを作成します。
  3. 予約が開始時間に達したら、予約容量を使用してコンピューティング インスタンスを作成します。
予約期間全体に標準料金が適用されます。CUD を適用して、大幅な費用削減を実現します。
スポット

この消費オプションでは、予約は不要です。Spot リソースを取得するプロセスは次のとおりです。

  1. 使用する GPU マシンタイプのプリエンプティブル割り当てをリクエストする必要があります。
  2. コンピューティング インスタンスを作成するリージョンまたはゾーンで使用可能なリソースを表示する
  3. コンピューティング インスタンスまたはクラスタを作成するときに、スポット プロビジョニング モデルを指定します。リソースは容量が利用可能になるとプロビジョニングされますが、いつでもプリエンプトされる可能性があります。
リソースが使用されているときに課金されます。Spot VM には、Spot VM の料金に基づいて自動的に割引が適用されます。

次のステップ