Kapazität – Übersicht

AI Hypercomputer unterstützt verschiedene Nutzungsoptionen , mit denen Sie Rechenressourcen erhalten und verwenden können. In diesem Dokument wird beschrieben, wie Sie für jede Nutzungsoption Kapazität erhalten.

Kapazität erhalten

In der folgenden Tabelle wird beschrieben, wie Sie für jede Nutzungsoption Kapazität erhalten.

Nutzungsoption Prozess zum Erhalten von Kapazität Auswirkungen auf die Preise
Vorausschauende Reservierungen in AI Hypercomputer

So erhalten Sie Ressourcen für vorausschauende Reservierungen:

  1. Reservieren Sie Kapazität indem Sie sich an Ihr Accountteam wenden.
  2. Das Kontingent wird automatisch erhöht, bevor die Kapazität bereitgestellt wird. Sie müssen deshalb nichts unternehmen.
  3. Wenn Sie eine Compute Engine-Instanz oder einen Cluster erstellen, geben Sie das an die Reservierung gebundene Bereitstellungsmodell an. Compute-Instanzen und -Cluster werden aus Ihrer reservierten Kapazität bereitgestellt.
Ihnen werden die Kosten für den gesamten Reservierungszeitraum in Rechnung gestellt, unabhängig davon, ob Sie die reservierten Ressourcen während des gesamten Zeitraums nutzen. Weitere Informationen finden Sie im Abschnitt zur Reservierungsabrechnung in der Dokumentation zu Compute Engine-Reservierungen.
Vorausschauende Reservierungen für weniger als 90 Tage (im Kalendermodus)

So erhalten Sie Ressourcen für vorausschauende Reservierungen:

  1. Suchen Sie nach verfügbarer Kapazität und reservieren Sie Ressourcen.
  2. Es werden keine Kontingentgebühren erhoben und Sie müssen nichts unternehmen.
  3. Wenn Sie eine Compute-Instanz oder einen Cluster erstellen, müssen Sie das an die Reservierung gebundene Bereitstellungsmodell angeben. Compute-Instanzen und -Cluster werden aus Ihrer reservierten Kapazität bereitgestellt.
Ihnen werden die Kosten für den gesamten Reservierungszeitraum in Rechnung gestellt, unabhängig davon, ob Sie die reservierten Ressourcen während des gesamten Zeitraums nutzen. Weitere Informationen finden Sie unter Preise für Dynamic Workload Scheduler.
Flex-Start

Für diese Nutzungsoption ist keine Reservierung erforderlich. So erhalten Sie Flex-Start-Ressourcen:

  1. Sie müssen ein Kontingent auf Abruf für den GPU Maschinentyp anfordern, den Sie verwenden möchten.
  2. Wenn Sie Compute-Instanzen oder -Cluster mit einer der folgenden Optionen erstellen, geben Sie das Flex-Start-Bereitstellungsmodell an:

    Wenn die angeforderten Ressourcen verfügbar werden, stellt Compute Engine Ihre VMs bereit. Ihre VMs werden bis zu sieben Tage lang ausgeführt.

Ihnen werden die Kosten in Rechnung gestellt, wenn die Ressourcen verwendet werden. Für Ressourcen, die mit Flex-Start bereitgestellt werden, werden automatisch Rabatte über die Preise für Dynamic Workload Scheduler gewährt.
On demand

Für diese Nutzungsoption ist die Reservierung von Kapazität optional. On-Demand-Ressourcen sind nur für allgemeine GPUs verfügbar (z. B. N1, G2, G4, A2 oder A3 Edge). So erhalten Sie diese On-Demand-Ressourcen: So gehen Sie vor:

  1. Fordern Sie ein Standard-GPU-Kontingent für den Maschinentyp den Sie verwenden möchten. Weitere Informationen finden Sie unter Kontingenterhöhung anfordern.
  2. Prüfen Sie die Verfügbarkeit, indem Sie die bevorzugten Regionen für Ihre Hardware in der Compute Engine Liste Verfügbarkeit von GPUs nach Region und Zone prüfen.
  3. Erstellen Sie eine Compute-Instanz oder einen Cluster und geben Sie das Standardbereitstellungsmodell an. Ressourcen werden sofort basierend auf verfügbaren Kapazität bereitgestellt.
Während der Nutzung der Ressourcen gelten die Standard-On-Demand-Preise.
On-Demand-Reservierungen

On-Demand-Reservierungen (manchmal auch als Reservierungen bezeichnet) sind nur für allgemeine GPUs verfügbar (z. B. G2, G4, A2 oder A3 Edge). So reservieren Sie Kapazität:

  1. Fordern Sie ein Standard-GPU-Kontingent für Ihren Maschinentyp an. Weitere Informationen finden Sie unter Kontingenterhöhung anfordern.
  2. Erstellen Sie eine On-Demand-Reservierung für Ihren spezifischen VM- und GPU-Typ mit der Google Cloud Console, der gcloud CLI oder anderen Methoden. Weitere Informationen zu allen Methoden zum Erstellen von Reservierungen finden Sie unter Reservierung für ein einzelnes Projekt erstellen.
  3. Stellen Sie Ihre Ressourcen bereit , indem Sie eine Instanz oder einen Cluster erstellen und auf Ihre spezifische Reservierung ausrichten.
Für den gesamten Reservierungszeitraum gelten die Standardpreise. Wenden Sie Rabatte für zugesicherte Nutzung an, um erhebliche Einsparungen zu erzielen.
Standardmäßige vorausschauende Reservierungen

Bei dieser Nutzungsoption reservieren Sie Kapazität für einen zukünftigen Zeitpunkt. Standardmäßige vorausschauende Reservierungen verwenden das Standardbereitstellungsmodell und sind nur für allgemeine GPUs verfügbar.

  1. Fordern Sie ein Standard-GPU-Kontingent für Ihren Maschinentyp an. Weitere Informationen finden Sie unter Kontingenterhöhung anfordern.
  2. Erstellen Sie eine Anfrage für eine vorausschauende Reservierung für Ihren spezifischen VM- und GPU-Typ.
  3. Wenn die Reservierung den Startzeitpunkt erreicht, erstellen Sie Compute-Instanzen mit Ihrer reservierten Kapazität.
Für den gesamten Reservierungszeitraum gelten die Standardpreise. Wenden Sie Rabatte für zugesicherte Nutzung an, um erhebliche Einsparungen zu erzielen.
Spot

Für diese Nutzungsoption ist keine Reservierung erforderlich. So erhalten Sie Spot-Ressourcen:

  1. Sie müssen ein Kontingent auf Abruf für den GPU Maschinentyp anfordern, den Sie verwenden möchten.
  2. Prüfen Sie die Ressourcenverfügbarkeit in der Region oder Zone, in der Sie Compute-Instanzen erstellen möchten.
  3. Wenn Sie eine Compute Instanz oder einen Cluster erstellen, geben Sie das Spot-Bereitstellungsmodell an. Ressourcen werden für Sie bereitgestellt, sobald Kapazität verfügbar ist, können aber jederzeit vorzeitig beendet werden.
Ihnen werden die Kosten in Rechnung gestellt, wenn die Ressourcen verwendet werden. Für Spot-VMs werden automatisch Rabatte über die Preise für Spot-VMs gewährt.

Nächste Schritte