Kapazität – Übersicht

AI Hypercomputer unterstützt mehrere Nutzungsoptionen, mit denen Sie Rechenressourcen beziehen und nutzen können. In diesem Dokument finden Sie einen Überblick darüber, wie Sie Kapazität für die einzelnen Nutzungsoptionen erhalten können.

Kapazität erhalten

In der folgenden Tabelle wird beschrieben, wie Sie Kapazität für die einzelnen Verbrauchsoptionen erhalten können.

Nutzungsoption Prozess zum Erhalten von Kapazität Auswirkungen auf den Preis
Vorausschauende Reservierungen in AI Hypercomputer

So erhalten Sie Ressourcen für vorausschauende Reservierungen:

  1. Kapazitäten reservieren: Wenden Sie sich dazu an Ihr Account-Management-Team.
  2. Das Kontingent wird automatisch erhöht, bevor die Kapazität bereitgestellt wird. Sie müssen nichts weiter tun.
  3. Wenn Sie eine Compute Engine-Instanz oder einen Cluster erstellen, geben Sie das reservierungsgebundene Bereitstellungsmodell an. Compute-Instanzen und ‑Cluster werden aus Ihrer reservierten Kapazität bereitgestellt.
Ihnen wird der gesamte Reservierungszeitraum in Rechnung gestellt, unabhängig davon, ob Sie die reservierten Ressourcen während des gesamten Zeitraums nutzen. Weitere Informationen finden Sie im Abschnitt Abrechnung von Reservierungen in der Dokumentation zu Compute Engine-Reservierungen.
Vorausschauende Reservierungen für weniger als 90 Tage (im Kalendermodus)

So erhalten Sie Ressourcen für vorausschauende Reservierungen:

  1. Nach verfügbarer Kapazität suchen und Ressourcen reservieren:
  2. Es wird kein Kontingent berechnet und Sie müssen nichts weiter tun.
  3. Wenn Sie eine Compute-Instanz oder einen Cluster erstellen, müssen Sie das reservierungsgebundene Bereitstellungsmodell angeben. Compute-Instanzen und ‑Cluster werden aus Ihrer reservierten Kapazität bereitgestellt.
Ihnen wird der gesamte Reservierungszeitraum in Rechnung gestellt, unabhängig davon, ob Sie die reservierten Ressourcen während des gesamten Zeitraums nutzen. Weitere Informationen finden Sie unter Dynamic Workload Scheduler – Preise.
Flex-Start

Für diese Verbrauchsoption ist keine Reservierung erforderlich. So erhalten Sie Flex-Start-Ressourcen:

  1. Sie müssen Kontingent auf Abruf für den GPU-Maschinentyp anfordern, den Sie verwenden möchten.
  2. Wenn Sie Compute-Instanzen oder ‑Cluster mit einer der folgenden Optionen erstellen, geben Sie das Flex-Start-Bereitstellungsmodell an:

    Wenn die angeforderten Ressourcen verfügbar werden, stellt Compute Engine Ihre VMs bereit. Ihre VMs werden bis zu sieben Tage lang ausgeführt.

Gebühren werden berechnet, wenn die Ressourcen verwendet werden. Ressourcen, die mit Flex-Start bereitgestellt werden, erhalten automatisch Rabatte über die Preisgestaltung für Dynamic Workload Scheduler.
On demand

Bei dieser Nutzungsoption ist die Reservierung von Kapazität optional. On-Demand-Ressourcen sind nur für allgemeine GPUs verfügbar, z. B. N1, G2, G4, A2 oder A3 Edge. So erhalten Sie diese On-Demand-Ressourcen:

  1. Fordern Sie ein Standard-GPU-Kontingent für den Maschinentyp an, den Sie verwenden möchten. Weitere Informationen finden Sie unter Kontingenterhöhung anfordern.
  2. Prüfen Sie die Verfügbarkeit, indem Sie die bevorzugten Regionen für Ihre Hardware in der Liste GPU-Verfügbarkeit nach Region und Zone in Compute Engine aufrufen.
  3. Erstellen Sie eine Compute-Instanz oder einen Compute-Cluster und geben Sie das Standardbereitstellungsmodell an. Ressourcen werden sofort auf Grundlage der verfügbaren Kapazität bereitgestellt.
Während die Ressourcen verwendet werden, fallen die Standard-On-Demand-Gebühren an.
On-demand-Reservierungen

On-Demand-Reservierungen (manchmal auch als Reservierungen bezeichnet) sind nur für allgemeine GPUs wie G2, G4, A2 oder A3 Edge verfügbar. So reservieren Sie Kapazität:

  1. Fordern Sie ein Standard-GPU-Kontingent für Ihren Maschinentyp an. Weitere Informationen finden Sie unter Kontingenterhöhung anfordern.
  2. Erstellen Sie eine On-Demand-Reservierung für Ihren spezifischen VM- und GPU-Typ mit der Google Cloud Console, der gcloud CLI oder anderen Methoden. Weitere Informationen zu allen Methoden zum Erstellen von Reservierungen finden Sie unter Reservierung für ein einzelnes Projekt erstellen.
  3. Ressourcen bereitstellen: Erstellen Sie eine Instanz oder einen Cluster und richten Sie sie auf Ihre spezifische Reservierung aus.
Für den gesamten Reservierungszeitraum gelten Standardpreise. Mit CUDs können Sie erhebliche Einsparungen erzielen.
Standardmäßige vorausschauende Reservierungen

Bei dieser Verbrauchsoption reservieren Sie Kapazität für einen zukünftigen Zeitpunkt. Für Standardreservierungen für die Zukunft wird das Standardbereitstellungsmodell verwendet. Sie sind nur für allgemeine GPUs verfügbar.

  1. Fordern Sie ein Standard-GPU-Kontingent für Ihren Maschinentyp an. Weitere Informationen finden Sie unter Kontingenterhöhung anfordern.
  2. Erstellen Sie eine Anfrage für eine vorausschauende Reservierung für Ihren spezifischen VM- und GPU-Typ.
  3. Wenn die Reservierung ihre Startzeit erreicht hat, erstellen Sie Compute-Instanzen mit der reservierten Kapazität.
Für den gesamten Reservierungszeitraum gelten Standardpreise. Mit CUDs können Sie erhebliche Einsparungen erzielen.
Spot

Für diese Verbrauchsoption ist keine Reservierung erforderlich. So erhalten Sie Spot-Ressourcen:

  1. Sie müssen Kontingent auf Abruf für den GPU-Maschinentyp anfordern, den Sie verwenden möchten.
  2. Ressourcenverfügbarkeit in der Region oder Zone ansehen, in der Sie Compute-Instanzen erstellen möchten.
  3. Wenn Sie eine Compute-Instanz oder einen Cluster erstellen, geben Sie das Spot-Bereitstellungsmodell an. Ressourcen werden für Sie bereitgestellt, sobald Kapazität verfügbar ist, können aber jederzeit vorzeitig beendet werden.
Gebühren werden berechnet, wenn die Ressourcen verwendet werden. Für Spot-VMs werden automatisch Rabatte über die Preise für Spot-VMs gewährt.

Nächste Schritte