Reservierungstyp auswählen

In diesem Dokument werden die verschiedenen Reservierungstypen beschrieben, mit denen Sie Kapazität für Compute Engine-Instanzen reservieren können. Weitere Informationen zu den Ressourcen, die Sie zum Erstellen von Instanzen verwenden, finden Sie unter Compute Engine-Instanzen.

Mit Reservierungen sorgen Sie dafür, dass die Ressourcen jederzeit verfügbar sind, die Sie zum Erstellen von Instanzen mit derselben Hardware (Arbeitsspeicher und vCPUs) und optionalen Ressourcen (GPUs, H4D-HPC-Clustern, TPUs oder lokalen SSD-Laufwerken) benötigen. Reservierungen bieten folgende Vorteile:

  • Hohe Kapazitätssicherheit: Sie reservieren Ressourcen, um zukünftige Nachfragesteigerungen zu berücksichtigen, z. B. bei:

    • Wachstum

    • Geplanten oder ungeplanten Nutzungsspitzen

    • Großen Migrationen

    • Sicherung und Notfallwiederherstellung

  • Exklusiver Zugriff: Reservierungen verhindern, dass andere Ihre reservierten Ressourcen verwenden.

  • Übernommene Attribute: Reservierungen übernehmen dieselben Attribute wie die ausgewählte Maschinenfamilie.

Nachdem Sie Kapazität reserviert haben, können Sie sie verwenden, um Instanzen zu erstellen, die der Reservierung entsprechen. Für die Erstellung dieser Instanzen fallen keine zusätzlichen Gebühren an. Sie zahlen nur für Ressourcen, die nicht Teil der Reservierung sind, z. B. Laufwerke oder IP-Adressen.

Beschränkungen

Für alle Reservierungstypen gelten die folgenden Einschränkungen:

  • Reservierungen sind zonenspezifische Ressourcen.

  • Sie können die reservierte Kapazität nicht verwenden, um die folgenden Compute Engine-Ressourcen zu erstellen:

    • Maschinentypen f1-micro und g1-small

    • Flex-Start-VMs

    • Knoten für einzelne Mandanten

    • Spot-VMs oder vorzeitig beendbare Instanzen

Reservierungstyp auswählen

Das folgende Diagramm hilft Ihnen bei der Auswahl des Compute Engine-Reservierungstyps, der am besten zu den Anforderungen Ihrer Arbeitslast passt:

Ein Flussdiagramm mit den verschiedenen Reservierungsmethoden, die in Compute Engine verfügbar sind.

Die Fragen im vorherigen Diagramm sind folgende:

  1. Benötigen Sie sofort Kapazität?

    • Ja: Fahren Sie mit der nächsten Frage fort.

    • Nein: Fahren Sie mit Frage 3 fort.

  2. Benötigen Sie Flexibilität bei der Dauer der Kapazitätsreservierung?

  3. Benötigen Sie Ressourcen mit hoher Nachfrage wie GPUs?

  4. Benötigen Sie Ressourcen für mehr als 90 Tage?

On‑Demand-Reservierungen verwenden

Mit On‑Demand-Reservierungen können Sie versuchen, sofort Kapazität für Compute-Instanzen zu reservieren. Wenn der Versuch erfolgreich ist, erstellt Compute Engine eine Reservierung für übereinstimmende Instanzen, die das Standardbereitstellungsmodell verwenden. Nachdem Sie eine On‑Demand-Reservierung erstellt haben, können Sie sie jederzeit nutzen, ändern oder löschen.

Weitere Informationen finden Sie unter Reservierungen.

Vorausschauende Reservierungen verwenden

Wenn Sie Instanzen für einen bestimmten Zeitraum reservieren möchten, können Sie standardmäßige vorausschauende Reservierungen verwenden. Nachdem Sie eine Reservierungsanfrage erstellt haben, müssen Sie sie Google Cloud zur Überprüfung einreichen. Google Cloud Die Überprüfung Ihrer Anfrage dauert in der Regel fünf Tage. Wenn Ihre Anfrage genehmigt wird, erstellt Compute Engine On‑Demand-Reservierungen mit der angeforderten Kapazität für das von Ihnen ausgewählte Datum und die von Ihnen ausgewählte Uhrzeit. Um diese Reservierungen zu nutzen, erstellen Sie Compute-Instanzen, die den Reservierungen entsprechen und das Standardbereitstellungsmodell verwenden. Nach Ablauf des Reservierungszeitraums können Sie die Reservierungen ändern oder löschen.

Weitere Informationen finden Sie unter Anfragen für vorausschauende Reservierungen.

Vorausschauende Reservierungen im Kalendermodus verwenden

Wenn Sie GPU-Instanzen, H4D-Instanzen oder TPUs für bis zu 90 Tage reservieren möchten, können Sie vorausschauende Reservierungen im Kalendermodus verwenden. Um diese Art von Reservierung zu erstellen, sehen Sie zuerst nach, wann die von Ihnen ausgewählte Anzahl und Art von Ressourcen in einer Region verfügbar sind. Erstellen und senden Sie dann eine Reservierungsanfrage mit den Attributen, die Sie als verfügbar bestätigt haben. Wenn Sie die Anfrage erfolgreich erstellen können, wird sie Google Cloud innerhalb einer Minute genehmigt. Nachdem die Anfrage genehmigt wurde, führt Compute Engine die folgenden Schritte aus:

  • Compute Engine erstellt automatisch eine Reservierung.

  • Compute Engine reserviert die angeforderten Ressourcen so nah wie möglich beieinander, um die Netzwerklatenz zu minimieren.

Zu Beginn des Reservierungszeitraums können Sie die Reservierung nutzen, indem Sie übereinstimmende GPU-, H4D- oder TPU-Instanzen erstellen, die das reservierungsgebundene Bereitstellungsmodell verwenden. Am Ende des Reservierungszeitraums löscht Compute Engine die Reservierung und beendet oder löscht alle Instanzen, die die Reservierung nutzen, basierend auf der Beendigungsaktion, die Sie für die Instanzen angegeben haben.

Weitere Informationen finden Sie unter Anfragen für vorausschauende Reservierungen im Kalendermodus.

Vorausschauende Reservierungen mit AI Hypercomputer oder H4D-HPC-Clustern verwenden

Wenden Sie sich an Ihr Account-Management-Team und fordern Sie an, GPU-Instanzen für umfangreiche KI- und ML-Arbeitslasten oder zum Erstellen eines Clusters von H4D-HPC-Instanzen mit erweiterten Clusterverwaltungsfunktionen zu reservieren. Nachdem Google eine Reservierungsanfrage für Sie erstellt hat, reichen Sie sie zur Überprüfung ein wenn alles korrekt aussieht. Google Cloud Die Anfrage wird sofort genehmigt und Compute Engine führt dann die folgenden Schritte aus:

  • Compute Engine erstellt automatisch eine Reservierung.

  • Compute Engine reserviert die angeforderten Ressourcen so nah wie möglich beieinander, um die Netzwerklatenz zu minimieren.

  • Compute Engine reserviert Ressourcen mit Topology Aware Scheduling sowie erweitertem Monitoring und erweiterter Wartung.

Zu Beginn des Reservierungszeitraums können Sie die Reservierung nutzen, indem Sie übereinstimmende GPU- oder H4D-Instanzen erstellen, die das reservierungsgebundene Bereitstellungsmodell verwenden. Am Ende des Reservierungszeitraums löscht Compute Engine die Reservierung und beendet oder löscht alle Instanzen, die die Reservierung nutzen, basierend auf der Beendigungsaktion, die Sie für die Instanzen angegeben haben.

Weitere Informationen finden Sie in einem der folgenden Dokumente: