Übersicht über die Bereitstellungsoptionen

Wenn Sie Arbeitslasten aus den Bereichen künstliche Intelligenz (KI), maschinelles Lernen (ML) oder Hochleistungs-Computing (HPC) ausführen möchten, können Sie KI-optimierte Compute Engine-Instanzen und -Cluster bereitstellen, die A4X-, A4-, A3 Ultra-, A3 Mega- und A3 High-Maschinen (8 GPUs) verwenden. Weitere Informationen zu den Funktionen dieser Maschinen, mit denen Sie KI- und ML-Cluster im großen Maßstab ausführen können, finden Sie unter Clusterverwaltung – Übersicht.

Sie können A4X-, A4-, A3 Ultra-, A3 Mega- und A3 High-Instanzen (8 GPUs) direkt über Compute Engine, über verwaltete Dienste wie Google Kubernetes Engine (GKE) oder mit Bereitstellungstools wie Cluster Toolkit erstellen.

Wählen Sie eine der folgenden Optionen aus, um die für Ihren Anwendungsfall am besten geeigneten Compute-Instanzen oder ‑Cluster zu erstellen:

Option Anwendungsfall
Cluster Director Sie möchten einen vollständig verwalteten Dienst, der die Einrichtung und Konfiguration Ihrer Slurm-Cluster automatisiert. Mit Cluster Director können Sie Rechen-, Netzwerk- und Speicherressourcen für Ihre Cluster konfigurieren, um die Leistung zu maximieren und Ausfallzeiten zu minimieren. Weitere Informationen finden Sie unter Vollständig verwalteten Slurm-Cluster für KI-Arbeitslasten erstellen.
Cluster Toolkit

Sie möchten Open-Source-Software verwenden, die die Bereitstellung von Slurm- und GKE-Clustern vereinfacht. Cluster Toolkit ist so konzipiert, dass es sich sehr gut anpassen und erweitern lässt. Mit Blueprints können Sie Netzwerk- und Speicherressourcen bereitstellen. Weitere Informationen finden Sie unter:

GKE

Sie möchten Ihren GKE-Cluster basierend auf den Anforderungen Ihrer Arbeitslast maximal flexibel konfigurieren. Weitere Informationen nachstehend:

Compute Engine verwenden

Sie möchten die volle Kontrolle über die Infrastrukturschicht haben, damit Sie Ihren eigenen Orchestrator einrichten können. Weitere Informationen nachstehend:

Nächste Schritte