Google Compute – Übersicht

In diesem Dokument werden die in Google Cloudverfügbaren Computing-Dienste vorgestellt. Wenn Sie das Spektrum der Infrastrukturkontrolle und der Abstraktion der Verwaltung verstehen, erhalten Sie das grundlegende Wissen, das Sie benötigen, um den richtigen Computing-Dienst für Ihre Arbeitslasten auszuwählen.

Der Begriff Compute be Google Cloud zieht sich auf die virtualisierten Computing Ressourcen, z. B. Rechenleistung und Arbeitsspeicher, die zum Ausführen Ihrer Anwendungen erforderlich sind. Diese Ressourcen reichen von einfachen VM-Instanzen (virtuelle Maschinen) bis hin zu vollständig verwalteten Plattformen. Mit VM-Instanzen können Sie das Betriebssystem, das Netzwerk und den Softwarestack vollständig anpassen. Bei verwalteten Plattformen übernimmt Google den Großteil der zugrunde liegenden Infrastruktur.

Allgemeine Dienstbereiche

Die Kategorie „Compute“ in Google Cloud umfasst die folgenden wichtigen Service bereiche:

  • VM-Instanzen und Bare-Metal-Instanzen: Compute Engine bietet konfigurierbare VM- und Bare-Metal-Instanzen, auf denen Sie Ihr eigenes Betriebssystem und Ihre eigenen Anwendungen installieren und verwalten können. Diese Konfiguration umfasst auch das Hinzufügen von GPUs (Grafikprozessoren) oder TPUs (Tensor Processing Units) zu einer benutzerdefinierten VM- oder Bare-Metal-Instanz.

  • Container: Mit Diensten wie Google Kubernetes Engine (GKE) können Sie containerisierte Anwendungen bereitstellen und verwalten.

  • Batchverarbeitung: Mit Diensten wie Batch können Sie umfangreiche asynchrone Jobs ausführen.

  • KI-Infrastruktur: umfasst spezielle Dienste und Tools wie Cluster Director und Cluster Toolkit, speziell entwickelte Hardware (NVIDIA-GPUs und Google-TPUs), Open-Source-Software und flexible Verbrauchs modelle. Diese Dienste wurden entwickelt, um komplexe, orchestrierte Trainings- und Inferenzarbeitslasten für künstliche Intelligenz (KI) oder maschinelles Lernen (ML) im großen Maßstab auszuführen.

  • HPC-Infrastruktur: umfasst spezielle Dienste und Hardware zum Ausführen von Hochleistungs-Computing-Arbeitslasten (HPC), z. B. eng gekoppelte physikalische Simulationen, Wettermodelle oder Molekulardynamik.

Kontrolle im Vergleich zur Abstraktion in Ihrer Infrastruktur

Google Cloud bietet Computing-Dienste mit unterschiedlichem Grad an Kontrolle und Abstraktion. Die beiden Hauptkategorien sind:

Infrastructure as a Service (IaaS)

Infrastructure as a Service (IaaS) ist das Modell, das die größte Kontrolle bietet. Sie verwalten das Betriebssystem, die Middleware und die Anwendungen. Stattdessen verwaltet Google die zugrunde liegende Virtualisierung, die Server, den Speicher und das Netzwerk. Zu den in Google Cloud verfügbaren IaaS-Lösungen gehören:

  • Compute Engine: Mit diesem Dienst können Sie VM- und Bare-Metal- Instanzen in der Infrastruktur von Google erstellen und ausführen. Compute Engine bietet Flexibilität für eine Vielzahl von Arbeitslasten, da Sie aus verschiedenen Maschinenserien, Speicherdiensten, Beschleunigern und Gastbetriebssystemen auswählen können.

  • Google Cloud VMware Engine: Ein Dienst, mit dem Sie VMware Arbeitslasten nativ in migrieren und ausführen können Google Cloud. Google verwaltet die zugrunde liegende Hardware und die VMware-Plattform. Sie behalten die volle Kontrolle über Ihre VMs, Gastbetriebssysteme und Anwendungen. Mit diesem Ansatz können Sie in die Cloud wechseln, ohne Ihre vorhandenen VMware-Umgebungen neu zu entwickeln.

IaaS wird häufig von Infrastrukturarchitekten, ML-Infrastrukturingenieuren und Plattformentwicklern bevorzugt, die benutzerdefinierte Umgebungen von Grund auf entwerfen und verwalten müssen.

Verwaltete Plattformen und Dienste

Verwaltete Plattformen und Dienste bieten ein ausgewogenes Verhältnis zwischen Kontrolle und Benutzerfreundlichkeit. Google verwaltet die zugrunde liegende Infrastruktur, das Betriebssystem und die Laufzeitumgebungen, damit Sie sich auf die Ausführung Ihrer Arbeitslasten konzentrieren können. Zu den in verfügbaren Google Cloud verwalteten Lösungen gehören:

  • Batch: Ein verwalteter Dienst, mit dem Sie Batch-Computing-Jobs im großen Maßstab planen, in die Warteschlange stellen und ausführen können. Batch stellt Compute Engine-Ressourcen bereit, um Ihre Jobs auszuführen, und verwaltet ihren Lebenszyklus. Sie müssen die zugrunde liegenden VM- oder Bare-Metal-Instanzen nicht direkt verwalten.

  • Cloud Run: Eine vollständig verwaltete Plattform, mit der Sie hochskalierbare containerisierte Anwendungen in einer serverlosen Infrastruktur entwickeln und bereitstellen können. Bei Cloud Run fallen Aufgaben der Infrastrukturverwaltung vollständig weg. Mit dieser Abstraktion können Sie Container ausführen, die auf Webanfragen oder Ereignisse reagieren, ohne Server oder Cluster verwalten zu müssen.

  • Cluster Director: Ein verwalteter Dienst, der die komplexe Einrichtung und Konfiguration von KI-, ML- oder HPC-Clustern automatisiert. Google verwaltet die Clusterinfrastruktur, sodass Sie sich mit minimalem Betriebsaufwand auf die Ausführung Ihrer Arbeitslasten konzentrieren können.

  • Cluster Toolkit: Ein Open-Source-Toolkit, mit dem Sie KI-, ML- oder HPC-Cluster in Google Cloud mithilfe vordefinierter Blaupausen bereitstellen können. Sie verwalten die resultierende Clusterinfrastruktur, aber das Toolkit abstrahiert den Bereitstellungsprozess und ermöglicht es Ihnen, Ihre Bereitstellungen und Ihren Softwarestack anzupassen.

  • GKE: Eine verwaltete Umgebung zum Ausführen containerisierter Anwendungen in Kubernetes. Google verwaltet die Kubernetes-Steuerungsebene, während Sie Ihre Containerarbeitslasten bereitstellen und verwalten. Je nach Bereitstellungsmodus (Autopilot oder Standard) können Sie auswählen, wie viel Kontrolle Sie über die zugrunde liegende Infrastruktur haben möchten.

Verwaltete Plattformen und Dienste werden häufig von Data Scientists, KI-Forschern und ML-Entwicklern bevorzugt, die Ressourcen schnell bereitstellen und Arbeitslasten bereitstellen möchten, ohne sich mit der Infrastrukturverwaltung auseinandersetzen zu müssen.

Nächste Schritte