In diesem Dokument finden Sie Links zu Dokumenten zur Fehlerbehebung für häufige Probleme, die bei der Verwendung von Google Kubernetes Engine (GKE) auftreten können. Ob Sie Arbeitslastfehler wie ImagePullBackOff und CrashLoopBackOff diagnostizieren, das Verhalten des Cluster Autoscalers debuggen, Probleme mit PersistentVolumes beheben oder Probleme mit der Knotenregistrierung beheben möchten – die hier aufgeführten Dokumente können Ihnen helfen.
Dieses Dokument richtet sich an Administratoren und Architekten, Sicherheitsexperten, Netzwerkspezialisten oder Speicherspezialisten, die Fehler in GKE-Konfigurationen beheben. Weitere Informationen zu GKE-Rollen finden Sie unter Häufig verwendete GKE-Nutzerrollen und -Aufgaben.
GKE Autopilot-Cluster diagnostizieren und Fehler beheben, einschließlich Clustererstellung, Löschen von Namespaces, Skalierung und Arbeitslastprobleme.
Fehlerbehebung beim kubectl Befehlszeilentool in
GKE, einschließlich Problemen mit Authentifizierung und Autorisierung.
Diese Seite enthält auch Informationen zur Fehlerbehebung beim Konnectivity-Proxy, um zu prüfen, ob er dazu führt, dass die Befehle kubectl logs, attach, exec oder port-forward nicht mehr reagieren.
Fehlerbehebung bei GKE Standard-Knotenpools,
einschließlich Problemen bei der Erstellung von Knotenpools, der Bereitstellung nach bestem Bemühen,
beschädigten Instanzmetadaten und der Migration von Arbeitslasten zu neuen Knotenpools.
Informationen zum Diagnostizieren und Beheben des Knotenstatus NotReady
in GKE durch Fehlerbehebung bei häufigen Ursachen wie
Ressourcenmangel, Netzwerkproblemen und Komponentenausfällen.
Fehlerbehebung bei Problemen, die beim Hinzufügen von Knoten zu einem
GKE Standard-Cluster auftreten, z. B. Fehler bei der Knotenregistrierung
und fehlende Voraussetzungen für eine erfolgreiche Knotenregistrierung.
Fehlerbehebung bei Problemen mit Windows Server-Knotenpools in GKE,
einschließlich Pod-Startfehlern, Fehlern beim Abrufen von Images, Problemen mit der Netzwerkkonnektivität
Problemen und Problemen mit dem Knotenstatus.
Häufige Gründe dafür, dass der Cluster nicht ausgelastete Knoten nicht entfernt, diagnostizieren und beheben. Informationen zum Prüfen auf Probleme wie restriktive
PodDisruptionBudgets, Pods mit lokalem Speicher oder bestimmte Anmerkungen
(z. B. "cluster-autoscaler.kubernetes.io/safe-to-evict": "false")
die das Entfernen von Knoten verhindern.
Informationen dazu, warum der Cluster Autoscaler keine neuen Knoten hinzufügt, um die Nachfrage zu decken.
Prüfen Sie, ob Pods nicht geplant werden können, ob die Größenlimits für Cluster oder Knoten
pools erreicht wurden, und ermitteln Sie potenzielle Probleme mit Ressourcenkontingenten oder der regionalen VM
Verfügbarkeit.
Fehlerbehebung bei Problemen, bei denen der horizontale Pod-Autoscaler die Pod-Replikate der Anwendung nicht skaliert. Häufige Probleme beheben, z. B.
falsch konfigurierte HorizontalPodAutoscaler-Ressourcen oder Probleme mit der Messwert
pipeline.
Fehlerbehebung bei Problemen, bei denen der VerticalPodAutoscaler
die Pod-Ressourcen der Anwendung nicht skaliert. Häufige Probleme beheben, z. B.
falsch konfigurierte VerticalPodAutoscaler-Ressourcen oder Probleme mit der Messwert
pipeline.
Fehlerbehebung bei Speicherproblemen, einschließlich Problemen mit regionalen nichtflüchtigen Festplatten,
der Festplattenleistung und der Volume-Erweiterung.
Fehlerbehebung bei Dienstkonten, einschließlich des Wiederherstellens des Standarddienst
kontos und des Aktivierens des standardmäßigen Compute Engine-Dienstkontos.
Wenn der Ablauf der Stammzertifizierungsstelle (Certificate Authority, CA) Ihres Clusters bevorsteht, erfahren Sie
wie Sie eine Anmeldedatenrotation
durchführen, um zu verhindern, dass normale Clustervorgänge unterbrochen werden.
Fehlerbehebung bei Image-Abrufen. Informationen zu den Ursachen für Status wie
ImagePullBackOff und ErrImagePull
und wie Sie diese Status beheben können, indem Sie häufige Probleme wie
Authentifizierung und Netzwerkkonnektivität beheben.
Fehlerbehebung bei CrashLoopBackOff Ereignissen in
GKE. Probleme wie Ressourcenmangel, App
Fehlkonfigurationen und Fehler bei Liveness-Tests diagnostizieren.
Fehlerbehebung bei Kubernetes-Ereignissen aufgrund von unzureichendem Arbeitsspeicher (Out of Memory, OOM). Ursachen ermitteln,
Ereignistypen unterscheiden und effektive Lösungen für OOM-Kills auf Container-
und Knotenebene anwenden.
Fehlerbehebung bei TPUs, einschließlich Problemen mit Kontingenten, der automatischen Knotenbereitstellung
, der Arbeitslastkonfiguration und der Planung.
Fehlerbehebung bei Problemen mit GKE-Cluster- und Knoten
Upgrade, einschließlich langer oder unvollständiger Upgrades, unerwarteter
automatischer Upgrades, Fehlern und Problemen nach dem Upgrade.
Fehlerbehebung bei Problemen mit Namespaces, die im
Terminating Status festhängen, indem Sie die fehlerhaften
Komponenten, die das Löschen blockieren, identifizieren und entfernen.
Fehlerbehebung bei gleichzeitigen Vorgängen, indem Sie erfahren, wie Sie diese Fehler identifizieren
und beheben, indem Sie warten, bis die Vorgänge abgeschlossen sind.
Fehlerbehebung bei fehlenden GKE-Logs. Informationen zum Prüfen des API
Status, der Clustereinstellungen, Berechtigungen, Kontingente, Filter und des Anwendungs
verhaltens.
Fehlerbehebung bei einigen der 400-, 401-, 403- und 404-Fehler, die bei der Verwendung von GKE auftreten können. Diese Seite enthält auch
Informationen zur Fehlerbehebung bei
fehlenden Bearbeitungsberechtigungen für Kontofehler.
Bekannte Probleme identifizieren und beheben, die sich auf die Verwendung von GKE auswirken können.
Nächste Schritte
Wenn Sie in der Dokumentation keine Lösung für Ihr Problem finden, lesen Sie den Abschnitt
Support erhalten. Dort finden Sie Informationen zu folgenden Themen:
Support von der Community erhalten, indem Sie
Fragen auf Stack Overflow stellen
und mit dem google-kubernetes-engine Tag nach ähnlichen
Problemen suchen. Sie können auch dem
#kubernetes-engine Slack-Kanal
beitreten, um mehr Community-Support zu erhalten.
[[["Leicht verständlich","easyToUnderstand","thumb-up"],["Mein Problem wurde gelöst","solvedMyProblem","thumb-up"],["Sonstiges","otherUp","thumb-up"]],[["Schwer verständlich","hardToUnderstand","thumb-down"],["Informationen oder Beispielcode falsch","incorrectInformationOrSampleCode","thumb-down"],["Benötigte Informationen/Beispiele nicht gefunden","missingTheInformationSamplesINeed","thumb-down"],["Problem mit der Übersetzung","translationIssue","thumb-down"],["Sonstiges","otherDown","thumb-down"]],["Zuletzt aktualisiert: 2026-09-10 (UTC)."],[],[]]