Questo documento elenca i documenti per la risoluzione dei problemi comuni che potresti riscontrare durante l'utilizzo di Google Kubernetes Engine (GKE). Che tu stia diagnosticando errori di workload come ImagePullBackOff e CrashLoopBackOff, eseguendo il debug del comportamento di scalabilità automatica del cluster, risolvendo problemi di PersistentVolume o risolvendo i problemi di registrazione dei nodi, i documenti elencati qui possono aiutarti.
Questo documento è destinato ad amministratori e architetti, specialisti della sicurezza, specialisti di Networking o specialisti di archiviazione che risolvono i problemi di configurazione di GKE. Per saperne di più sui ruoli GKE,
consulta
Ruoli e attività utente GKE comuni.
Diagnostica e risolvi i problemi dei cluster GKE Autopilot, inclusi la creazione di cluster, l'eliminazione di spazi dei nomi, la scalabilità e i problemi dei workload.
Risolvi i problemi dello strumento a riga di comando kubectl in
GKE, inclusi i problemi di autenticazione e autorizzazione.
Questa pagina include anche consigli su come
risolvere i problemi del proxy Konnectivity
per verificare se causa l'interruzione della risposta dei comandi kubectl logs, attach,
exec, o port-forward.
Risolvi i problemi dei node pool GKE Standard,
inclusi i problemi relativi alla creazione di pool di nodi, al provisioning best-effort,
ai metadati delle istanze danneggiati e alla migrazione dei workload a nuovi node pool.
Scopri come diagnosticare e risolvere lo stato NotReady
del nodo in GKE risolvendo le cause comuni, come
carenze di risorse, problemi di rete ed errori dei componenti.
Risolvi i problemi che si verificano quando aggiungi nodi al tuo
cluster GKE Standard, come errori di registrazione dei nodi
e prerequisiti mancanti per la registrazione dei nodi.
Risolvi i problemi relativi ai node pool Windows Server in GKE,
inclusi errori di avvio dei pod, errori di pull delle immagini, problemi di connettività di rete
e problemi di stato dei nodi.
Diagnostica e risolvi i motivi comuni per cui il cluster non rimuove i nodi sottoutilizzati. Scopri come verificare la presenza di problemi come restrittivi
PodDisruptionBudgets, pod con spazio di archiviazione locale o annotazioni specifiche
(ad esempio, "cluster-autoscaler.kubernetes.io/safe-to-evict": "false")
che impediscono l'espulsione dei nodi.
Scopri perché il gestore della scalabilità automatica del cluster non aggiunge nuovi nodi per soddisfare la domanda.
Verifica la presenza di pod non pianificabili, assicurati di non aver raggiunto i limiti di dimensioni del cluster o del node
pool e identifica potenziali problemi di quota di risorse o di disponibilità delle VM
availability issues.
Risolvi i problemi relativi al Horizontal Pod Autoscaler che non scala
le repliche dei pod dell'applicazione. Risolvi i problemi comuni, come
risorse HorizontalPodAutoscaler configurate in modo errato o problemi con la pipeline delle metriche
Risolvi i problemi relativi al gestore della scalabilità automatica pod verticale che non scala
le risorse dei pod dell'applicazione. Risolvi i problemi comuni, come
risorse VerticalPodAutoscaler configurate in modo errato o problemi con la pipeline delle metriche.
Risolvi i problemi relativi ai service account, inclusi il ripristino del service account predefinito e l'abilitazione del account di servizio predefinito di Compute Engine.
Se l'autorità di certificazione (CA) radice del cluster scadrà a breve, scopri
come eseguire una rotazione delle credenziali
per evitare l'interruzione delle normali operazioni del cluster.
Risolvi i problemi relativi al pull delle immagini. Scopri le cause di stati come
ImagePullBackOff e ErrImagePull
e come risolverli correggendo problemi comuni come
l'autenticazione e la connettività di rete.
Risolvi i problemi relativi agli0/eventi in101GKE.CrashLoopBackOff Diagnostica problemi come l'esaurimento delle risorse, le configurazioni errate delle app
e gli errori del probe di attività.
Risolvi i problemi relativi agli eventi Out Of Memory (OOM) di Kubernetes. Identifica le cause,
distingui i tipi di eventi e applica soluzioni efficaci per gli OOM kill a livello di container
e di nodo.
Risolvi i problemi relativi alle TPU, inclusi i problemi relativi a quota, provisioning automatico dei nodi
, configurazione dei workload e pianificazione.
Risolvi i problemi relativi alle GPU, inclusi i problemi relativi all'installazione dei driver GPU,
errori dei plug-in dei dispositivi e immagini container.
Risolvi i problemi relativi all'upgrade dei cluster e dei nodi GKE
inclusi upgrade lunghi o incompleti, upgrade automatici imprevisti
errori e problemi post-upgrade.
Risolvi i problemi relativi agli spazi dei nomi bloccati nello
Terminating stato identificando e rimuovendo i componenti non integri
che bloccano l'eliminazione.
Risolvi i problemi relativi alle operazioni simultanee imparando a identificare
questi errori e a risolverli attendendo il completamento delle operazioni.
Risolvi i problemi relativi alle dashboard di monitoraggio, inclusi i problemi relativi all'abilitazione
monitoraggio, alle risorse Kubernetes mancanti e alle autorizzazioni.
Risolvi i problemi relativi ai log GKE mancanti. Scopri come controllare lo stato dell'API
lo stato, le impostazioni del cluster, le autorizzazioni, le quote, i filtri e il comportamento dell'applicazione
il comportamento.
Risolvi alcuni degli errori 400, 401, 403 e 404 che potresti
riscontrare durante l'utilizzo di GKE. Questa pagina include anche
informazioni su come risolvere i problemi relativi alle
autorizzazioni di modifica mancanti negli errori dell'account.
Identifica e risolvi i problemi noti che potrebbero influire sul tuo utilizzo di GKE.
Passaggi successivi
Se non riesci a trovare una soluzione al tuo problema nella documentazione, consulta
Richiedere assistenza per ulteriore assistenza,
inclusi consigli sui seguenti argomenti:
Richiedere assistenza alla community ponendo
domande su Stack Overflow
e utilizzando il tag google-kubernetes-engine per cercare problemi simili. Puoi anche unirti al
#kubernetes-engine canale Slack
per ulteriore assistenza della community.
[[["Facile da capire","easyToUnderstand","thumb-up"],["Il problema è stato risolto","solvedMyProblem","thumb-up"],["Altra","otherUp","thumb-up"]],[["Difficile da capire","hardToUnderstand","thumb-down"],["Informazioni o codice di esempio errati","incorrectInformationOrSampleCode","thumb-down"],["Mancano le informazioni o gli esempi di cui ho bisogno","missingTheInformationSamplesINeed","thumb-down"],["Problema di traduzione","translationIssue","thumb-down"],["Altra","otherDown","thumb-down"]],["Ultimo aggiornamento 2026-09-10 UTC."],[],[]]