Diagnostica dei problemi relativi ai cluster

La funzionalità di controllo di integrità monitora regolarmente l'integrità del piano di controllo del cluster e di diversi componenti critici e ti aiuta a rilevare e diagnosticare potenziali problemi con i cluster.

Se hai bisogno di ulteriore assistenza, contatta l'assistenza clienti Google Cloud.

Problemi rilevati

Il controllo di integrità del cluster rileva i seguenti problemi in un cluster e ti invia un avviso:

  • Integrità di kube-scheduler sui nodi del piano di controllo: se kube-scheduler non è integro, significa che il cluster ha difficoltà ad assegnare i pod ai nodi. Per ulteriori informazioni, puoi esaminare il log dei pod kube-scheduler.

  • Integrità del piano di controllo kube-controller-manager sui nodi: kube-controller-manager monitora vari controller, tra cui ReplicaSet, Deployment e Namespace. Se kube-controller-manager non è integro, significa che uno o più dei controller che gestisce potrebbero non funzionare correttamente. Per determinare il problema esatto, puoi esaminare il log dei pod kube-controller-manager, che potrebbe fornire ulteriori informazioni sui controller malfunzionanti.

  • Capacità del volume di root: il controllo di integrità verifica che la capacità del volume di root di ogni nodo del control plane sia sufficiente. Se la capacità disponibile scende sotto i 512 MB, il controllo di integrità ti avvisa del potenziale rischio di esaurimento dello spazio su disco.

Visualizzare gli eventi del controllo di integrità

Per visualizzare gli avvisi del controllo di integrità per un cluster specifico, esegui il seguente comando:

gcloud container aws clusters describe CLUSTER_NAME \
    --location GOOGLE_CLOUD_LOCATION

Sostituisci quanto segue:

  • CLUSTER_NAME: il nome del cluster
  • GOOGLE_CLOUD_LOCATION: il nome della Google Cloud località che gestisce il cluster

Ecco un estratto del tipo di output che puoi aspettarti:

{
  "name": "some-cluster-name",
  "description": "test-cluster",
  ...
  "errors": [
  {
    "message": "Replica (replica-name)": kube-controller-manager is unhealthy"
  },
  {
    "message": "Replica (replica-name)": not enough disk space on root volume, only 9 MB left"
  }
  ]
  ...
}

In questo esempio, il messaggio di errore indica che un componente kube-controller-manager non è integro e che la capacità del volume di root di un nodo del control plane sta diminuendo.

Passaggi successivi

Se hai bisogno di ulteriore assistenza, contatta l'assistenza clienti Google Cloud.