La funzionalità di controllo di integrità monitora regolarmente l'integrità del piano di controllo del cluster e di diversi componenti critici e ti aiuta a rilevare e diagnosticare potenziali problemi con i cluster.
Se hai bisogno di ulteriore assistenza, contatta l'assistenza clienti Google Cloud.Problemi rilevati
Il controllo di integrità del cluster rileva i seguenti problemi in un cluster e ti invia un avviso:
Integrità di
kube-schedulersui nodi del piano di controllo: sekube-schedulernon è integro, significa che il cluster ha difficoltà ad assegnare i pod ai nodi. Per ulteriori informazioni, puoi esaminare il log dei podkube-scheduler.Integrità del piano di controllo
kube-controller-managersui nodi:kube-controller-managermonitora vari controller, tra cui ReplicaSet, Deployment e Namespace. Sekube-controller-managernon è integro, significa che uno o più dei controller che gestisce potrebbero non funzionare correttamente. Per determinare il problema esatto, puoi esaminare il log dei podkube-controller-manager, che potrebbe fornire ulteriori informazioni sui controller malfunzionanti.Capacità del volume di root: il controllo di integrità verifica che la capacità del volume di root di ogni nodo del control plane sia sufficiente. Se la capacità disponibile scende sotto i 512 MB, il controllo di integrità ti avvisa del potenziale rischio di esaurimento dello spazio su disco.
Visualizzare gli eventi del controllo di integrità
Per visualizzare gli avvisi del controllo di integrità per un cluster specifico, esegui il seguente comando:
gcloud container aws clusters describe CLUSTER_NAME \
--location GOOGLE_CLOUD_LOCATION
Sostituisci quanto segue:
CLUSTER_NAME: il nome del clusterGOOGLE_CLOUD_LOCATION: il nome della Google Cloud località che gestisce il cluster
Ecco un estratto del tipo di output che puoi aspettarti:
{
"name": "some-cluster-name",
"description": "test-cluster",
...
"errors": [
{
"message": "Replica (replica-name)": kube-controller-manager is unhealthy"
},
{
"message": "Replica (replica-name)": not enough disk space on root volume, only 9 MB left"
}
]
...
}
In questo esempio, il messaggio di errore indica che un componente kube-controller-manager non è integro e che la capacità del volume di root di un nodo del control plane sta diminuendo.