Gérer les événements d'erreur de service

Error Reporting vous permet de surveiller et de diagnostiquer les échecs de plate-forme dans les services Google Cloud qui enregistrent les messages d'erreur sans traces de pile. Par exemple, si Cloud Run atteint sa limite maximale d'instances de conteneur, Error Reporting regroupe l'événement de journal, envoie des notifications et fournit des liens directs vers la documentation de dépannage spécifique au service.

Afficher les groupes d'erreurs de service

Dans la console Google Cloud , accédez à la page Error Reporting :

Accéder à Error Reporting

Vous pouvez également accéder à cette page à l'aide de la barre de recherche.

Lorsque Error Reporting détermine qu'une défaillance de service s'est produite, il regroupe ces événements d'erreur et définit le type d'erreur sur Service error. La présentation d'Error Reporting affiche le type d'erreur ainsi que d'autres informations sur le groupe d'erreurs :

Page de présentation d'Error Reporting

Pour les événements d'erreur de service avec des solutions documentées, Error Reporting fournit un lien vers le guide de dépannage du service Google Cloud .

Exemples d'événements d'erreur de service

Le tableau suivant liste certains des événements d'erreur capturés par la fonctionnalité "Erreurs de service" dans Error Reporting.

Nom du serviceGoogle Cloud Type d'erreur
Dataflow Limitation des journaux de nœuds de calcul
Mémoire insuffisante (système)
Sous-réseau personnalisé manquant
Opération longue dans l'étape
Crash du JRE
Fichier JAR du nœud de calcul mal configuré
Cloud Run Limite de mémoire dépassée
Aucune instance disponible
Google Kubernetes Engine Pod non opérationnel, vérification ayant échoué
Échec de l'ordonnancement des pods
Redémarrage du conteneur ayant échoué avec intervalle entre les tentatives
Volume non désinstallé
Échec de la récupération de l'image de conteneur
Échec de la mise à jour du point de terminaison
Secrets/ConfigMaps introuvables