Gérer les événements d'erreur de service

Dans Error Reporting, vous pouvez surveiller et diagnostiquer les défaillances de la plate-forme dans les Google Cloud services qui enregistrent des messages d'erreur sans traces de pile, ce qui vous permet de résoudre rapidement les problèmes d'infrastructure.

Par exemple, si Cloud Run atteint sa limite maximale d'instances de conteneur lors d'une requête, l'échec est enregistré dans une entrée de journal. Error Reporting détecte cet événement, le regroupe avec des erreurs de service similaires et vous envoie une notification. Vous pouvez ensuite utiliser des liens directs dans la console pour ouvrir la documentation de dépannage spécifique au service et résoudre le goulot d'étranglement.

Afficher les groupes d'erreurs de service

Dans la Google Cloud console, accédez à la page Error Reporting :

Accéder à Error Reporting

Vous pouvez également accéder à cette page à l'aide de la barre de recherche.

Lorsque Error Reporting détecte une défaillance de service, il regroupe ces événements d'erreur et définit le type d'erreur sur Service error. La présentation d'Error Reporting affiche le type d'erreur ainsi que d'autres informations sur le groupe d'erreurs :

Page de présentation d'Error Reporting

Pour les événements d'erreur de service avec des solutions documentées, Error Reporting fournit un lien vers le guide de dépannage du Google Cloud service.

Exemples d'événements d'erreur de service

Le tableau suivant répertorie certains des événements d'erreur détectés par la fonctionnalité Erreurs de service d'Error Reporting, mais pas tous.

Google Cloud Nom du service Type d'erreur
Dataflow Limite du nombre de journaux de nœud de calcul
Mémoire insuffisante (système)
Sous-réseau personnalisé manquant
Opération de longueur à l'étape
Erreur de plantage de l'environnement d'exécution
Fichier JAR de nœud de calcul mal configuré
Cloud Run Limite de mémoire dépassée
Aucune instance disponible
Google Kubernetes Engine Pod non opérationnel, échec de la vérification
Échec de la planification des pods
Redémarrage du conteneur ayant échoué avec intervalle entre les tentatives
Volume désinstallé
Échec de l'extraction de l'image de conteneur
Échec de la mise à jour du point de terminaison
Secrets/ConfigMaps introuvables