Métricas de supervisión admitidas

En esta página, se enumeran las métricas disponibles para Memorystore para Redis y se describe lo que mide cada una.

Para aprender a ver estas métricas, consulta Supervisa instancias.

Métricas de Cloud Monitoring

En esta sección, se enumeran y describen las métricas de Cloud Monitoring que están disponibles para Memorystore para Redis.

Nombre de la métrica Descripción
redis.googleapis.com/keyspace/avg_ttl Esta métrica mide el tiempo de actividad (TTL) promedio, en milisegundos, de todas las claves de una base de datos de Redis que tienen un vencimiento establecido. Puedes usar la métrica para comprender el ciclo de vida de tus datos almacenados en caché y determinar si las claves vencen antes o después de lo esperado en tus instancias.
redis.googleapis.com/clients/blocked

Esta métrica hace un seguimiento de la cantidad de conexiones de cliente que esperan que los datos estén disponibles porque se están ejecutando comandos de bloqueo en una instancia. Estos comandos de bloqueo incluyen BLPOP, BRPOP y BRPOPLPUSH. Una gran cantidad de clientes bloqueados puede indicar que tu aplicación está esperando que se propaguen ciertos eventos o claves.

Puedes supervisar esta métrica para comprender el comportamiento de tu aplicación, en especial si observas aumentos inesperados en la latencia que podrían estar relacionados con clientes que esperan operaciones de bloqueo.

redis.googleapis.com/replication/master/slaves/lag

Esta métrica mide la cantidad de segundos que una réplica se retrasa con respecto a una instancia principal. Memorystore para Redis calcula el valor de la métrica tomando la hora actual y restándole la hora en la que la réplica confirma que recibió el mensaje de los bytes entrantes.

Puedes usar la métrica para identificar si una réplica se retrasa con respecto a la instancia principal.

redis.googleapis.com/replication/offset_diff

Esta métrica hace un seguimiento de la cantidad de bytes que no se replican en una réplica. La métrica representa la diferencia entre la compensación de bytes de replicación de una instancia principal y la compensación de bytes de replicación de la réplica. Si no hay diferencias entre estos desplazamientos, la réplica está completamente sincronizada con la instancia principal.

A medida que la instancia principal replica los datos en la réplica durante un proceso de conmutación por error, es posible que notes un aumento en estos bytes pendientes.

redis.googleapis.com/stats/cache_hit_ratio

Esta métrica representa la proporción de llamadas correctas a bases de datos de Redis y llamadas fallidas. Una llamada se realiza de forma correcta cuando la base de datos de Redis muestra el valor que solicitó el emisor.

Una proporción de caché a aciertos más alta significa que la caché se utiliza más por completo. Esto es beneficioso para el rendimiento de tu aplicación.

redis.googleapis.com/commands/calls

Esta métrica mide la cantidad de comandos de Redis que se ejecutan cada minuto en una instancia principal. Estos incluyen todos los comandos de Redis de código abierto, como SET , GET y HSET . La métrica no cuenta los comandos de Memorystore para Redis, como create o update.

redis.googleapis.com/clients/connected Esta métrica muestra la cantidad de clientes conectados a una instancia. Puedes supervisar la métrica para identificar la carga en la instancia. Si la cantidad de clientes conectados se acerca al límite de maxclients, es posible que el servidor rechace los nuevos intentos de conexión.
redis.googleapis.com/stats/cpu_utilization

Esta métrica mide el tiempo de uso de la CPU por minuto que utiliza el servidor de Redis. Este tiempo se desglosa por el espacio del sistema y del usuario, y las relaciones entre elementos superiores y secundarios.

El valor de los segundos de CPU muestra el total de segundos de CPU para todos los subprocesos del proceso principal del servidor de Redis. Si solo quieres ver el uso de CPU del subproceso principal, consulta la métrica Main Thread CPU Seconds (cpu_utilization_main_thread).

El uso elevado de CPU es una causa común del aumento de la latencia en las instancias de Redis, ya que puede provocar demoras en el procesamiento de comandos. Si supervisas esta métrica, puedes identificar si una carga alta de numerosos clientes genera el uso de la CPU.

redis.googleapis.com/stats/evicted_keys

Esta métrica muestra la cantidad de claves que Memorystore para Redis expulsa de una instancia porque esta alcanza el límite de maxmemory.

Si supervisas esta métrica, puedes determinar si el tamaño de la memoria de la instancia es suficiente para tu carga de trabajo. Si los datos a los que se accede con frecuencia se quitan de la caché, las expulsiones de claves pueden afectar el rendimiento de tu aplicación.

redis.googleapis.com/keyspace/keys_with_expiration Esta métrica hace un seguimiento de la cantidad de claves en una instancia que tienen un vencimiento configurado. Si ninguna clave tiene una fecha de vencimiento, en el gráfico de la métrica se mostrará el mensaje "Sin datos".
redis.googleapis.com/keyspace/keys Esta métrica muestra la cantidad total de claves almacenadas en una base de datos. Si no se almacenan claves, en el gráfico de la métrica se muestra el mensaje "Sin datos".
redis.googleapis.com/stats/cpu_utilization_main_thread Esta métrica mide los segundos de CPU que usa el subproceso principal del servidor de Redis. Esta medición se desglosa por el espacio del sistema y del usuario, y la relación entre elementos superiores y secundarios. Puedes supervisar la métrica para identificar los picos de uso de la CPU que se producen en el subproceso principal.
redis.googleapis.com/stats/memory/maxmemory Esta métrica representa la cantidad máxima de memoria (maxmemory) que pueden usar las claves en una instancia. Una vez que se alcanza este límite, Memorystore para Redis expulsa las claves de la instancia. Este proceso de expulsión se produce de acuerdo con la política de expulsión configurada para la instancia.
redis.googleapis.com/stats/memory/usage_ratio Esta métrica muestra el uso de memoria actual de una instancia, expresado como una proporción de su límite de memoria máximo. Puedes supervisar la métrica para determinar qué tan cerca está la instancia de su capacidad. Según la configuración de la instancia, alcanzar este límite activa el proceso de expulsión de claves.
redis.googleapis.com/stats/keyspace_misses

Esta métrica hace un seguimiento de la cantidad de búsquedas de claves con errores en el diccionario principal. La métrica se incrementa cada vez que un cliente intenta acceder a una clave que no existe en la base de datos.

La métrica se usa para calcular la proporción de aciertos de caché, que mide la eficacia con la que tu aplicación usa la caché. Una gran cantidad de errores de espacio de claves a menudo indica que la aplicación solicita datos que no están presentes en la caché. Si la aplicación tiene que recuperar esos datos de un almacén de datos de backend más lento, esto puede generar una mayor latencia.

redis.googleapis.com/replication/role

Esta métrica devuelve un valor que identifica el rol de un nodo en un grupo de replicación. Un valor de 1 indica que el nodo es principal, mientras que un valor de 0 indica que el nodo es una réplica.

Puedes usar la métrica para supervisar el estado de los nodos, en especial durante los eventos de conmutación por error en los que los roles pueden cambiar. Además, puedes hacer un seguimiento del estado y la topología de las instancias de nivel Estándar, que admiten alta disponibilidad a través de la replicación.

redis.googleapis.com/persistence/rdb/bgsave_in_progress

Esta métrica devuelve un valor que identifica si una operación de guardado en segundo plano (BGSAVE) de la base de datos de Redis (RDB) está activa. Un valor de 1 indica que hay una copia de seguridad en segundo plano de la RDB activa; un valor de 0 significa que no se está ejecutando ninguna copia de seguridad en segundo plano.

Puedes usar la métrica para hacer un seguimiento de las instantáneas de RDB automatizadas o las exportaciones manuales. Además, si supervisas la métrica, puedes correlacionar los picos transitorios en el uso de la memoria o la latencia con las tareas de persistencia en curso.

redis.googleapis.com/stats/pubsub/channels Esta métrica hace un seguimiento de la cantidad global de canales de Pub/Sub que tienen suscripciones de clientes activas en una instancia. La métrica mide el recuento total de canales únicos a los que se suscriben los clientes con los comandos SUBSCRIBE o PSUBSCRIBE.
redis.googleapis.com/stats/pubsub/patterns Esta métrica hace un seguimiento de la cantidad global de patrones de Pub/Sub que tienen suscripciones de clientes activas en una instancia. La métrica mide el recuento total de patrones únicos a los que se suscriben los clientes. Por lo general, los clientes crean estas suscripciones con el comando PSUBSCRIBE.
redis.googleapis.com/stats/reject_connections_count

Esta métrica hace un seguimiento de la cantidad de intentos de conexión que rechaza una instancia por los siguientes motivos:

  • Límite de maxclients: El servidor alcanza la cantidad máxima permitida de conexiones simultáneas de clientes.
  • Presión en la memoria: La instancia rechaza conexiones nuevas debido a un uso elevado de la memoria.
  • Una conexión TLS no válida: Una instancia en la que se habilitó la encriptación en tránsito tiene problemas relacionados con TLS.

Si supervisas la métrica, podrás identificar problemas de capacidad. Si aumenta la cantidad de conexiones rechazadas, es posible que debas escalar la instancia para que pueda controlar más conexiones o aumentar su capacidad de memoria. Además, cuando se aplica la encriptación, puedes usar la métrica para depurar problemas de conexión del cliente.

redis.googleapis.com/replication/master_repl_offset Esta métrica representa la cantidad total de bytes que una instancia principal produce y envía a una réplica. Si restas la compensación de bytes de replicación de la réplica de esta compensación, puedes calcular el tamaño del retraso de replicación. Cuando no hay diferencias entre estos valores de desplazamiento, la réplica está completamente sincronizada con la instancia principal.
redis.googleapis.com/replication/master/slaves/offset Esta métrica indica la cantidad total de bytes que una réplica recibe de una instancia principal. Si restas esta compensación de la compensación de bytes de replicación de la instancia principal, puedes calcular el tamaño del retraso de replicación. Cuando no hay diferencias entre estos valores de desplazamiento, la réplica está completamente sincronizada con la instancia principal.
redis.googleapis.com/stats/memory/system_memory_usage_ratio Esta métrica representa la cantidad de memoria en uso, expresada como una proporción de la memoria total disponible para el sistema. La memoria total disponible del sistema es la que aprovisionas para una instancia, además de la memoria adicional que proporciona Memorystore para Redis para administrar los procesos de sobrecarga.
redis.googleapis.com/stats/memory/system_memory_overload_duration

Esta métrica mide la cantidad total de tiempo (en microsegundos) en que una instancia está en modo de sobrecarga de memoria del sistema.

Puedes usar la métrica para hacer un seguimiento de los períodos en los que el uso de memoria de la instancia supera los umbrales operativos seguros para el sistema. Los valores persistentes en la métrica pueden indicar que la instancia corre el riesgo de degradación o inestabilidad del rendimiento debido a que no hay suficiente memoria para los procesos de sobrecarga.

redis.googleapis.com/commands/usec_per_call

Esta métrica representa el tiempo promedio dedicado a cada llamada de comando de Redis durante más de un minuto. Este tiempo se mide en microsegundos.

La métrica se desglosa por comandos individuales. Esto te permite supervisar el rendimiento de operaciones específicas, como GET, SET y HSET.

También puedes usar la métrica para medir la latencia de la instancia. Si comparas el tiempo por llamada en diferentes puntos, puedes identificar cambios en el rendimiento y analizar las causas de una discrepancia en la latencia.

redis.googleapis.com/stats/connections/total Esta métrica representa la cantidad total de conexiones que acepta el servidor.
redis.googleapis.com/commands/total_time Esta métrica mide la cantidad total de tiempo, en microsegundos, que se dedica a cada comando de Redis de código abierto (como SET, GET o HSET) durante el último segundo. Por ejemplo, si el comando SET usa 800,000 microsegundos, significa que el 80% de un solo núcleo de CPU tarda en procesar todas las instancias de ese comando combinadas.
redis.googleapis.com/stats/network_traffic Esta métrica representa la cantidad total de bytes que se envían a Redis o desde Redis. Este recuento incluye los bytes de los comandos, los datos de carga útil y los delimitadores.
redis.googleapis.com/server/uptime Esta métrica indica el tiempo de actividad del proceso del servidor de Redis en ejecución.
redis.googleapis.com/stats/memory/usage Esta métrica representa la cantidad total de bytes que asigna el proceso del servidor de Redis.

Métricas de detalles de la instancia

En esta sección, se enumeran y describen las métricas disponibles para una instancia en la página Detalles de la instancia de la consola de Google Cloud .

Nombre de la métrica Descripción
Bytes con replicación pendiente

Esta métrica muestra la cantidad de datos que se escriben en un nodo principal, pero que no se copian en un nodo de réplica. Representa la diferencia entre la compensación de bytes de replicación de la instancia principal y la compensación de la réplica.

Un valor de cero para la métrica indica que la réplica está completamente sincronizada con la instancia principal. Por lo general, se produce un valor alto durante los períodos de alta actividad de escritura o durante un proceso de conmutación por error, ya que se están sincronizando los datos.

Tasa de aciertos de caché

Esta métrica muestra la proporción de llamadas correctas a la base de datos de Redis (aciertos) en relación con la cantidad total de llamadas (aciertos más errores). La métrica representa la eficacia con la que tu aplicación usa la caché.

Una proporción más alta de caché a aciertos indica que se satisfacen más solicitudes directamente desde la caché. Esto es beneficioso para el rendimiento de tu aplicación, ya que reduce la latencia.

Una proporción baja o en descenso suele indicar que tu aplicación solicita datos que no están presentes en la caché. Es posible que debas aumentar el tamaño de la instancia o ajustar la lógica de población de datos.

Llamadas

Esta métrica muestra la cantidad de comandos de Redis que se ejecutan en una instancia principal cada minuto. La métrica cuenta todos los comandos de Redis de código abierto, como SET, GET y HSET. Sin embargo, la métrica no incluye los comandos específicos de Memorystore para Redis, como create o update.

Puedes usar la métrica para medir y analizar la latencia de la instancia. Si comparas el volumen de llamadas con el tiempo que se dedica a ellas, puedes identificar cambios en el rendimiento y analizar qué podría causar picos de latencia.

Clientes conectados y clientes bloqueados

Esta métrica muestra la siguiente información:

  • Clientes conectados: Es la cantidad total de clientes conectados a una instancia. Puedes usar esta información para identificar la carga general de la instancia. Si la cantidad de clientes conectados se acerca al límite de maxclients, es posible que el servidor comience a rechazar los nuevos intentos de conexión.

    El seguimiento de la cantidad de clientes conectados te ayuda a determinar si te acercas a los límites de conexión que requieren escalamiento o agrupación de conexiones.

  • Clientes bloqueados: Es la cantidad de conexiones de clientes que esperan datos porque ejecutan comandos de bloqueo, como BLPOP, BRPOP y BRPOPLPUSH.

    Una gran cantidad de clientes bloqueados puede indicar que tu aplicación espera eventos específicos o que se propaguen claves. Esto puede manifestarse como una mayor latencia en tu aplicación.

Segundos de CPU

Esta métrica muestra el tiempo total de uso de la CPU (en segundos) que una instancia utiliza durante un período específico.

Si supervisas esta métrica, puedes determinar si la instancia tiene un uso de CPU elevado. Esta es una causa frecuente del aumento de la latencia, ya que el uso elevado de CPU puede retrasar el procesamiento de comandos. También puedes usar la métrica para determinar si un uso elevado de la CPU se debe a una gran cantidad de clientes.

Claves expulsadas y claves vencidas

Esta métrica muestra la siguiente información:

  • Claves expulsadas: Es la cantidad de claves que Memorystore para Redis quita (expulsa) de una instancia porque esta alcanza su límite máximo de memoria (maxmemory).
  • Claves vencidas: Es la cantidad de claves que alcanzan su límite de vencimiento y se borran.
Tiempo de actividad de la instancia

Esta métrica indica la cantidad total de tiempo que el proceso del servidor de Redis se ejecuta de forma continua. Si una instancia se reinicia debido a una conmutación por error, un mantenimiento o una falla inesperada, el valor de la métrica se reduce a cero y, luego, vuelve a aumentar a partir de la nueva hora de inicio.

Puedes usar la métrica para identificar y correlacionar interrupciones inesperadas del servicio, eventos de conmutación por error o períodos de mantenimiento con otros cambios en el rendimiento.

Claves en la base de datos

Esta métrica muestra la cantidad total de claves que se almacenan en cada base de datos de Redis dentro de una instancia. La métrica hace un seguimiento de todas las claves que residen en las bases de datos, independientemente de si tienen una fecha de vencimiento establecida. Si no se almacenan claves en las bases de datos, se muestra "sin datos" en el gráfico de la métrica, en lugar de un valor cero.

Puedes supervisar la métrica para verificar que la instancia reciba tráfico y almacene datos. Una caída repentina en la métrica puede indicar pérdida de datos, desalojo masivo o reinicio de la instancia.

Uso de memoria / Cantidad máx. de memoria Esta métrica muestra el uso de memoria de una instancia en comparación con su límite de memoria máxima (maxmemory). Este límite representa la cantidad máxima de memoria que pueden usar las claves en la instancia. Una vez que se alcanza el límite, Memorystore para Redis comienza a expulsar claves de acuerdo con la política de expulsión configurada para la instancia.
Bytes de entrada y salida de la red

Esta métrica muestra la cantidad de bytes que una instancia envía y recibe durante un período determinado. Este tráfico de red incluye datos de comandos, datos de carga útil y delimitadores.

Puedes usar la métrica para comprender la carga de red de tu aplicación, identificar cuellos de botella en el ancho de banda y correlacionar los picos de red con los cambios en la latencia o el rendimiento de tu aplicación.

Conexiones recibidas y rechazadas Esta métrica muestra los intentos de conexión de red exitosos (recibidos) y los intentos de conexión rechazados durante un período determinado. Puedes usar la métrica para comprender tu tasa de conexiones entrantes, detectar tormentas de conexiones y diagnosticar problemas de capacidad o conectividad del cliente.

Métricas de instantáneas de RDB

En esta sección, se enumeran y describen las métricas que te ayudan a administrar las instantáneas de RDB para Memorystore para Redis.

Métricas de supervisión de instantáneas

En esta sección, se enumeran y describen las métricas de supervisión de instantáneas de Memorystore para Redis.

Nombre de la métrica Descripción
redis.googleapis.com/rdb/enabled Esta métrica indica si el modo de instantánea de RDB está habilitado para una instancia.
redis.googleapis.com/rdb/snapshot/time_until_next_run Esta métrica indica la cantidad de segundos hasta que comienza a ejecutarse la siguiente instantánea programada.

Métricas de estado de las instantáneas

En esta sección, se enumeran y describen las métricas de estado de las instantáneas de Memorystore para Redis.

Nombre de la métrica Descripción
redis.googleapis.com/rdb/snapshot/in_progress Esta métrica indica si hay una instantánea de RDB en curso. Si el valor de la métrica es true, se está tomando la instantánea.
redis.googleapis.com/rdb/snapshot/elapsed_time Esta métrica mide la cantidad de tiempo que transcurre mientras se crea la instantánea actual.
redis.googleapis.com/rdb/snapshot/attempt_count Esta métrica indica la cantidad de intentos de instantáneas que se realizan cada minuto.
redis.googleapis.com/rdb/snapshot/last_status Esta métrica indica el estado del intento de instantánea más reciente.
redis.googleapis.com/rdb/snapshot/last_success_duration Esta métrica indica el tiempo total necesario para escribir la última instantánea correcta. Este tiempo no incluye los intentos fallidos.
redis.googleapis.com/rdb/snapshot/last_success_age Esta métrica indica el tiempo que transcurre desde el inicio de la última instantánea correcta.

Métricas de recuperación de instantáneas

En esta sección, se enumeran y describen las métricas de recuperación de instantáneas para Memorystore para Redis.

Nombre de la métrica Descripción
redis.googleapis.com/rdb/recovery/in_progress Esta métrica indica si se realiza una recuperación a partir de una instantánea de RDB. Si el valor de esta métrica es true, significa que se está realizando una recuperación.
redis.googleapis.com/rdb/recovery/elapsed_time Esta métrica indica el tiempo cada vez mayor que transcurre durante una recuperación en curso a partir de una instantánea de RDB.
redis.googleapis.com/rdb/recovery/estimated_recovery_time Esta métrica indica el tiempo esperado que se tarda en recuperar los datos cuando se usa la última instantánea de RDB sin errores.
redis.googleapis.com/rdb/recovery/estimated_remaining_time Esta métrica indica el tiempo restante que se necesita para finalizar una recuperación a partir de una instantánea de RDB.
redis.googleapis.com/rdb/recovery/attempts_since_last_success Esta métrica indica la cantidad de intentos de recuperación desde el último intento de recuperación exitoso a partir de una instantánea de RDB.
redis.googleapis.com/rdb/recovery/last_status Esta métrica indica el estado de la recuperación más reciente a partir de una instantánea de RDB.
redis.googleapis.com/rdb/recovery/last_duration Esta métrica indica el tiempo que lleva restablecer la última instantánea de RDB.
redis.googleapis.com/rdb/recovery/total_bytes_count Esta métrica indica el tamaño de una instantánea de RDB.
redis.googleapis.com/rdb/recovery/loaded_bytes_count Esta métrica indica la cantidad de bytes que se cargan durante la recuperación de una instantánea de RDB. Si la recuperación no está activa, la cantidad de bytes es 0.