Métricas de supervisión admitidas

En esta página, se enumeran las métricas disponibles para Memorystore para Redis Cluster y se describe lo que mide cada una.

Para obtener información sobre cómo ver estas métricas, consulta Supervisa clústeres.

Métricas de copias de seguridad

En esta sección, se enumeran y describen las métricas de copia de seguridad y de importación.

Métricas a nivel del clúster

En esta sección, se enumeran y describen las métricas de importación y copia de seguridad a nivel del clúster.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/backup/last_backup_start_time Esta métrica muestra la hora de inicio de la última operación de copia de seguridad.
redis.googleapis.com/cluster/backup/last_backup_status Esta métrica muestra si el intento de copia de seguridad más reciente se completó correctamente o falló. Los estados son 1 para Success y 0 para Failed.
redis.googleapis.com/cluster/backup/last_backup_duration Esta métrica muestra la duración de la última operación de copia de seguridad (en milisegundos).
redis.googleapis.com/cluster/backup/last_backup_size Esta métrica muestra el tamaño de la última copia de seguridad (en bytes). Esta métrica es un indicador clave para supervisar la eficiencia de las copias de seguridad y la planificación de la capacidad de almacenamiento.
redis.googleapis.com/cluster/import/last_import_start_time Esta métrica muestra la hora de inicio de la última operación de importación.
redis.googleapis.com/cluster/import/last_import_duration Esta métrica muestra la duración de la última operación de importación (en milisegundos).

Métricas de la autoridad certificadora (CA)

En esta sección, se enumeran las métricas asociadas con las autoridades certificadoras (CA) administradas por el cliente.

Métricas a nivel del clúster

Estas métricas proporcionan una descripción general de alto nivel de los certificados asociados a las máquinas de un clúster.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/security/rotate_tls_cert_count

Esta métrica muestra el estado de los certificados rotativos que están asociados con las máquinas de un clúster.

La métrica puede tener los siguientes estados:

  • SUCCESS: Memorystore for Redis Cluster rotó el certificado.
  • FAILED: Memorystore for Redis Cluster no rotó el certificado porque no está disponible, Memorystore for Redis Cluster no tiene permisos para rotar el certificado o hay un error interno.
  • SKIPPED: Memorystore for Redis Cluster omitió la rotación del certificado porque no es necesario rotarlo.

Métricas de Cloud Monitoring

En esta sección, se enumeran y describen las métricas de Cloud Monitoring que están disponibles para Memorystore para Redis Cluster.

Métricas a nivel del clúster

Estas métricas proporcionan una descripción general del estado y el rendimiento generales de un clúster. Puedes usar las métricas para comprender la capacidad y la utilización generales de un clúster, así como para identificar posibles cuellos de botella o áreas de mejora.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/clients/average_connected_clients Esta métrica mide la cantidad promedio de conexiones de clientes activas a un clúster durante un período especificado. Puedes usar la métrica para supervisar el ajuste de escala de las conexiones, identificar los cuellos de botella de la aplicación y garantizar que el clúster sea estable.
redis.googleapis.com/cluster/clients/maximum_connected_clients Esta métrica muestra la cantidad máxima de conexiones de clientes activas en todos los nodos de un clúster. Puedes usarla para supervisar la carga de conexión más alta en el clúster en cualquier momento. Esto es fundamental para garantizar un alto rendimiento del clúster, ya que una gran cantidad de conexiones puede aumentar los tiempos de respuesta.
redis.googleapis.com/cluster/clients/total_connected_clients Esta métrica hace un seguimiento de la cantidad actual de conexiones de cliente activas a un clúster. Puedes usar la métrica para supervisar la carga de tu base de datos y evitar los límites de conexión.
redis.googleapis.com/cluster/stats/total_connections_received_count Esta métrica muestra la cantidad acumulada de conexiones de clientes que se crean en un clúster en el último minuto. Puedes usar la métrica para analizar la carga de tráfico, asegurarte de que no se excedan los límites de conexión y determinar si necesitas escalar el clúster.
redis.googleapis.com/cluster/stats/total_rejected_connections_count Esta métrica hace un seguimiento de la cantidad total de conexiones a un clúster que se rechazan porque se alcanzó el límite de maxclients.
redis.googleapis.com/cluster/commandstats/total_usec_count Esta métrica mide el tiempo total de CPU que consume cada comando. La métrica indica los microsegundos totales utilizados, lo que proporciona estadísticas sobre el rendimiento y la latencia de un clúster.
redis.googleapis.com/cluster/commandstats/total_calls_count Esta métrica mide la cantidad total de llamadas asociadas a un comando específico en un nodo del clúster en un minuto. Para identificar cuellos de botella o tráfico alto en comandos específicos, puedes usar la métrica para supervisar la capacidad de procesamiento de los comandos (comandos por minuto) en los nodos principales y de réplica.
redis.googleapis.com/cluster/cpu/average_utilization Esta métrica muestra la utilización promedio de la CPU para un clúster (de 0.0 a 1.0). Puedes usarla para identificar recursos sobreaprovisionados o subutilizados, administrar los umbrales de ajuste automático y detectar cuellos de botella en el rendimiento, con una utilización ideal del 40% al 70%.
redis.googleapis.com/cluster/cpu/maximum_utilization

Esta métrica muestra el uso máximo de CPU en todos los nodos de un clúster (de 0.0 a 1.0).

La métrica solo resume los estados sys_main_thread y user_main_thread. No incluye otros estados de la CPU (como sys_children o user_children) que están disponibles en la métrica /cluster/node/cpu/utilization .

Asegúrate de que el uso de CPU no supere los 0.8 s para el nodo principal y los 0.5 s para cada réplica designada como réplica de lectura. Para obtener más información, consulta las prácticas recomendadas para el uso de la CPU.

redis.googleapis.com/cluster/stats/average_expired_keys Esta métrica mide la cantidad promedio de eventos de vencimiento de claves para todos los nodos principales de un clúster. Puedes usarla para supervisar la cantidad de claves que vencen.
redis.googleapis.com/cluster/stats/maximum_expired_keys Esta métrica mide la cantidad máxima de eventos de vencimiento de claves que se producen en todos los nodos principales de un clúster.
redis.googleapis.com/cluster/stats/total_expired_keys_count Esta métrica hace un seguimiento de la cantidad total de eventos de vencimiento de claves que se producen en todos los nodos principales de un clúster. Puedes usar la métrica para supervisar la cantidad de claves que vencen.
redis.googleapis.com/cluster/stats/average_evicted_keys Esta métrica hace un seguimiento de la cantidad media de claves que se expulsan debido a las restricciones de capacidad de memoria en los fragmentos principales de un clúster.
redis.googleapis.com/cluster/stats/maximum_evicted_keys Esta métrica muestra la mayor cantidad de claves que se expulsan de un nodo o fragmento de un clúster principal debido a la capacidad de memoria.
redis.googleapis.com/cluster/stats/total_evicted_keys_count Esta métrica muestra la cantidad total de claves que expulsa un nodo de un clúster principal debido a la capacidad de memoria.
redis.googleapis.com/cluster/keyspace/total_keys Esta métrica muestra la cantidad de claves que se almacenan en un clúster.
redis.googleapis.com/cluster/stats/average_keyspace_hits Esta métrica muestra la cantidad media de búsquedas exitosas de claves en todos los nodos de un clúster.
redis.googleapis.com/cluster/stats/maximum_keyspace_hits Esta métrica muestra la cantidad máxima de búsquedas exitosas de claves en un nodo del clúster. Puedes usar la métrica para supervisar el rendimiento del clúster y, además, identificar posibles puntos críticos en él.
redis.googleapis.com/cluster/stats/total_keyspace_hits_count Esta métrica hace un seguimiento de la cantidad acumulada de búsquedas exitosas de claves en todos los nodos de un clúster.
redis.googleapis.com/cluster/stats/average_keyspace_misses Esta métrica muestra la cantidad promedio de búsquedas fallidas de claves en un clúster. Puedes usarla para hacer un seguimiento de la frecuencia con la que se solicitan claves, pero no se encuentran en la caché.
redis.googleapis.com/cluster/stats/maximum_keyspace_misses Esta métrica muestra la cantidad máxima de búsquedas de claves con errores en un nodo del clúster.
redis.googleapis.com/cluster/stats/total_keyspace_misses_count Esta métrica muestra la cantidad total de búsquedas de claves fallidas en todos los nodos del clúster.
redis.googleapis.com/cluster/memory/average_utilization Esta métrica muestra el uso promedio de la memoria en un clúster (de 0.0 a 1.0). Puedes usar la métrica para supervisar la capacidad del clúster y establecer umbrales de alerta. Por ejemplo, puedes establecer un umbral de alerta para notificar a los usuarios cuando la memoria promedio supere un porcentaje específico (por ejemplo, el 80%).
redis.googleapis.com/cluster/memory/maximum_utilization Esta métrica muestra el uso máximo de memoria en todos los nodos del clúster (de 0.0 a 1.0). Puedes usar la métrica para identificar cuándo escalar un clúster. Te recomendamos que supervises el uso para asegurarte de que se mantenga por debajo del 100%. Con cargas de escritura altas, el rendimiento puede disminuir si esta métrica alcanza entre el 65% y el 85%.
redis.googleapis.com/cluster/memory/total_used_memory Esta métrica muestra el uso total de memoria de un clúster (en bytes). Puedes usar la métrica para supervisar la capacidad del clúster.
redis.googleapis.com/cluster/memory/size Esta métrica mide la RAM total, la RAM usada y la RAM disponible en todos los nodos de un clúster. Puedes usar la métrica para supervisar la capacidad del clúster y evitar fallas en los nodos.
redis.googleapis.com/cluster/replication/average_ack_lag Esta métrica muestra el rezago promedio de confirmación (en segundos) de las réplicas en un clúster.

El retraso en la confirmación es un cuello de botella en el nodo principal de un clúster. Este cuello de botella se debe a sus réplicas, que no pueden seguir el ritmo de la información que les envía el nodo principal. Cuando esto sucede, el nodo principal debe esperar la confirmación de que las réplicas recibieron la información. Esto podría ralentizar las confirmaciones de transacciones y afectar el rendimiento del nodo principal.
redis.googleapis.com/cluster/replication/maximum_ack_lag Esta métrica muestra el retraso máximo de confirmación (en segundos) de las réplicas en un clúster.
redis.googleapis.com/cluster/replication/average_offset_diff Esta métrica muestra la diferencia media del desplazamiento de confirmación de la replicación (en bytes) en un clúster.

La diferencia de compensación de confirmación de replicación indica la cantidad de bytes que no se replican entre las réplicas y sus clústeres principales.
redis.googleapis.com/cluster/replication/maximum_offset_diff Esta métrica muestra la diferencia máxima en el desfase de replicación (en bytes) en un clúster.

La diferencia de desfase de replicación indica la cantidad de bytes que no se replican entre las réplicas y sus clústeres principales.
redis.googleapis.com/cluster/stats/total_net_input_bytes_count Esta métrica muestra el recuento de bytes de red entrantes que reciben los extremos de un clúster.
redis.googleapis.com/cluster/stats/total_net_output_bytes_count Esta métrica muestra el recuento de bytes de red salientes que envían los extremos de un clúster.

Métricas a nivel del nodo

Estas métricas ofrecen estadísticas detalladas sobre el estado y el rendimiento de los nodos individuales dentro de un clúster. Puedes usar las métricas para solucionar problemas con los nodos y optimizar su rendimiento.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/node/clients/connected_clients Esta métrica indica la cantidad de conexiones de clientes activas a un nodo del clúster, sin incluir las conexiones de réplica. Puedes usar la métrica para supervisar los límites de conexión y para identificar los puntos de acceso en los que un fragmento recibe tráfico desproporcionado.
redis.googleapis.com/cluster/node/clients/blocked_clients Esta métrica muestra la cantidad de conexiones de clientes que bloquea un nodo del clúster. Una cantidad alta o en rápido aumento de conexiones de cliente bloqueadas podría indicar que muchos clientes están esperando operaciones. Esto puede generar una mayor latencia.
redis.googleapis.com/cluster/node/server/uptime Esta métrica mide el tiempo de actividad de un nodo del clúster. Puedes usar la métrica para hacer un seguimiento de cuánto tiempo se ejecuta un servidor de forma continua sin reiniciarse ni fallar.
redis.googleapis.com/cluster/node/stats/connections_received_count Esta métrica hace un seguimiento de la cantidad total de conexiones de clientes que se crean en un nodo del clúster dentro de un período especificado. Puedes usar la métrica para supervisar el tráfico de conexión a nodos individuales dentro de un clúster. Como resultado, puedes analizar la distribución de la carga e identificar picos en la actividad de conexión.
redis.googleapis.com/cluster/node/stats/rejected_connections_count Esta métrica muestra la cantidad de conexiones que se rechazan porque un nodo del clúster alcanza el límite de maxclients. Puedes usar la métrica para identificar si un nodo está bajo presión de conexión alta y rechaza nuevas conexiones porque no puede controlar más.
redis.googleapis.com/cluster/node/commandstats/usec_count Esta métrica muestra el tiempo total que consume cada comando en un nodo del clúster. Puedes usar la métrica para analizar el rendimiento de los comandos, identificar los comandos lentos y solucionar problemas de latencia a nivel del nodo.
redis.googleapis.com/cluster/node/commandstats/calls_count Esta métrica hace un seguimiento de la cantidad total de llamadas para un comando en un nodo de clúster por minuto. Puedes usar la métrica para supervisar la distribución del tráfico, identificar los comandos que se usan con frecuencia y solucionar los cuellos de botella en nodos individuales.
redis.googleapis.com/cluster/node/cpu/utilization Esta métrica muestra el uso de CPU para un nodo del clúster (de 0.0 a 1.0).
redis.googleapis.com/cluster/node/stats/expired_keys_count Esta métrica muestra la cantidad total de eventos de vencimiento en un nodo del clúster. Puedes usar la métrica para supervisar la frecuencia con la que se quitan claves del clúster porque su tiempo de actividad (TTL) llega a cero.
redis.googleapis.com/cluster/node/stats/evicted_keys_count Esta métrica cuenta la cantidad total de claves que expulsa un nodo del clúster porque el clúster alcanza su límite máximo de memoria. La métrica puede identificar si un clúster está bajo presión de memoria. Los recuentos altos o en aumento de claves expulsadas indican que un clúster se está quedando sin espacio. Como resultado, el clúster quita claves para dejar espacio para datos nuevos.
redis.googleapis.com/cluster/node/keyspace/total_keys Esta métrica mide la cantidad total de claves que almacena un nodo del clúster. La métrica proporciona visibilidad sobre la distribución y el sharding de datos en los nodos.
redis.googleapis.com/cluster/node/stats/keyspace_hits_count Esta métrica hace un seguimiento de la cantidad de búsquedas de claves exitosas en un nodo del clúster. Puedes usar la métrica para supervisar la eficiencia con la que el nodo recupera los datos en la memoria.
redis.googleapis.com/cluster/node/stats/keyspace_misses_count Esta métrica hace un seguimiento de la cantidad de búsquedas de claves con errores en un nodo del clúster.
redis.googleapis.com/cluster/node/memory/utilization Esta métrica hace un seguimiento del uso de memoria en un nodo del clúster (de 0.0 a 1.0). Puedes usar la métrica para evitar fallas en los nodos y garantizar la estabilidad de un clúster.
redis.googleapis.com/cluster/node/memory/usage Esta métrica mide el uso total de memoria de un nodo del clúster.
redis.googleapis.com/cluster/node/stats/net_input_bytes_count Esta métrica mide la cantidad total de bytes de red entrantes que recibe un nodo del clúster. Puedes usar la métrica para supervisar la capacidad de procesamiento de la red, identificar posibles cuellos de botella y analizar los aumentos repentinos de tráfico en el nodo.
redis.googleapis.com/cluster/node/stats/net_output_bytes_count Esta métrica mide la cantidad total de bytes de red salientes que envía un nodo del clúster. Puedes usar la métrica para supervisar el volumen de salida de red del nodo con fines de ajuste del rendimiento y planificación de la capacidad.
redis.googleapis.com/cluster/node/replication/offset Esta métrica mide los bytes de desfase de replicación de un nodo del clúster. Antes de promover las réplicas de un clúster a clústeres principales, puedes usar la métrica para verificar si las réplicas procesaron todos los datos. Esto evita la pérdida de datos.
redis.googleapis.com/cluster/node/server/healthy Esta métrica determina si un nodo del clúster está disponible y funciona correctamente.
redis.googleapis.com/cluster/node/stats/evicted_clients_count Esta métrica hace un seguimiento de la cantidad total de clientes que desconecta Memorystore for Redis Cluster porque la memoria agregada que consumen todos los búferes de clientes supera un umbral de memoria predefinido. Puedes usar la métrica como mecanismo de protección para evitar que el uso descontrolado de la memoria por parte de los clientes agote la memoria del servidor y provoque fallas.
redis.googleapis.com/cluster/node/clients/tracking_clients Esta métrica hace un seguimiento de la cantidad de clientes de Redis activos que están registrados para recibir mensajes de seguimiento y de invalidación del servidor. Puedes usar la métrica para supervisar y depurar las implementaciones de almacenamiento en caché del cliente, y asegurarte de que el seguimiento del servidor funcione según lo esperado.
redis.googleapis.com/cluster/node/clients/maxclients Esta métrica muestra la cantidad máxima de conexiones simultáneas de clientes que permite Memorystore for Redis Cluster en un nodo del clúster.
redis.googleapis.com/cluster/node/clients/recent_max_input_buffer Esta métrica informa el tamaño del búfer de memoria más grande (en bytes) que se usa para procesar un solo comando entrante del cliente entre todas las conexiones activas. Puedes usar la métrica para hacer un seguimiento de la estabilidad de la conexión y evitar el uso excesivo de memoria. Si el tamaño del búfer de entrada de un cliente específico alcanza los límites de forma constante, esto puede provocar interrupciones en la red o conexiones interrumpidas en todo el clúster.
redis.googleapis.com/cluster/node/clients/recent_max_output_buffer Esta métrica mide la lista de salida más larga (en bytes) entre las conexiones de cliente conectadas más recientemente a un servidor. La métrica es un indicador vital del estado del servidor, ya que identifica a los clientes que solicitan grandes cantidades de datos más rápido de lo que el servidor puede enviárselos.
redis.googleapis.com/cluster/node/commandstats/rejected_calls_count La métrica muestra la cantidad de comandos (llamadas) de Redis que rechaza un servidor antes de que se ejecuten. Estas llamadas se activan por condiciones previas, como tener errores de sintaxis en el comando o ejecutar comandos con restricciones de memoria cuando la instancia se queda sin memoria (OOM).
redis.googleapis.com/cluster/node/commandstats/failed_calls_count Esta métrica hace un seguimiento de la cantidad de operaciones fallidas en un nodo del clúster. Puedes usar la métrica para evaluar si tu aplicación cliente pasa parámetros incorrectos o no está sincronizada con el esquema de tu conjunto de datos. Además, puedes diagnosticar si un aumento en las fallas se correlaciona con la degradación del comando.
redis.googleapis.com/cluster/node/keyspace/keys_with_expiration Esta métrica hace un seguimiento de la cantidad de claves activas en un clúster que tienen un tiempo de vida (TTL) o una marca de tiempo de vencimiento establecidos. Puedes usar la métrica para supervisar los límites de almacenamiento en caché, el uso de memoria y la administración de sesiones.
redis.googleapis.com/cluster/node/memory/dataset_usage Esta métrica mide la cantidad de memoria que consumen los conjuntos de datos o los objetos de datos principales en un nodo del clúster.
redis.googleapis.com/cluster/node/memory/mem_not_counted_for_evict

Esta métrica muestra la cantidad de memoria que excluye un servidor cuando evalúa la memoria que necesita para la expulsión de claves.

Cuando Memorystore para Redis Cluster calcula si necesita desalojar claves, compara su memoria total asignada (used_memory) con el límite de maxmemory configurado. Sin embargo, el valor de mem_not_counted_for_evict se resta de esta ecuación.

redis.googleapis.com/cluster/node/memory/number_of_cached_scripts Esta métrica hace un seguimiento de la cantidad total de secuencias de comandos EVAL que un servidor almacena en caché en un nodo del clúster. Puedes usar la métrica para supervisar la sobrecarga asociada con las secuencias de comandos de Lua en el clúster.
redis.googleapis.com/cluster/node/memory/number_of_functions Esta métrica hace un seguimiento de la cantidad total de funciones definidas en un nodo del clúster.
redis.googleapis.com/cluster/node/memory/lua_usage Esta métrica hace un seguimiento de la cantidad de bytes que Lua usa para las secuencias de comandos de EVAL en un nodo del clúster.
redis.googleapis.com/cluster/node/memory/replica_clients_usage

Esta métrica hace un seguimiento de la cantidad de memoria (en bytes) que consumen los clientes de réplicas en un nodo del clúster. La métrica mide la memoria que usan los clientes de réplica.

Debido a que los búferes de réplica comparten memoria con el backlog de replicación, la métrica puede informar un valor de 0 cuando las réplicas no activan un aumento en el uso de memoria más allá de lo que se asigna para el backlog.

redis.googleapis.com/cluster/node/memory/normal_clients_usage Esta métrica hace un seguimiento de la cantidad de memoria (en bytes) que los clientes que no son de réplica usan en un nodo del clúster. La métrica mide el consumo de memoria de las conexiones de clientes que no son réplicas.
redis.googleapis.com/cluster/node/memory/peak_usage Esta métrica hace un seguimiento de la memoria máxima que consume Memorystore for Redis Cluster en un nodo del clúster. La métrica mide la cantidad máxima de memoria (en bytes) que usa Memorystore para Redis Cluster desde su último inicio.
redis.googleapis.com/cluster/node/memory/rss_usage

Esta métrica hace un seguimiento del uso del tamaño del conjunto residente (RSS) de Memorystore para Redis Cluster en un nodo del clúster. La métrica representa la cantidad de bytes que asigna Memorystore para Redis Cluster.

Es fundamental supervisar el uso de RSS, ya que refleja el uso real de la RAM física, por lo que puede detectar una alta fragmentación de la memoria. Por ejemplo, si el RSS se acerca al límite del contenedor del clúster, esto puede generar problemas de OOM.

redis.googleapis.com/cluster/node/memory/scripts_usage Esta métrica hace un seguimiento de la sobrecarga de memoria asociada con las secuencias de comandos en un nodo del clúster. La métrica mide la cantidad de bytes de sobrecarga de memoria que usa la función EVAL. Esta memoria se considera parte del used_memory general del clúster.
redis.googleapis.com/cluster/node/memory/maxmemory_policy Esta métrica hace un seguimiento de la configuración de la política de expulsión para un nodo del clúster. La métrica informa el parámetro de configuración maxmemory-policy actual del nodo, que determina cómo Memorystore para Redis Cluster selecciona las claves para el desalojo cuando alcanza el límite de maxmemory.
redis.googleapis.com/cluster/node/persistence/aof_enabled Esta métrica indica si la persistencia de archivos de solo anexar (AOF) está habilitada en un nodo del clúster.
redis.googleapis.com/cluster/node/persistence/async_loading Este parámetro indica si Memorystore para Redis Cluster carga un conjunto de datos de replicación de forma asíncrona mientras entrega datos existentes. La métrica hace un seguimiento del estado en el que Memorystore for Redis Cluster carga el conjunto de datos. Esto ocurre cuando la configuración de repl-diskless-load está habilitada y establecida en swapdb.
redis.googleapis.com/cluster/node/persistence/loading Este parámetro indica si Memorystore for Redis Cluster carga un archivo de volcado en un nodo del clúster. Puedes usarlo para evaluar si Memorystore for Redis Cluster carga datos desde un almacén persistente, como una instantánea de la base de datos de Redis (RDB) o un archivo AOF.
redis.googleapis.com/cluster/node/persistence/current_cow_peak

Esta métrica hace un seguimiento del uso máximo de memoria asociado con las operaciones de copia en escritura (COW) durante un proceso de bifurcación secundaria en un nodo del clúster. La métrica mide el tamaño máximo (en bytes) de la memoria de COW mientras se ejecuta una bifurcación secundaria. Esto ocurre durante las operaciones que implican la bifurcación del proceso, como la creación de una instantánea de RDB o la realización de una reescritura de AOF.

Supervisar el tamaño máximo de COW es importante para la planificación de la capacidad y para evitar problemas de OOM, ya que el uso de memoria total del nodo aumenta durante el proceso de bifurcación en la cantidad de datos que se modifican mientras la bifurcación está activa.

redis.googleapis.com/cluster/node/persistence/current_cow_size

Esta métrica hace un seguimiento del tamaño actual de la memoria de COW mientras un proceso secundario de bifurcación está activo en un nodo del clúster. La métrica mide el tamaño (en bytes) de la memoria que se copia durante un proceso de bifurcación, como la creación de una instantánea de RDB o la realización de una reescritura de AOF.

Puedes usar la métrica para supervisar la sobrecarga de memoria en tiempo real de una bifurcación en curso.

redis.googleapis.com/cluster/node/persistence/rdb_last_bgsave_time_sec

Esta métrica hace un seguimiento de la duración de la operación de guardado en segundo plano más reciente (BGSAVE) para una RDB en un nodo del clúster. La métrica mide cuánto tiempo (en segundos) tardó en completarse la última operación de guardar el archivo .rdb.

Puedes usar la métrica para supervisar el impacto en el rendimiento de las operaciones de persistencia, en especial durante los eventos de mantenimiento o de expansión.

redis.googleapis.com/cluster/node/persistence/rdb_last_cow_size

Esta métrica hace un seguimiento del tamaño de la memoria de COW durante la operación de guardado de RDB más reciente en un nodo del clúster. La métrica mide la cantidad de memoria (en bytes) que se copia mientras se crea la última instantánea de RDB en segundo plano.

Puedes usar la métrica para depurar posibles problemas con las sincronizaciones completas durante las actualizaciones de mantenimiento o configuración, ya que proporciona estadísticas sobre la sobrecarga de memoria del proceso de persistencia.

redis.googleapis.com/cluster/node/persistence/current_fork_percentage Esta métrica hace un seguimiento del progreso del proceso de bifurcación actual en un nodo del clúster. La métrica indica el porcentaje de finalización de las operaciones de bifurcación activas, como las que se usan para las instantáneas de RDB o las reescrituras de AOF.
redis.googleapis.com/cluster/node/persistence/aof_rewrite_in_progress Esta métrica proporciona un estado en tiempo real (1 para verdadero y 0 para falso) sobre si Memorystore for Redis Cluster realiza una reescritura de AOF en un nodo del clúster. Puedes usar la métrica para determinar si las operaciones de AOF en segundo plano contribuyen a aumentos notables en la latencia o el uso de memoria. Las operaciones de reescritura pueden provocar picos de carga transitorios.
redis.googleapis.com/cluster/node/persistence/aof_last_cow_size

Esta métrica hace un seguimiento del tamaño de la memoria de COW que se usa durante la operación de reescritura de AOF más reciente en un nodo del clúster. La métrica mide la cantidad de memoria (en bytes) que copia Memorystore for Redis Cluster mientras realiza la última reescritura de AOF en segundo plano.

Puedes usar la métrica para supervisar el tamaño de la memoria de COW durante las operaciones de persistencia. Esto es fundamental para la planificación de la capacidad, ya que el uso total de memoria del nodo aumenta durante el proceso de bifurcación en la cantidad de datos que se modifican mientras la bifurcación está activa. Si no administras la memoria de COW, es posible que experimentes problemas de OOM en el clúster.

redis.googleapis.com/cluster/node/persistence/aof_last_rewrite_time_sec Esta métrica mide cuánto tiempo (en segundos) tarda en completarse la operación de reescritura del AOF en segundo plano más reciente en un nodo del clúster. Puedes usar la métrica para evaluar el impacto en el rendimiento de la persistencia de AOF en segundo plano y comprender la duración de los picos de carga transitorios que causan las operaciones de reescritura.
redis.googleapis.com/cluster/node/errorstats/errors_count Esta métrica proporciona una vista detallada de los errores que se derivan de la sección ERRORSTATS de las estadísticas internas de Memorystore para Redis Cluster. La métrica mide el cambio en los recuentos de errores durante un intervalo.
redis.googleapis.com/cluster/node/stats/acl_access_denied_auths_count Esta métrica informa la cantidad total de errores de autenticación por denegación de acceso a la lista de control de acceso (LCA) durante un intervalo.
redis.googleapis.com/cluster/node/stats/expire_cycle_cpu_millisecond_count Esta métrica mide la cantidad acumulada de tiempo de CPU dedicado a los ciclos de vencimiento activos durante un intervalo.
redis.googleapis.com/cluster/node/stats/expired_keys_percentage Esta métrica muestra el porcentaje estimado de claves vencidas en un momento determinado. La métrica proporciona estadísticas sobre el proceso de vencimiento. Si el porcentaje es constantemente alto, es posible que Memorystore para Redis Cluster no asigne suficientes ciclos de CPU en segundo plano para mantener el ritmo de vencimiento de las claves.
redis.googleapis.com/cluster/node/stats/expired_time_cap_reached_count Esta métrica mide el recuento acumulativo de ciclos que alcanzan el límite de tiempo durante un intervalo. Un valor alto o en aumento para la métrica suele correlacionarse con un uso elevado de memoria por parte de las claves vencidas. Para mantener la integridad del conjunto de datos, es posible que se necesiten más ciclos de CPU en segundo plano.
redis.googleapis.com/cluster/node/stats/pubsub_channels Esta métrica muestra la cantidad global de canales de Pub/Sub que tienen suscripciones de clientes.
redis.googleapis.com/cluster/node/stats/pubsub_patterns Esta métrica muestra la cantidad global de patrones de Pub/Sub que tienen suscripciones de clientes.
redis.googleapis.com/cluster/node/stats/pubsubshard_channels Esta métrica muestra la cantidad global de canales de fragmentos de Pub/Sub que tienen suscripciones de clientes.
redis.googleapis.com/cluster/node/stats/total_fork_count

Esta métrica mide el cambio en la cantidad total de bifurcaciones durante un intervalo. La métrica es un indicador clave de la actividad en segundo plano de Memorystore for Redis Cluster.

Puedes usar la métrica para supervisar la frecuencia de bifurcación para la planificación de la capacidad, ya que cada proceso de bifurcación involucra memoria COW. La memoria COW aumenta el espacio en memoria general de un nodo del clúster.

redis.googleapis.com/cluster/node/stats/tracking_total_keys Esta métrica muestra la cantidad de claves que rastrea Memorystore para Redis Cluster. La métrica es un componente de la función de seguimiento del servidor, que permite a los clientes mantener una caché local que se invalida cuando cambian las claves en Memorystore for Redis Cluster.
redis.googleapis.com/cluster/node/stats/tracking_total_items Esta métrica muestra la cantidad total de elementos que rastrea Memorystore para Redis Cluster. La métrica representa la suma de todos los clientes que observan cada clave.
redis.googleapis.com/cluster/node/stats/tracking_total_prefixes Esta métrica muestra la cantidad de prefijos que se rastrean en la tabla prefix de Memorystore para Redis Cluster.
redis.googleapis.com/cluster/node/stats/latest_fork_usec Esta métrica muestra la duración de la operación de bifurcación más reciente (en microsegundos).
redis.googleapis.com/cluster/node/replication/primary_sync_in_progress

Esta métrica muestra si un clúster principal se está sincronizando con una réplica. Un valor de 1 indica que la sincronización está en curso, mientras que un valor de 0 significa que el clúster no se está sincronizando con la réplica.

Puedes usar la métrica para solucionar problemas de coherencia de los datos y comprender el progreso de los eventos de mantenimiento o de expansión.

redis.googleapis.com/cluster/node/replication/sync_partial_ok_count Esta métrica mide la cantidad de intentos de resincronización parcial correctos.
redis.googleapis.com/cluster/node/replication/sync_partial_err_count

Esta métrica mide la cantidad de intentos fallidos de resincronización parcial.

Puedes usar la métrica como indicador del estado de la replicación. Cuando falla una resincronización parcial, la réplica debe realizar una resincronización completa. Esto implica crear una instantánea de la RDB en el clúster principal y transferir todo el conjunto de datos a través de la red.

redis.googleapis.com/cluster/node/replication/sync_full_count

Esta métrica mide el cambio en la cantidad de resincronizaciones completas que un clúster principal tiene con una réplica. Se produce una resincronización completa cuando falla una resincronización parcial. Esto sucede cuando la acumulación de replicación en el clúster principal no es lo suficientemente grande como para contener los datos que la réplica perdió durante una desconexión.

Puedes usar la métrica para diagnosticar problemas de capacidad y estado de la replicación del clúster.

redis.googleapis.com/cluster/node/memory/maxmemory

Esta métrica refleja el parámetro de configuración maxmemory para un nodo del clúster, que es la cantidad máxima de memoria que puede consumir Memorystore para Redis Cluster. Este parámetro determina cuándo Memorystore para Redis Cluster comienza a desalojar claves, según el parámetro de configuración establecido para maxmemory-policy.

Puedes usar la métrica para la planificación de la capacidad y la solución de problemas de OOM, ya que define el límite superior del uso de memoria para el almacenamiento de datos y la sobrecarga del servidor.

Para obtener más información sobre la configuración de maxmemory y maxmemory-policy, consulta Parámetros de configuración modificables.

Métricas de replicación entre regiones

En esta sección, se enumeran y describen las métricas de la replicación entre regiones.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/cross_cluster_replication/secondary_replication_links Esta métrica muestra la cantidad de vínculos de fragmentos entre los clústeres primario y secundario. Dentro de un grupo de replicación entre regiones, un clúster principal informa la cantidad de vínculos de replicación de CRR que tiene con los clústeres secundarios del grupo. Para cada clúster secundario, se espera que este número sea igual a la cantidad de fragmentos. Si, de forma inesperada, la cantidad disminuye por debajo de la cantidad de fragmentos, esto identifica la cantidad de fragmentos en los que cesó la replicación entre el replicador y el seguidor. En un estado ideal, esta métrica debería tener el mismo número que el recuento de fragmentos del clúster principal.
redis.googleapis.com/cluster/cross_cluster_replication/secondary_maximum_replication_offset_diff Esta métrica mide la diferencia máxima de desfase de replicación (en bytes) entre las particiones principales y secundarias (réplicas) de un clúster en diferentes regiones.
redis.googleapis.com/cluster/cross_cluster_replication/secondary_average_replication_offset_diff Esta métrica mide la diferencia promedio de la compensación de replicación (en bytes) entre los fragmentos principales y de réplica de un clúster en diferentes regiones. Los valores altos de la métrica indican un retraso en la replicación, que puedes resolver pausando y, luego, reanudando la replicación.

Métricas de JSON

En esta sección, se enumeran las métricas a nivel del nodo para los documentos JSON.

Métricas a nivel del nodo

Estas métricas ofrecen estadísticas detalladas sobre la cantidad total de documentos JSON y la cantidad de memoria que consumen estos documentos.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/node/json/documents_count Esta métrica mide la cantidad total de documentos JSON que se encuentran en un nodo del clúster. Puedes usar la métrica para hacer un seguimiento de la distribución y la capacidad de los datos, ya que muestra cuántos documentos se indexan, borran o combinan a nivel del nodo.
redis.googleapis.com/cluster/node/json/used_memory Esta métrica mide la cantidad de memoria (en bytes o como porcentaje de la memoria disponible) que consumen los documentos JSON. Puedes usar la métrica para supervisar la capacidad, identificar los nodos vinculados a la memoria y activar acciones de ajuste de escala.

Métricas de persistencia

En esta sección, se enumeran y describen las métricas de persistencia.

Métricas de persistencia de RDB

En esta sección, se enumeran y describen las métricas de persistencia de RDB.

Métricas a nivel del clúster

En esta sección, se enumeran y describen las métricas de persistencia de RDB a nivel del clúster.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/persistence/rdb_saves_count

Esta métrica hace un seguimiento de la cantidad acumulada de veces que se toma una instantánea de persistencia de RDB (también conocida como guardado de RDB) en un nodo del clúster. Puedes usar la métrica para supervisar la frecuencia y el éxito de las instantáneas de RDB por nodo.

La métrica tiene un campo status_code. Para verificar si falla una instantánea de RDB, filtra el campo status_code para el estado 3 - INTERNAL_ERROR.

redis.googleapis.com/cluster/persistence/rdb_save_ages Esta métrica muestra la antigüedad de la instantánea de distribución para todos los nodos de un clúster. En el caso de un incidente de recuperación, puedes usar la métrica para ver el período de obsolescencia de los datos. Idealmente, la distribución tiene valores con un tiempo de rezago menor (o igual) que la frecuencia de tus instantáneas.

Métricas a nivel del nodo

Nombre de la métrica Descripción
redis.googleapis.com/cluster/node/persistence/rdb_bgsave_in_progress Esta métrica indica si una operación de guardado en segundo plano de RDB (BGSAVE) está activa en un nodo del clúster. Un estado TRUE significa que el BGSAVE está activo.
redis.googleapis.com/cluster/node/persistence/rdb_last_bgsave_status Este parámetro indica si la operación BGSAVE en un nodo del clúster se completó o si se produjo un error. El estado TRUE significa que la operación se completó.
redis.googleapis.com/cluster/node/persistence/rdb_saves_count Esta métrica hace un seguimiento de la cantidad acumulada de instantáneas de RDB que se crean en un nodo del clúster. Puedes usar la métrica para supervisar la frecuencia y el éxito de las instantáneas en el nodo.
redis.googleapis.com/cluster/node/persistence/rdb_last_save_age Esta métrica mide el tiempo, en segundos, que transcurrió desde la última instantánea de RDB correcta. Puedes usar la métrica para supervisar la obsolescencia de los datos de persistencia de RDB en un nodo del clúster.
redis.googleapis.com/cluster/node/persistence/rdb_next_save_time_until Esta métrica mide el tiempo restante, en segundos, hasta que se programe la próxima instantánea de RDB en un nodo del clúster. Puedes usar la métrica para supervisar el programa de persistencia de la RDB y hacer un seguimiento de cuándo se tomará la próxima instantánea automática.
redis.googleapis.com/cluster/node/persistence/current_save_keys_total Esta métrica hace un seguimiento de la cantidad total de claves que se procesan en la operación de guardado de RDB actual en un nodo del clúster.

Métricas de persistencia del AOF

En esta sección, se enumeran y describen las métricas de persistencia de AOF.

Métricas a nivel del clúster

En esta sección, se enumeran y describen las métricas de persistencia del AOF a nivel del clúster.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/persistence/aof_fsync_lags

Esta métrica mide la diferencia de tiempo (o rezago) para todos los nodos de un clúster que pasa entre la escritura de datos en el AOF y el momento en que esos datos se sincronizan correctamente con el almacenamiento duradero.

Cuando el parámetro appendfsync se establece en everysec, puedes usar la métrica para evaluar el estado de la persistencia del clúster. Lo ideal es que la distribución del rezago tenga valores con menos tiempo de rezago (o el mismo tiempo) que la frecuencia de sincronización del AOF.

redis.googleapis.com/cluster/persistence/aof_rewrite_count

Esta métrica hace un seguimiento de la cantidad acumulada de veces que un nodo del clúster activa una operación de reescritura del AOF. Puedes usar la métrica para diagnosticar problemas de rendimiento, ya que una alta frecuencia de reescrituras de AOF puede causar picos de latencia o presión de memoria en el clúster.

La métrica tiene un campo status_code. Para verificar si fallan las reescrituras de AOF, filtra este campo según el estado 3 - INTERNAL_ERROR.

Métricas a nivel del nodo

En esta sección, se enumeran y describen las métricas de persistencia del AOF a nivel del nodo.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/node/persistence/aof_last_write_status Esta métrica muestra el estado de la última operación de escritura en el archivo AOF en un nodo del clúster. Si el estado es TRUE, la operación de escritura se realizó correctamente. Puedes usar la métrica para verificar que Memorystore for Redis Cluster conserve los datos correctamente.
redis.googleapis.com/cluster/node/persistence/aof_last_bgrewrite_status Esta métrica muestra el estado de la última operación de AOF bgrewrite en un nodo del clúster. Si el estado es TRUE, la operación se realizó correctamente.
redis.googleapis.com/cluster/node/persistence/aof_fsync_lag

Esta métrica mide la diferencia de tiempo (o el retraso) de un nodo de clúster que pasa entre la escritura de datos en el AOF y el momento en que esos datos se sincronizan correctamente con el almacenamiento duradero.

Cuando el parámetro appendfsync se establece en everysec, puedes usar la métrica para evaluar el estado de la persistencia del nodo. Si el proceso de sincronización de datos tarda más de 1 segundo, la persistencia se rezaga con respecto a los datos entrantes, lo que puede provocar una degradación del rendimiento o pérdida de datos en caso de falla.

redis.googleapis.com/cluster/node/persistence/aof_rewrites_count

Esta métrica hace un seguimiento de la cantidad acumulada de veces que un nodo del clúster activa una operación de reescritura del AOF. Puedes usar la métrica para diagnosticar problemas de rendimiento. Las frecuencias altas de reescrituras del AOF pueden generar una mayor latencia o presión de memoria en el clúster.

La métrica tiene un campo status_code. Para verificar si fallan las reescrituras de AOF, filtra este campo según el estado 3 - INTERNAL_ERROR.

redis.googleapis.com/cluster/node/persistence/aof_fsync_errors_count Esta métrica hace un seguimiento de la cantidad acumulativa de veces que falla la llamada al sistema fsync() de AOF en un nodo del clúster. La métrica solo se aplica a los clústeres habilitados para AOF en los que el parámetro appendfsync está configurado como everysec o always.

Métricas de persistencia comunes

En esta sección, se enumeran y describen las métricas que se aplican a la persistencia de AOF y RDB.

Métricas a nivel del nodo

En esta sección, se enumeran y describen las métricas de persistencia de AOF y RDB a nivel del nodo.

Nombre de la métrica Descripción
redis.googleapis.com/cluster/node/persistence/auto_restore_count

Esta métrica hace un seguimiento de la cantidad acumulada de veces que un nodo del clúster se restablece automáticamente a partir de un archivo de volcado de persistencia (AOF o RDB).

La métrica tiene un campo status_code. Para verificar si las restauraciones fallan, filtra este campo según el estado 3 - INTERNAL_ERROR.

Ejemplos de casos de uso para las métricas de persistencia

En esta sección, se describen ejemplos de casos de uso para las métricas de persistencia de AOF y RDB.

Verifica si las operaciones de escritura de AOF causan latencia y presión en la memoria

Supongamos que detectas un aumento en la latencia o el uso de memoria en un clúster o en un nodo dentro del clúster. Si esto sucede, verifica si el uso adicional está relacionado con la persistencia de AOF.

Las operaciones de reescritura del AOF pueden provocar picos de carga transitorios. Te recomendamos que inspecciones la métrica aof_rewrites_count, ya que esta te proporciona el recuento acumulativo de las reescrituras del AOF durante la vida útil del clúster o del nodo del clúster.

Supongamos que esta métrica muestra que los incrementos en el recuento de reescrituras corresponden a aumentos en la latencia. Para reducir la frecuencia de las reescrituras, disminuye la tasa de escritura o aumenta el recuento de fragmentos.

Verifica si las operaciones de guardado de RDB causan latencia y presión en la memoria

Supongamos que detectas un aumento en la latencia o el uso de memoria en un clúster o en un nodo dentro del clúster. Si esto ocurre, verifica si el uso adicional está relacionado con la persistencia de la RDB.

Las operaciones de guardado de RDB pueden generar picos de carga transitorios. Te recomendamos que inspecciones la métrica rdb_saves_count, ya que te proporciona el recuento acumulativo de las copias de seguridad de RDB durante la vida útil del clúster o el nodo del clúster.

Supongamos que esta métrica muestra que los incrementos en el recuento de guardados de la RDB corresponden a aumentos de latencia. Para reducir la frecuencia de los guardados de RDB, aumenta el intervalo de instantáneas de RDB. Además, para reducir los niveles de carga de referencia, escala horizontalmente el clúster.

Interpreta las métricas de Memorystore for Redis Cluster

Muchas métricas pertenecen a las siguientes categorías: promedio, máximo y total.

Proporcionamos variaciones del promedio y el máximo de la misma métrica para que puedas usar ambas métricas y, así, identificar los puntos críticos de esa familia de métricas.

El valor total de la métrica es independiente de las variaciones promedio y máximo de la métrica. Este valor proporciona estadísticas que son independientes y no están relacionadas con el propósito de las variaciones para los puntos de interés.

Comprende las métricas de promedio y máximo

Supongamos que comparas los valores de las métricas average_keyspace_hits y maximum_keyspace_hits para un clúster. A medida que crece la diferencia entre las dos métricas, una mayor diferencia indica más hotspots para los clics en el clúster. Un valor cercano entre las métricas indica que los hits se distribuyen de manera más uniforme entre los nodos del clúster.

Este principio se aplica a todas las métricas que tienen las variaciones de promedio y máximo de la misma métrica.

Ejemplo de hotspot

Si comparas los valores de las métricas average_keyspace_hits y maximum_keyspace_hits para todos los fragmentos de un clúster, puedes determinar en qué fragmentos se producen los puntos calientes. Por ejemplo, supongamos que los fragmentos de un clúster de seis fragmentos tienen la siguiente cantidad de hits:

  • Fragmento 1: De 2 a 3 golpes
  • Fragmento 2: 2 hits
  • Fragmento 3: 2 hits
  • Fragmento 4: 2 hits
  • Fragmento 5: 2 hits
  • Fragmento de 6 a 8 hits

En este ejemplo, la métrica average_keyspace_hits devuelve un valor de 3, pero la métrica maximum_keyspace_hits devuelve un valor de 8. Los hits no se distribuyen de manera uniforme entre los fragmentos del clúster. El fragmento 6 es un hotspot porque controla una cantidad de tráfico desproporcionadamente alta.