Alertas de umbral

Puede definir IBM Cloud Monitoring Alertas de umbral (anteriormente denominadas Alertas de métrica) en el editor de alertas mediante un formulario o PromQL.

Para obtener más información sobre la configuración de alertas, consulte Configuración de una alerta utilizando el editor de alertas.

Especificación de las condiciones de activación de una alerta de umbral

En el editor de alertas, especifique lo siguiente en la sección Métrica y condiciones.

Ámbito
La alerta se establece para que se aplique de forma predeterminada a la Infraestructura completa del ámbito del equipo. Sin embargo, puede restringir el ámbito de alerta filtrando por etiquetas específicas, como container_name o kube_namespace_name.
Métrica
Seleccione la métrica que desea supervisar y configure cómo desea que se agreguen los datos. A continuación, puede elegir el método de agregación que mejor se adapte a sus necesidades. Por ejemplo, si desea comprender la latencia media en todo el clúster, puede utilizar la agregación promedio. De forma alternativa, si desea identificar nodos con la latencia más alta, puede utilizar la agregación máxima.
Agrupar por segmento
Al agrupar las métricas por etiquetas como container_name, se genera un segmento exclusivo para cada contenedor. Esto le permite detectar rápidamente si un contenedor determinado es responsable de la desengrasación del rendimiento.
Agregación de tiempo
También conocida como Rango, la Agregación temporal de una regla de alerta determina la ventana temporal sobre la que se agrega la métrica seleccionada. Por ejemplo, si selecciona la agregación avg para la métrica cassandra_read_latency con un intervalo especificado, calcula el valor medio de la métrica cassandra_read_latency en esa ventana de tiempo. Este intervalo define cuánto tiempo atrás se consideran los valores métricos para la agregación temporal.
Duration
La duración define el tiempo que una condición de alerta debe cumplirse de forma continuada antes de activar una alerta. Por ejemplo, una duración de 10m significa que la condición debe cumplirse durante 10 minutos seguidos. Si la condición de alerta no se cumple en ningún momento dentro de este periodo, el temporizador de 10 minutos se reinicia y debe cumplirse de nuevo durante 10 minutos completos e ininterrumpidos. Establecer una duración más larga reduce los falsos positivos al evitar que se activen alertas por violaciones de umbrales de corta duración.

Agregación temporal y duración

La agregación temporal de una consulta de alerta define el periodo de tiempo en el que se evalúan los datos métricos relevantes. No debe confundirse con la Duración de una regla de alerta, que se refiere al tiempo que debe cumplirse una condición de alerta para que se active una alerta.

Umbrales

Defina el umbral y el intervalo de tiempo para evaluar la condición de alerta.

Métodos de agregación
Agregación Descripción
media La media de los valores métricos recuperados a lo largo del periodo de tiempo.
sum Suma de la métrica durante el periodo de tiempo evaluado.
maximum El máximo de los valores de métrica recuperados durante el periodo de tiempo.
minimum El mínimo de los valores de métrica recuperados durante el periodo de tiempo.

Imágenes en las notificaciones de alerta de umbral

Las notificaciones de alerta de umbral enviadas a Slack o por correo electrónico incluyen una instantánea de los datos de la serie temporal desencadenante. Para los canales de notificación de Slack, la instantánea se puede habilitar o inhabilitar dentro de los valores del canal de notificación. Cuando el canal está configurado para Notificar al resolver, también se proporciona en la notificación una instantánea de los datos de serie temporal que resuelve la alerta.

Configuración de varios umbrales

Además de un umbral de alerta, se puede configurar un umbral de aviso. Los umbrales de aviso y los umbrales de alerta se pueden asociar con distintos canales de notificación. En el ejemplo siguiente, es posible que un usuario desee enviar una notificación de aviso y alerta a Slack, pero también paginar el equipo de guardia en Pagerduty si se cumple un umbral de alerta.

Si los umbrales de aviso y alerta están asociados con el mismo canal de notificación, una métrica que supere inmediatamente el umbral de alerta ignorará el umbral de aviso y sólo desencadenará el umbral de alerta.

Alerta cuando no hay datos de métrica

Cuando una métrica deja de notificar datos, las alertas que utilizan estas métricas no se pueden evaluar. Para asegurarse de que sabe cuándo sucede esto, puede configurar alertas para que notifiquen sobre Sin datos configurando la opción Sin datos en la sección Valores para ignorar o notificar.

Conversión de una configuración de alerta a PromQL

Puede convertir automáticamente del formulario a PromQL para aprovechar la flexibilidad y la potencia de PromQL. El uso de la opción Traducir a PromQL le permite configurar consultas complejas.

Por ejemplo, la consulta siguiente examina el porcentaje de memoria disponible en un host.

sysdig_host_memory_available_bytes / sysdig_host_memory_total_bytes * 100

Los umbrales se configuran por separado de la consulta, lo que permite al usuario especificar un umbral de alerta y un umbral de aviso.