Alertas de umbral
Puede definir IBM Cloud Monitoring Alertas de umbral (anteriormente denominadas Alertas de métrica) en el editor de alertas mediante un formulario o PromQL.
Para obtener más información sobre la configuración de alertas, consulte Configuración de una alerta utilizando el editor de alertas.
Especificación de las condiciones de activación de una alerta de umbral
En el editor de alertas, especifique lo siguiente en la sección Métrica y condiciones.
- Ámbito
- La alerta se establece para que se aplique de forma predeterminada a la Infraestructura completa del ámbito del equipo. Sin embargo, puede restringir el ámbito de alerta filtrando por etiquetas específicas, como
container_nameokube_namespace_name. - Métrica
- Seleccione la métrica que desea supervisar y configure cómo desea que se agreguen los datos. A continuación, puede elegir el método de agregación que mejor se adapte a sus necesidades. Por ejemplo, si desea comprender la latencia media en todo el clúster, puede utilizar la agregación promedio. De forma alternativa, si desea identificar nodos con la latencia más alta, puede utilizar la agregación máxima.
- Agrupar por segmento
- Al agrupar las métricas por etiquetas como
container_name, se genera un segmento exclusivo para cada contenedor. Esto le permite detectar rápidamente si un contenedor determinado es responsable de la desengrasación del rendimiento. - Agregación de tiempo
- También conocida como Rango, la Agregación temporal de una regla de alerta determina la ventana temporal sobre la que se agrega la métrica seleccionada. Por ejemplo, si selecciona la agregación
avgpara la métricacassandra_read_latencycon un intervalo especificado, calcula el valor medio de la métricacassandra_read_latencyen esa ventana de tiempo. Este intervalo define cuánto tiempo atrás se consideran los valores métricos para la agregación temporal. - Duration
- La duración define el tiempo que una condición de alerta debe cumplirse de forma continuada antes de activar una alerta. Por ejemplo, una duración de 10m significa que la condición debe cumplirse durante 10 minutos seguidos. Si la condición de alerta no se cumple en ningún momento dentro de este periodo, el temporizador de 10 minutos se reinicia y debe cumplirse de nuevo durante 10 minutos completos e ininterrumpidos. Establecer una duración más larga reduce los falsos positivos al evitar que se activen alertas por violaciones de umbrales de corta duración.
Agregación temporal y duración
La agregación temporal de una consulta de alerta define el periodo de tiempo en el que se evalúan los datos métricos relevantes. No debe confundirse con la Duración de una regla de alerta, que se refiere al tiempo que debe cumplirse una condición de alerta para que se active una alerta.
Umbrales
Defina el umbral y el intervalo de tiempo para evaluar la condición de alerta.
| Agregación | Descripción |
|---|---|
| media | La media de los valores métricos recuperados a lo largo del periodo de tiempo. |
| sum | Suma de la métrica durante el periodo de tiempo evaluado. |
| maximum | El máximo de los valores de métrica recuperados durante el periodo de tiempo. |
| minimum | El mínimo de los valores de métrica recuperados durante el periodo de tiempo. |
Imágenes en las notificaciones de alerta de umbral
Las notificaciones de alerta de umbral enviadas a Slack o por correo electrónico incluyen una instantánea de los datos de la serie temporal desencadenante. Para los canales de notificación de Slack, la instantánea se puede habilitar o inhabilitar dentro de los valores del canal de notificación. Cuando el canal está configurado para Notificar al resolver, también se proporciona en la notificación una instantánea de los datos de serie temporal que resuelve la alerta.
Configuración de varios umbrales
Además de un umbral de alerta, se puede configurar un umbral de aviso. Los umbrales de aviso y los umbrales de alerta se pueden asociar con distintos canales de notificación. En el ejemplo siguiente, es posible que un usuario desee enviar una notificación de aviso y alerta a Slack, pero también paginar el equipo de guardia en Pagerduty si se cumple un umbral de alerta.
Si los umbrales de aviso y alerta están asociados con el mismo canal de notificación, una métrica que supere inmediatamente el umbral de alerta ignorará el umbral de aviso y sólo desencadenará el umbral de alerta.
Alerta cuando no hay datos de métrica
Cuando una métrica deja de notificar datos, las alertas que utilizan estas métricas no se pueden evaluar. Para asegurarse de que sabe cuándo sucede esto, puede configurar alertas para que notifiquen sobre Sin datos configurando la opción Sin datos en la sección Valores para ignorar o notificar.
Conversión de una configuración de alerta a PromQL
Puede convertir automáticamente del formulario a PromQL para aprovechar la flexibilidad y la potencia de PromQL. El uso de la opción Traducir a PromQL le permite configurar consultas complejas.
Por ejemplo, la consulta siguiente examina el porcentaje de memoria disponible en un host.
sysdig_host_memory_available_bytes / sysdig_host_memory_total_bytes * 100
Los umbrales se configuran por separado de la consulta, lo que permite al usuario especificar un umbral de alerta y un umbral de aviso.