Avvisi soglia

È possibile definire gli avvisi di soglia IBM Cloud Monitoring (precedentemente denominati avvisi metrici) nell'editor degli avvisi utilizzando un modulo o PromQL.

Per ulteriori informazioni sulla configurazione degli avvisi, consultare Configurazione di un avviso utilizzando l'editor degli avvisi.

Specificare le condizioni di attivazione di un avviso di soglia

Nell'editor dei messaggi di alert, specificare quanto segue nella sezione Metrica & Condizioni.

Ambito
L'avviso è impostato per essere applicato per impostazione predefinita all' intera infrastruttura dell'ambito del team. Tuttavia, è possibile limitare l'ambito dell'avviso filtrando in base a specifiche etichette, come container_name o kube_namespace_name.
Metrica
Selezionare la metrica che si desidera monitorare e configurare la modalità di aggregazione dei dati. Quindi, è possibile scegliere il metodo di aggregazione più adatto alle proprie necessità. Ad esempio, se si desidera comprendere la latenza media nell'intero cluster, è possibile utilizzare l'aggregazione media. In alternativa, se si desidera identificare i nodi con la latenza più elevata, è possibile utilizzare l'aggregazione massima.
Raggruppa per segmento
Raggruppando le metriche per etichette come container_name, viene generato un segmento univoco per ogni contenitore. Ciò consente di rilevare rapidamente se un particolare contenitore è responsabile della riduzione delle prestazioni.
Aggregazione temporale
Conosciuta anche come Intervallo, l'Aggregazione temporale di una regola di avviso determina la finestra temporale su cui viene aggregata la metrica selezionata. Ad esempio, se si seleziona l'aggregazione avg per la metrica cassandra_read_latency con un intervallo specificato, viene calcolato il valore medio della metrica cassandra_read_latency in quella finestra temporale. Questo intervallo definisce quanto indietro nel tempo vengono considerati i valori delle metriche per l'aggregazione temporale.
Durata
La durata definisce il tempo in cui una condizione di avviso deve essere continuamente soddisfatta prima di attivare un avviso. Ad esempio, una durata di 10m significa che la condizione deve essere soddisfatta per 10 minuti continui. Se la condizione di allarme non viene soddisfatta in qualsiasi momento entro questo periodo, il timer di 10 minuti si resetta e deve essere nuovamente soddisfatto per 10 minuti ininterrotti. L'impostazione di una durata maggiore riduce i falsi positivi, evitando che gli avvisi vengano attivati da violazioni di soglia di breve durata.

Aggregazione temporale e durata

L'aggregazione temporale di una query di avviso definisce il periodo di tempo in cui vengono valutati i dati metrici pertinenti. Non deve essere confusa con la Durata di una regola di avviso, che si riferisce al periodo di tempo in cui una condizione di avviso deve essere soddisfatta prima di attivare un avviso.

Soglie

Definire la soglia e l'intervallo di tempo per valutare la condizione di avviso.

Metodi di aggregazione
Aggregazione Descrizione
media La media dei valori di metrica richiamati nel periodo di tempo.
sum La somma della metrica nel periodo di tempo valutato.
massimo Il massimo dei valori di metrica richiamati nel periodo di tempo.
minimum Il valore minimo della metrica richiamata nel periodo di tempo.

Immagini nelle notifiche di avviso di soglia

Le notifiche di avviso di soglia inoltrate a Slack o via e-mail includono un'istantanea dei dati della serie temporale di attivazione. Per i canali di notifica Slack, l'istantanea può essere abilitata o disabilitata nelle impostazioni del canale di notifica. Quando il canale è configurato su Notifica quando risolto, nella notifica viene fornita anche un'istantanea dei dati delle serie temporali che risolve l'avviso.

Configurazione di più soglie

Oltre a una soglia di avviso, è possibile configurare una soglia di avviso. Le soglie di avviso e le soglie di avviso possono essere associate a canali di notifica differenti. Nel seguente esempio, un utente potrebbe voler inviare un'avvertenza e una notifica di avviso a Slack, ma anche inviare una pagina al team in attesa su Pagerduty se viene soddisfatta una soglia di avviso.

Se entrambe le soglie di avviso e avvertenza sono associate allo stesso canale di notifica, una metrica che supera immediatamente la soglia di avviso ignorerà la soglia di avvertenza e attiverà solo la soglia di avviso.

Avviso quando non ci sono dati di metrica

Quando una metrica arresta i dati di report, gli avvisi che utilizzano tali metriche non possono essere valutati. Per assicurarti di essere consapevole di quando ciò si verifica, puoi configurare gli avvisi per la notifica in caso di Nessun dato configurando l'opzione Nessun dato nella sezione Impostazioni per ignorare o notificare.

Traduzione di una configurazione di avvisi in PromQL

È possibile eseguire automaticamente la conversione dal modulo a PromQL per sfruttare la flessibilità e la potenza di PromQL. L'uso dell'opzione Converti in PromQL consente di configurare query complesse.

Ad esempio, la seguente query esamina la percentuale di memoria disponibile su un host.

sysdig_host_memory_available_bytes / sysdig_host_memory_total_bytes * 100

Le soglie vengono configurate separatamente dalla query, consentendo all'utente di specificare sia una soglia di avviso che una soglia di avviso.