Mit Alerts und Ereignissen arbeiten

Im IBM Cloud Monitoring-Service können Sie Einzelalerts und Alerts mit mehreren Bedingungen konfigurieren, um über Probleme benachrichtigt zu werden, die Ihre Aufmerksamkeit erfordern. Wenn ein Alert ausgelöst wird, können Sie über einen oder mehrere Kanäle benachrichtigt werden. Durch eine Alertdefinition können Benachrichtigungen für mehrere Kanäle generiert werden.

Ein Alert ist ein Benachrichtigungsereignis, das Sie verwenden können, um vor Situationen zu warnen, die Aufmerksamkeit erfordern. Jeder Alert hat einen Prioritätsstatus. Dieser Status informiert Sie über die Kritikalität der Informationen, die gemeldet werden.

Wenn Sie einen Alert definieren, müssen Sie die Bedingung, die die Benachrichtigung auslöst, und einen oder mehrere Benachrichtigungskanäle, über die Sie benachrichtigt werden möchten, definieren. Sie müssen auch die Prioritätsstufe des Alerts und den Typ des Alerts definieren. Weitere Informationen dazu, wie Sie Alerts konfigurieren, finden Sie in Alert konfigurieren.

Die Priorität ist standardmäßig auf Warnung festgelegt. Sie können die Priorität eines Alerts auf einen der folgenden Werte festlegen: Notfall, Alert, Kritisch, Fehler, Warnung, Hinweis, Information, Debug*

Sie können einen Alert für eine einzelne Metrik oder für mehrere Metriken definieren, um über Ereignisse oder Probleme benachrichtigt zu werden, die Sie überwachen möchten.

  • Sie können einen Alert mit einer einzelnen Bedingung definieren.
  • Sie können einen Alert mit mehreren Bedingungen definieren. Dabei wird der Alertschwellenwert durch komplexe Bedingungen festgelegt.
  • Sie können definieren, wie die Daten aggregiert werden.
  • Sie können boolesche Logik verwenden, um Alerts zu definieren, die mehrere Metriken überwachen.
  • Sie werden benachrichtigt, wenn die Alertbedingung erfüllt ist.
  • Sie können für jeden Alert mehrere Benachrichtigungskanäle konfigurieren.
  • Alerts werden innerhalb von 1 Minute oder weniger nach Eingang ausgeführt, mit der Option, die Auslösewartezeit nach Stunde oder Tag zu konfigurieren.
  • Nur für PromQL-Alarme können Sie optional eine Wartezeit von 0 Minuten konfigurieren.

Sie können in der Webbenutzerschnittstelle und mithilfe derIBM Cloud Monitoring-API vordefinierte Alerts aktivieren, Alerts ändern und angepasste Alerts erstellen.

Sie verwalten Alerts in der Ansicht Alerts der Webbenutzerschnittstelle. Sie können die Tabellenspalten konfigurieren, die in der Ansicht Alerts angezeigt werden. Gültige Spaltenoptionen sind Name, Umfang, Alarmieren wenn, Segmentieren nach, Benachrichtigungen, Aktiviert, Geändert, Erfasst, Kanäle, Erstellt, Beschreibung, E-Mail-Empfänger, Mindestens für, OpsGenie, PagerDuty, Schweregrad, Slack, WebHook, Typ und VictorOps.

Alerttypen

Der IBM Cloud Monitoring-Service enthält vordefinierte Alerts, die Sie aktivieren können. Darüber hinaus können Sie angepasste Alerts über Anzeigen in einem Dashboard mithilfe der REST-API oder im Abschnitt Alerts der Webbenutzerschnittstelle konfigurieren.

Im IBM Cloud Monitoring-Service können Sie die folgenden Alerttypen definieren:

  • Ausfallzeit: Mit diesem Alerttyp können Sie Quellen (z. B. eine Bare-Metal-Einheit) überwachen und Alerts auslösen, wenn eine Quelle nicht betriebsbereit ist.

  • Metrik: Mit diesem Alerttyp können Sie Zeitreihenmetriken überwachen und Alerts auslösen, wenn die definierten Schwellenwerte erreicht werden.

  • PromQL: Mit diesem Alerttyp können Sie Metriken unter Verwendung einer PromQL-Abfrage überwachen.

  • Ereignis: Mit diesem Alerttyp können Sie das Auftreten bestimmter Ereignisse überwachen und Alerts auslösen, wenn die definierten Schwellenwerte erreicht werden. Dieser Alerttyp kann beispielsweise ausgelöst werden, wenn eine bestimmte Anzahl nicht autorisierter Zugriffe gemeldet wurde.

  • Anomalieerkennung: Mit diesem Alerttyp können Sie das Langzeitverhalten von Hosts überwachen und Alerts auslösen, wenn Abweichungen von dem erwarteten Verhaltensmuster auftreten.

    Diese Art von Ausschreibung ist veraltet. Sie können nur bestehende Warnungen dieses Typs verwalten.

  • Gruppenausreißer: Mit diesem Alerttyp können Sie Hosts überwachen und Alertbenachrichtigungen auslösen, wenn das Verhalten eines Hosts vom Verhalten der anderen Hosts abweicht.

    Diese Art von Ausschreibung ist veraltet. Sie können nur bestehende Warnungen dieses Typs verwalten.

Benachrichtigungskanäle

Ein Benachrichtigungskanal definiert, wohin Benachrichtigungen über ausgelöste Alerts gesendet werden sollen.

Beim Konfigurieren eines Alerts können Sie einen oder mehrere Benachrichtigungskanäle angeben.

Standardmäßig wird eine Benachrichtigung im Bereich Ereignisse hinzugefügt, wenn ein Alert ausgelöst wird.

Sie können beliebige der folgenden Benachrichtigungskanäle konfigurieren:

  • E-Mail
  • IBM Event Notifications
  • Microsoft Teams
  • OpsGenie
  • PagerDuty
  • Slack
  • E-Mail für Teams
  • VictorOps
  • WebHook

Ereignisse

Ein Ereignis ist eine Benachrichtigung, die darüber informiert, dass in einem der Knoten, die Daten an Ihre Monitoring-Instanz weiterleiten, etwas aufgetreten ist. Verwenden Sie Ereignisse, um Probleme zu überprüfen, zu verfolgen und zu beheben.

In der folgenden Liste sind die verschiedenen Arten von Ereignissen aufgeführt:

  • Alertereignisse sind Ereignisse, die durch vom Benutzer konfigurierte Alerts ausgelöst werden.
  • Infrastrukturbasierte Ereignisse sind Ereignisse, die von Docker- und Kubernetes-Knoten erfasst werden. Der Überwachungsagent erkennt und erfasst automatisch Daten aus einer ausgewählten Gruppe von Ereignissen. Sie können die Agentenkonfigurationsdatei bearbeiten, um weitere Ereignisse zu aktivieren.
  • Angepasste Ereignisse, die Sie über eine der folgenden Integrationen konfigurieren: Slackbot, vordefinierte Python-Scripts, angepasste und vom Benutzer erstellte Python-Scripts oder cURL-Anforderungen.

Ein Ereignis hat standardmäßig einen Status:

  • Aktiv: Dieser Status zeigt an, dass die Umstände, die das Ereignis ausgelöst haben, weiterhin vorhanden sind, z. B. wenn ein Knoten weiterhin inaktiv ist.
  • OK: Dieser Status zeigt an, dass die Situation wieder normal ist, z. B. wenn ein Knoten wieder betriebsbereit ist.

Ereignisse werden im Abschnitt Ereignisse der Webbenutzerschnittstelle verwaltet.

  • Sie können Alertereignisse über die Registerkarte Alertereignisse anzeigen.
  • Sie können infrastrukturbasierte Ereignisse über die Registerkarte Angepasste Ereignisse anzeigen.
  • Sie können angepasste Ereignisse über die Registerkarte Angepasste Ereignisse anzeigen.
  • Sie können angepasste Ereignisse mithilfe des API-Token für dieses Team an jedes Ihrer Teams senden. Weitere Informationen finden Sie unter Benutzerdefinierte Ereignisse).
  • Sie können das Ereignis als Gelöst festlegen, um andere Benutzer darüber zu informieren, dass das Problem behoben wurde, anstatt auf den Status OK zu warten.