フローアラートの設定
フローアラートは、アラートイベントの任意の組み合わせが、定義された時間枠内で特定のシーケンスで発生したときに通知するように設計されています。
たとえば、CPU使用率が高いために HTTP リクエストの割合が増加する場合を監視するために、 HTTP エラー率が高いことを監視するアラートが定義された時間枠内にトリガーされ、その後にCPU使用率が高いことを監視するアラートがトリガーされるフローアラートを定義できます。
フローアラートの用途には以下のようなものがある:
-
包括的なデータ相関:ログ、メトリクス、セキュリティ・イベントのアラートを相関させることができます。 この多面的なアプローチにより、孤立した情報の断片ではなく、システムのパフォーマンスを全体的に把握することができ、十分な情報に基づいた意思決定を行うために必要なすべてのデータを得ることができます。
-
高度な根本原因分析:フローアラートは、問題の根本原因を特定するように構成できます。 根本原因を特定したアラートを定義できるため、問題に迅速に対応でき、システムのダウンタイムが短縮され、業務効率が向上します。
-
アラート疲労の軽減:従来の監視システムは、冗長なアラートでユーザーを溢れさせることが多く、アラート疲労を引き起こし、重要な問題を見落とす可能性がある。 順序付けされた期限付きの基準フィルタを適用することで、フローアラートは誤ったアラートを大幅に削減する。 つまり、設定された条件がすべて満たされた場合にのみアラートが表示されるため、不要な通知ノイズから解放される。
フローアラートを構成する個々のアラートに対してファントムモードを有効にすることで、通知をさらに整理することができます。 その後、フローアラートのみが通知シーケンスをトリガーし、インシデントを発生させるが、その構成アラートはサイレンスのままである。
-
カスタマイズ可能な警告シーケンス:フローアラートでは、簡単なドラッグ&ドロップのインターフェースでアラートシーケンスを定義できます。 順序と時間によってすべての条件が満たされた場合にのみトリガーされるフローを作成し、直感的でカスタムなモニタリング体験を提供します。
-
効率的なトラブルシューティング:アラートのシーケンスをキャンバス上で視覚化できるため、トラブルシューティングがより簡単で効率的になります。 簡単にパターンを特定し、アラートにつながる一連の出来事を理解し、問題を修正するために迅速に行動することができます。
-
リソース利用の最適化:誤警告を減らし、根本原因の特定を可能にすることで、時間とリソースを大幅に節約できます。 この最適化により、あなたのチームは、誤ったアラートの絶え間ない流れに煩わされることなく、より戦略的なタスクに集中することができます。
フローログの構成要素を理解する
フロービルダーツールは、フローアラートのトリガーとなるユーザー定義アラートを視覚的に組み合わせ、連鎖させるために使用されます。 フローアラートの基本的な構成要素は、ステージとグループである。
グループは、個々のユーザー定義アラートの論理的な組み合わせを表します。 このグループは、 OR、 AND、 NOT の論理演算子をサポートしており、複数の個別警告を組み合わせることができる。
ステージは、指定された時間枠内でトリガーする必要があるアラートグループを表す。 1つのステージに複数のグループが存在することもある。
フローログの制限
フローログには以下の制限がある:
-
全ステージの累積時間は168時間(1週間)を超えてはならない。 制限を超える時間枠を挿入すると、入力はゼロにリセットされる。
-
1つのフローアラートには最大30件のアラートを含めることができる。
-
以下の警告タイプは、
NOT論理演算子をサポートしていません:
前提条件
- アラートについてはIBM Cloud Logsを参照してください。 詳細については、アラート を参照してください。
- Event Notificationsインスタンスが IBM Cloud Logsインスタンスと同じアカウントにあり、Event Notificationsインスタンスにリソースを設定する権限があることを確認してください。
- IBM Cloud LogsインスタンスとEvent Notificationsインスタンス間のアウトバウンド統合が構成されていることを確認する。 詳細については、接続するアウトバウンドインテグレーションを設定する を参照してください。
起動アラート管理
以下のステップを実行します。
- コンソールで、 ナビゲーション・メニュー・アイコン
> Resource list をクリックする。
- IBM Cloud Logs のインスタンスを選択します。
- IBM Cloud Logsナビゲーションで、アラートアイコン
>アラー管理をトクリックします。
- 新しいアラートをクリックします。
設定するアラートの種類を選択する
以下のステップを実行します。
-
アラートの種類を選択します。 詳細については、 「アラートの種類」 を参照してください。
-
Details セクションで、以下のステップを完了する:
-
名前を入力します。
- 名前の最大長は4096文字。
-
[オプション]説明文を入力します。
- 説明文の最大長は4096文字です。
-
[オプション] 1つ以上のラベルを追加する。
ラベルは、後で簡単に検索するために使用できるキーと値のペアです。
-
アラートフローの定義
-
フロービルダーを開く 」をクリックする。 ビルダーダイアログは、 既存のアラートパネルで以前に設定されたアラートを表示します。
-
既存のアラート ] パネルからフロー ビルダーのワークスペース エリアに既存のアラートをドラッグ アンド ドロップします。
-
アラートをグループや段階に分けて整理する。
-
各ステージにタイムフレームを設定する。
-
適用] をクリックして警告フローを保存します。
-
Group By キーを選択する。
利用可能なキーは、異なるアラート間の交差グループとなる。 例えば、 アラートAが
RegionおよびClusterによってグループ化され、 アラートBがRegionおよびPodによってグループ化されている場合、アラートフローはRegionによってのみグループ化することができ、ClusterまたはPodによってグループ化することはできません。 アラートにカーソルを合わせ、アラートの説明を表示することで、アラートビルダー内の各アラートで利用可能なグループ化オプションを確認することができます。
通知の詳細を設定する
以下のステップを実行します。
-
Notify every を設定して、アラートがトリガーされた後のイベント取得頻度を定義します。 デフォルトでは0時間10分に設定されている。
-
Resolve automaticallyを有効にすると、イベントが解決されたときにイベントを取得します。
アラートの条件がイベントをトリガーしなくなると、最初にトリガーされたイベントは解決済みとしてマークされる。
-
Enableファントムモードを有効にして、このアラートがファントムアラートであることを示す。
ファントムアラートは、フローアラートのビルディングブロックとして機能する。
ファントムアラートは、独立したイベント通知をトリガーしない。
このオプションを有効にすると、アラート定義から通知セクションが削除されます。
-
統合を追加する。
統合を追加するには、送信統合が定義されている必要があります。 詳細については、Event Notificationsサービスとの統合を設定する を参照してください。
スケジュールと含めるログの内容を設定する
以下のステップを実行します。
-
*スケジュール]*セクションで、このアラートを有効にするタイミングを制御するスケジュールを設定します。 特定の曜日と時間を選ぶことができる。
-
*Notification Content(通知内容)*セクションでは、トリガーされたイベントにログ行のサンプルを含めるか、一部のフィールドのみを含めるかを定義します。
アラート通知に含める特定のJSONキーを選択するか、アラートメッセージにログテキスト全体を含めるには空白のままにします:
-
オプション1:アラートのフィルタリング条件に一致するログ行を1行含めるには、空白のままにします。
-
オプション2:JSONキーを指定し、key:valueのペアの形式で選択したフィールドを含める。 フィールドを追加するには、ログ記録がJSON形式でなければならないことに注意してください。
名前に
.を含む JSON キーは、選択フィールドとして使用できません。 -
オプション3:フィルターとしてJSONパスを指定する。
-
アラートがトリガーされると、イベントに含まれるデータ量には制限がある。 これらの制限の詳細については、データサイズ を参照。
アラート設定を保存する
以下のステップを実行します。
-
警告を確認する。
Verify(検証)」をクリックしてデータを評価し、過去24時間にアラートが何回条件に一致したかを調べます。
Verifyは優先順位の洞察パイプラインのデータのみを評価する。 アラートが分析とアラートパイプラインで利用可能なデータでトリガーされるように構成されている場合、この機能は利用できないことに注意してください。
-
**「アラートの作成」**をクリックします。
アラートの確認
アラートを作動させる。 アラートがトリガーされ処理されると、システムは、電子メール、Slack、SMS、または統合されたインシデント管理プラットフォームなどのさまざまなチャネルを通じて、指定されたユーザーまたはチームに通知を送信します。 その後、*「インシデント」*ページに移動し、トリガーされたアラートに関する情報を見ることができます。 詳細については、IBM Cloud Logsのトリガーされたアラートの管理 を参照してください。