複数の etcd アラートを受け取るのはなぜですか?

etcdHighNumberOfLeaderChanges または etcdExcessiveDatabaseGrowth に関する複数のアラートを受け取り、以下のようなメッセージが表示されます。

"etcd": 7.5 leader changes within the last 15 minutes. Frequent elections might be a sign of insufficient resources, high network latency, or disruptions by other components and should be investigated.
"etcd cluster "etcd": Observed surge in etcd writes leading to 50% increase in database size over the past four hours on etcd instance, please check as it might be disruptive.

クラスタ etcd データベースはクラスタコントロールプレーンにあり、 IBM によって管理される。 3つの別々の etcd インスタンスからのメトリクスは、クラスタ内の単一のポッドにプッシュされますが、メトリクスのソースは必ずしも区別されません。 これらのメトリクスが Prometheus によって収集されると、複数の個別のインスタンスからではなく、単一の etcd インスタンスから発信されたものとして読み取られる可能性があり、その結果、高い活動率に対する誤ったアラートが発生する。 この場合、根本的な問題はなく、アラートは誤ってトリガーされます。

多くの場合、 etcdHighNumberOfLeaderChanges および etcdExcessiveDatabaseGrowth は根本的な問題を示していないため、無視してかまいません。 アラートが false であることを確認する場合は、お客様サポートにお問い合わせください。 サポート Case を開きます。 ケースの詳細には、関連するログ・ファイル、エラー・メッセージ、またはコマンド出力を必ず含めてください。