Pourquoi est-ce que je reçois plusieurs alertes etcd ?

Vous recevez plusieurs alertes pour etcdHighNumberOfLeaderChanges ou etcdExcessiveDatabaseGrowth, avec des descriptions similaires aux messages suivants.

"etcd": 7.5 leader changes within the last 15 minutes. Frequent elections might be a sign of insufficient resources, high network latency, or disruptions by other components and should be investigated.
"etcd cluster "etcd": Observed surge in etcd writes leading to 50% increase in database size over the past four hours on etcd instance, please check as it might be disruptive.

La base de données du cluster etcd est située sur le plan de contrôle du cluster, qui est maintenu par IBM. Les mesures de trois instances etcd distinctes sont transmises à un seul pod dans le cluster, mais la source des mesures n'est pas toujours distinguée. Lorsque ces mesures sont collectées par Prometheus, elles peuvent être interprétées comme provenant d'une seule instance etcd plutôt que de plusieurs instances distinctes, ce qui donne lieu à une fausse alerte en cas de taux d'activité élevé. Dans ce cas, il n'y a pas de problème sous-jacent et les alertes sont déclenchées de manière erronée.

Souvent, etcdHighNumberOfLeaderChanges et etcdExcessiveDatabaseGrowth n'indiquent pas de problème sous-jacent et peuvent être ignorés. Si vous souhaitez valider que les alertes sont fausses, vous pouvez contacter le service clients. Ouverture d'un cas de support. Dans les détails du cas, veillez à inclure les fichiers journaux, les messages d'erreur ou les sorties de commande appropriés.