Warum erhalte ich mehrere etcd-Alerts?

Sie erhalten mehrere Alerts für etcdHighNumberOfLeaderChanges oder etcdExcessiveDatabaseGrowth mit Beschreibungen ähnlich den folgenden Nachrichten.

"etcd": 7.5 leader changes within the last 15 minutes. Frequent elections might be a sign of insufficient resources, high network latency, or disruptions by other components and should be investigated.
"etcd cluster "etcd": Observed surge in etcd writes leading to 50% increase in database size over the past four hours on etcd instance, please check as it might be disruptive.

Die Datenbank des Clusters etcd befindet sich auf der Clusterkontrollebene, die von IBM verwaltet wird. Metriken von drei separaten etcd Instanzen werden an einen einzigen Pod im Cluster übertragen, aber die Quelle der Metriken wird nicht immer unterschieden. Wenn diese Metriken von Prometheus gesammelt werden, könnten sie als von einer einzigen etcd Instanz stammend gelesen werden, anstatt von mehreren separaten Instanzen, was zu einem falschen Alarm für hohe Aktivitätsraten führt. In diesem Fall gibt es kein zugrunde liegendes Problem und die Alerts werden fälschlicherweise ausgelöst.

Häufig weisen etcdHighNumberOfLeaderChanges und etcdExcessiveDatabaseGrowth nicht auf ein zugrunde liegendes Problem hin und können ignoriert werden. Wenn Sie überprüfen möchten, ob die Alerts falsch sind, können Sie sich an die Kundenunterstützung wenden. Öffnen Sie einen Supportfall. Stellen Sie in den Falldetails sicher, dass alle relevanten Protokolldateien, Fehlernachrichten oder Befehlsausgaben enthalten sind.