다중 etcd 경보를 수신하는 이유는 무엇입니까?

다음 메시지와 유사한 설명과 함께 etcdHighNumberOfLeaderChanges 또는 etcdExcessiveDatabaseGrowth 에 대한 다중 경보를 수신합니다.

"etcd": 7.5 leader changes within the last 15 minutes. Frequent elections might be a sign of insufficient resources, high network latency, or disruptions by other components and should be investigated.
"etcd cluster "etcd": Observed surge in etcd writes leading to 50% increase in database size over the past four hours on etcd instance, please check as it might be disruptive.

클러스터 etcd 데이터베이스는 IBM 에서 유지 관리하는 클러스터 제어 영역에 있습니다. 세 개의 개별 etcd 인스턴스의 메트릭이 클러스터의 단일 포드로 푸시되지만 메트릭의 소스가 항상 구분되는 것은 아닙니다. 이러한 지표가 Prometheus 에서 수집되면 여러 개의 개별 인스턴스가 아닌 단일 etcd 인스턴스에서 발생한 것으로 판독되어 높은 활동률에 대한 잘못된 알림이 발생할 수 있습니다. 이 경우에는 기본적인 문제가 없으며 경보가 잘못 트리거됩니다.

종종 etcdHighNumberOfLeaderChanges 및 etcdExcessiveDatabaseGrowth 는 기본 문제를 표시하지 않으므로 무시할 수 있습니다. 경보가 false인지 유효성을 검증하려면 고객 지원에 문의할 수 있습니다. 지원 케이스 열기 케이스 세부사항에는 관련 로그 파일, 오류 메시지 또는 명령 출력이 포함되어야 합니다.