네트워크 상태에 NHC005 오류가 표시되는 이유는 무엇인가요?

가상 사설 클라우드 클래식 인프라

네트워크 상태 확인 오류 NHC005 의 문제 해결.

ibmcloud oc cluster health issues --cluster <CLUSTER_ID> 을 실행하여 클러스터의 상태를 확인하면 다음 예와 유사한 오류가 표시됩니다.

ID       Component   Severity   Description
NHC005   Network     Warning    Tigera operator is reporting that Calico is in 'degraded' state.

이 경고는 내에서 IBM Cloud Kubernetes Service 를 Calico 관리하는 Tigera 운영자가 가 성능 저하 상태에 있음을 Calico 감지했음을 나타냅니다. 이는 네트워크 정책, 포드 네트워킹 또는 기타 네트워크 관련 기능에 영향을 미칠 수 있습니다.

Tigera 오퍼레이터 및 Calico 구성 요소의 로그를 확인하여 성능 저하의 원인을 조사하십시오.

  1. Tigera 상태 사용자 지정 리소스 및 조건을 확인하고 "Progressing": true 에서 "conditions" 을 찾아보세요.

    kubectl get tigerastatus -o yaml
    
    kubectl get tigerastatus calico -o yaml
    
  2. calico-system 네임스페이스에 Calico 파드를 나열하여 Calico 및 Calico-typha 구성 요소 상태를 확인합니다:

    kubectl get pods -n calico-system
    
  3. 배포 및 데몬 세트의 롤아웃 상태를 확인합니다.

    kubectl rollout status deployment/calico-kube-controllers -n calico-system
    kubectl rollout status deployment/calico-typha -n calico-system
    kubectl rollout status daemonset/calico-node -n calico-system
    
  4. 파드가 준비되지 않았거나 Init 또는 CrashLoopBackOff 에서 멈춘 경우 파드 로그를 가져옵니다.

    kubectl logs <pod-name> -n calico-system
    
  5. 로그에서 구성 오류, 네트워킹 문제 또는 크래시 루프를 찾아보세요.

  6. 확인된 문제를 해결한 후 몇 분간 기다렸다가 네트워크 상태를 다시 확인하세요.

  7. 자세한 내용은 네트워크 정책으로 트래픽 제어하기Calico 구성 요소 디버깅하기를 참조하세요

  8. 문제가 계속되면 지원팀에 문의하여 추가 도움을 받으십시오. 지원 케이스 열기 케이스 세부 정보에 관련 로그 파일, 오류 메시지 또는 명령 출력을 모두 포함해야 합니다.