네트워크 상태에 NHC005 오류가 표시되는 이유는 무엇인가요?

가상 사설 클라우드 클래식 인프라

네트워크 상태 확인 오류 NHC005 의 문제 해결.

ibmcloud oc cluster health issues --cluster <CLUSTER_ID> 을 실행하여 클러스터의 상태를 확인하면 다음 예와 유사한 오류가 표시됩니다.

ID       Component   Severity   Description
NHC005   Network     Warning    Tigera operator is reporting that Calico is in 'degraded' state.

이 경고는 내에서 IBM Cloud Kubernetes Service 를 Calico 관리하는 Tigera 운영자가 가 성능 저하 상태에 있음을 Calico 감지했음을 나타냅니다. 이는 네트워크 정책, 포드 네트워킹 또는 기타 네트워크 관련 기능에 영향을 미칠 수 있습니다.

Tigera 오퍼레이터 및 Calico 구성 요소의 로그를 확인하여 성능 저하의 원인을 조사하십시오.

  1. Tigera 상태 사용자 지정 리소스 및 조건을 확인하고 "Progressing": true 에서 "conditions" 을 찾아보세요.

    kubectl get tigerastatus -o yaml
    
    kubectl get tigerastatus calico -o yaml
    
  2. calico-system 네임스페이스에 Calico 파드를 나열하여 Calico 및 Calico-typha 구성 요소 상태를 확인합니다:

    kubectl get pods -n calico-system
    
  3. 배포 및 데몬 세트의 롤아웃 상태를 확인합니다.

    kubectl rollout status deployment/calico-kube-controllers -n calico-system
    kubectl rollout status deployment/calico-typha -n calico-system
    kubectl rollout status daemonset/calico-node -n calico-system
    
  4. 파드가 준비되지 않았거나 Init 또는 CrashLoopBackOff 에서 멈춘 경우 파드 로그를 가져옵니다.

    kubectl logs <pod-name> -n calico-system
    
  5. 로그에서 구성 오류, 네트워킹 문제 또는 크래시 루프를 찾아보세요.

  6. 확인된 문제를 해결한 후 몇 분간 기다렸다가 네트워크 상태를 다시 확인하세요.

  7. 자세한 내용은 네트워크 정책으로 트래픽 제어하기 및 Calico 구성 요소 디버깅하기를 참조하세요

  8. 문제가 계속되면 지원팀에 문의하여 추가 도움을 받으십시오. 지원 케이스 열기 케이스 세부 정보에 관련 로그 파일, 오류 메시지 또는 명령 출력을 모두 포함해야 합니다.