네트워크 상태에 NHC001 오류가 표시되는 이유는 무엇인가요?

가상 사설 클라우드 클래식 인프라

네트워크 상태 확인 오류 NHC001 의 문제 해결.

ibmcloud oc cluster health issues --cluster <CLUSTER_ID> 을 실행하여 클러스터의 상태를 확인하면 다음 예와 유사한 오류가 표시됩니다.

ID       Component   Severity   Description
NHC001   Network     Warning    Tigera operator has been reporting that Calico is in 'progressing' state for over an hour.

이 경고는 Tigera 운영자가 해당 작업이 '진행 중' 상태에 멈춰 Calico 있다고 보고했음을 의미하며, 이는 구성 요소 배포 지연 또는 근본적인 문제로 인해 발생했을 가능성이 있습니다.

Tigera 운영자 및 Calico 구성 요소의 로그를 조사하여 정상 상태에 도달하지 Calico 못하게 하는 원인을 파악하십시오.

  1. Tigera 상태 사용자 지정 리소스 및 조건을 확인하세요. "Progressing": true 으로 "conditions" 을 검색합니다.

    kubectl get tigerastatus -o yaml
    
    kubectl get tigerastatus calico -o yaml
    
  2. calico-system 네임스페이스에 Calico 파드를 나열하여 Calico 및 Calico-typha 구성 요소 상태를 확인합니다:

    kubectl get pods -n calico-system
    

    배포 및 데몬 세트의 롤아웃 상태를 확인합니다.

    kubectl rollout status deployment/calico-kube-controllers -n calico-system
    kubectl rollout status deployment/calico-typha -n calico-system
    kubectl rollout status daemonset/calico-node -n calico-system
    
  3. 파드가 준비되지 않았거나 Init 또는 CrashLoopBackOff 에서 멈춘 경우 로그를 가져옵니다:

    kubectl logs <pod-name> -n calico-system
    
  4. 구성 요소의 롤아웃이 완료될 때까지 기다립니다. 문제(예: CrashLoopBackOff, 이미지 가져오기 오류)를 해결한 후 Tigera가 상태를 새로 고칠 때까지 몇 분 정도 기다리세요.

  5. 자세한 내용은 네트워크 정책으로 트래픽 제어하기Calico 구성 요소 디버깅하기를 참조하세요

  6. 문제가 계속되면 고객 지원팀에 문의하여 도움을 받으십시오. 지원 케이스 열기 케이스 세부 정보에 관련 로그 파일, 오류 메시지 또는 명령 출력을 모두 포함해야 합니다.