為什麼網路狀態會顯示 NHC005 錯誤?

虛擬私有雲 經典基礎設施

排除網路狀態檢查錯誤 NHC005 的問題。

當您執行 ibmcloud oc cluster health issues --cluster <CLUSTER_ID> 檢查群集的健康狀態時,您會看到類似以下範例的錯誤。

ID       Component   Severity   Description
NHC005   Network     Warning    Tigera operator is reporting that Calico is in 'degraded' state.

此警告表示管理 Calico 的 Tigera 操作員已 IBM Cloud Kubernetes Service 偵測到 Calico 處於降級狀態。 這可能會影響網路政策、Pod 網路或其他網路相關功能。

檢查 Tigera 操作員和 Calico 組件的記錄,以調查效能下降的原因。

  1. 檢查 Tigera 狀態自訂資源和條件,並尋找 "conditions""Progressing": true

    kubectl get tigerastatus -o yaml
    
    kubectl get tigerastatus calico -o yaml
    
  2. 透過列出 calico-system 名稱空間中的 Calico pod,檢查 Calico 和 Calico-typha 元件的狀態:

    kubectl get pods -n calico-system
    
  3. 檢查部署和 daemonset 的推出狀態。

    kubectl rollout status deployment/calico-kube-controllers -n calico-system
    kubectl rollout status deployment/calico-typha -n calico-system
    kubectl rollout status daemonset/calico-node -n calico-system
    
  4. 如果 pod 未準備好或卡在 InitCrashLoopBackOff,請取得 pod 記錄。

    kubectl logs <pod-name> -n calico-system
    
  5. 在日誌中尋找任何組態錯誤、網路問題或當機迴圈。

  6. 解決任何發現的問題後,請等待幾分鐘,然後再重新檢查網路健康狀況。

  7. 如需詳細資訊,請參閱 使用網路政策控制流量調試 Calico 元件

  8. 若問題仍未解決,請聯絡客服以獲取進一步協助。 開啟 支援個案。 在案例詳細資訊中,請務必包含任何相關的記錄檔、錯誤訊息或指令輸出。