Perché lo stato della rete mostra un errore NHC005 ?

Cloud privato virtuale Infrastruttura classica

Risoluzione dei problemi relativi all'errore di controllo dello stato della rete NHC005.

Quando si controlla lo stato di salute del cluster eseguendo ibmcloud oc cluster health issues --cluster <CLUSTER_ID>, si vede un errore simile al seguente esempio.

ID       Component   Severity   Description
NHC005   Network     Warning    Tigera operator is reporting that Calico is in 'degraded' state.

Questo avviso indica che l'operatore Tigera, che gestisce Calico in IBM Cloud Kubernetes Service, ha rilevato che Calico è in uno stato degradato. Ciò potrebbe avere un impatto sui criteri di rete, sulla rete pod o su altre funzioni relative alla rete.

Controllare i registri dell'operatore Tigera e Calico dei componenti per indagare sulla causa del degrado.

  1. Controllare lo stato di Tigera risorse e condizioni personalizzate e cercare "conditions" con "Progressing": true.

    kubectl get tigerastatus -o yaml
    
    kubectl get tigerastatus calico -o yaml
    
  2. Controllare lo stato dei componenti Calico e Calico-typha elencando i pod Calico nello spazio dei nomi calico-system:

    kubectl get pods -n calico-system
    
  3. Controllare lo stato di rollout delle distribuzioni e dei daemonset.

    kubectl rollout status deployment/calico-kube-controllers -n calico-system
    kubectl rollout status deployment/calico-typha -n calico-system
    kubectl rollout status daemonset/calico-node -n calico-system
    
  4. Se i pod non sono pronti o sono bloccati in Init o CrashLoopBackOff, ottenere i log dei pod.

    kubectl logs <pod-name> -n calico-system
    
  5. Cercate nei log eventuali errori di configurazione, problemi di rete o crash loop.

  6. Dopo aver risolto i problemi individuati, attendere qualche minuto e ricontrollare lo stato della rete.

  7. Per ulteriori informazioni, vedere Controllo del traffico con i criteri di rete e Debug dei componenti di Calico

  8. Se il problema persiste, contatta l'assistenza per ricevere ulteriore supporto. Apri un caso di supporto. Nei dettagli del caso, assicurarsi di includere qualsiasi file di registro, messaggio di errore o output di comando pertinente.