Perché lo stato della rete mostra un errore NHC001 ?

Cloud privato virtuale Infrastruttura classica

Risoluzione dei problemi relativi all'errore di controllo dello stato della rete NHC001.

Quando si controlla lo stato di salute del cluster eseguendo ibmcloud oc cluster health issues --cluster <CLUSTER_ID>, si vede un errore simile al seguente esempio.

ID       Component   Severity   Description
NHC001   Network     Warning    Tigera operator has been reporting that Calico is in 'progressing' state for over an hour.

Questo avviso significa che l'operatore Tigera ha segnalato che Calico è bloccato in uno stato di "progressione", potenzialmente a causa di ritardi nell'implementazione dei componenti o di problemi sottostanti.

Esamina i log dell'operatore Tigera e Calico dei componenti per capire cosa impedisce Calico il raggiungimento di uno stato ottimale.

  1. Controllare le risorse e le condizioni personalizzate dello stato di Tigera. Cercare "conditions" con "Progressing": true.

    kubectl get tigerastatus -o yaml
    
    kubectl get tigerastatus calico -o yaml
    
  2. Controllare lo stato dei componenti Calico e Calico-typha elencando i pod Calico nello spazio dei nomi calico-system:

    kubectl get pods -n calico-system
    

    Controllare lo stato di rollout delle distribuzioni e dei daemonset.

    kubectl rollout status deployment/calico-kube-controllers -n calico-system
    kubectl rollout status deployment/calico-typha -n calico-system
    kubectl rollout status daemonset/calico-node -n calico-system
    
  3. Se i baccelli non sono pronti o sono bloccati in Init o CrashLoopBackOff, ottenere i log:

    kubectl logs <pod-name> -n calico-system
    
  4. Attendere che i componenti completino il rollout. Dopo aver risolto eventuali problemi (ad esempio, errori di estrazione dell'immagine CrashLoopBackOff, ), attendere qualche minuto affinché Tigera aggiorni lo stato.

  5. Per ulteriori informazioni, vedere Controllo del traffico con i criteri di rete e Debug dei componenti di Calico

  6. Se il problema persiste, contatta l'assistenza per ricevere aiuto. Apri un caso di supporto. Nei dettagli del caso, assicurarsi di includere qualsiasi file di registro, messaggio di errore o output di comando pertinente.