Warum zeigt der Netzwerkstatus einen NHC006 Fehler an?

Klassische Infrastruktur

Fehlerbehebung bei der Netzwerkzustandsprüfung NHC006.

Wenn Sie den Status Ihres Clusters überprüfen, indem Sie ibmcloud oc cluster health issues --cluster <CLUSTER_ID> ausführen, erhalten Sie eine Fehlermeldung wie im folgenden Beispiel.

ID       Component   Severity   Description
NHC006   Network     Warning    One or more DNS resolvers are not reachable from certain worker nodes.

Wenn Sie die Details des Problems überprüfen, sehen Sie, auf welche DNS-Auflöser von welchem Arbeitsknoten aus nicht zugegriffen werden kann.

ibmcloud ks cluster health issue get --cluster <CLUSTER_ID> --issue NHC006

Diese Warnung zeigt an, dass einige Arbeitsknoten nicht in der Lage sind, einen oder mehrere DNS-Auflöser zu erreichen. Dies kann zu DNS-Fehlern führen und die Workload-Kommunikation beeinträchtigen.

  1. Überprüfen Sie Calico GlobalNetworkPolicies (GNP), indem Sie alle GNPs auflisten.

    kubectl get globalnetworkpolicies.crd.projectcalico.org
    

    Führen Sie den folgenden Befehl aus, um eine bestimmte Richtlinie zu überprüfen.

    kubectl get globalnetworkpolicies.crd.projectcalico.org <policy-name> -o yaml
    
  2. Suchen Sie nach egress Regeln, die den DNS-Verkehr blockieren ( UDP / TCP port 53). Überprüfen Sie auch die Felder von selector, die fälschlicherweise Arbeiterknoten enthalten könnten.

  3. Überprüfung der DNS-Erreichbarkeit von Arbeitsknoten mit einem Debug-Pod

    kubectl run  -i --tty debug \
      --image=us.icr.io/armada-master/network-alpine:latest \
      --restart=Never \
      --overrides='
    {
      "apiVersion": "v1",
      "spec": {
        "nodeName": "<node-name>"
      }
    }' -- sh
    
  4. Führen Sie die folgenden Befehle im Debug-Pod aus. Wenn dies nicht gelingt, wird DNS möglicherweise durch Richtlinien oder IaaS-level Konfigurationen blockiert.

    nslookup ibm.com
    
    dig ibm.com
    
  5. Überprüfen Sie Ihre Infrastruktur (Netzwerkgeräte, ACLs usw.) und erlauben Sie UDP und TCP Anschluss 53 ausgehenden Datenverkehr.

  6. Wenn das Problem weiterhin besteht, wenden Sie sich bitte an den Support, um weitere Unterstützung zu erhalten. Öffnen Sie einen Supportfall. Fügen Sie den Falldetails unbedingt alle relevanten Protokolldateien, Fehlermeldungen oder Befehlsausgaben bei.