네트워크 상태에 NHC004 오류가 표시되는 이유는 무엇인가요?

가상 사설 클라우드

네트워크 상태 확인 오류 NHC004 의 문제 해결.

ibmcloud oc cluster health issues --cluster <CLUSTER_ID> 을 실행하여 클러스터의 상태를 확인하면 다음 예와 유사한 오류가 표시됩니다.

ID       Component   Severity   Description
NHC004   Network     Warning    Some worker nodes in the cluster can not resolve VPE gateway hostnames.

이 경고는 VPE(가상 사설 엔드포인트)와 연결된 호스트 이름에 대해 DNS 확인이 실패했음을 나타냅니다. 이는 서비스에 IBM Cloud 대한 비공개 연결성에 의존하는 서비스에 영향을 미칠 수 있습니다.

작업자 노드에 올바른 DNS 확인자가 구성되어 있고 VPE 게이트웨이 호스트 이름을 확인할 수 있는지 확인하세요. 다음 단계는 DNS 확인 문제가 연결할 수 없는 VPE 엔드포인트 또는 잘못된 구성으로 인한 것인지 확인하는 데 도움이 됩니다.

VPC 클러스터용 VPE 게이트웨이를 찾는 방법

IBM Cloud Kubernetes Service 클러스터에서 사용하는 VPE 게이트웨이를 식별하려면 다음 단계를 따르세요:

1단계. IBM Cloud CLI를 사용하여 엔드포인트 게이트웨이를 나열합니다

  1. 다음 명령을 실행하여 VPC의 모든 VPE(엔드포인트) 게이트웨이를 나열합니다.

    ibmcloud is endpoint-gateways
    

    특정 VPC에 대한 VPE를 나열하는 명령 예시입니다.

    ibmcloud is endpoint-gateways --vpc <VPC-ID>
    
  2. iks-cluster_ID 에 대한 출력을 필터링하고 Service Endpoints 을 찾습니다. 여기에는 관련 서비스, IP 주소 및 엔드포인트 이름이 표시됩니다.

2단계. IBM Cloud 콘솔을 사용하여 엔드포인트 게이트웨이를 나열합니다

  1. VPC 인프라 > 엔드포인트 게이트웨이로 이동합니다
  2. VPC 선택
  3. 비공개 서비스 액세스를 위해 구성된 게이트웨이를 검토하고 DNS/IP 정보 보기

3단계. VPE 게이트웨이 호스트 이름을 찾은 후 다음 단계를 완료합니다.

  1. 워커 노드에서 실행 중인 파드에서 디버그 셸을 실행합니다:

    kubectl run -i --tty debug --image=us.icr.io/armada-master/network-alpine:latest --restart=Never -- sh
    
  2. 포드 내에서 VPE 게이트웨이 호스트 이름을 확인해보세요.

    nslookup <vpe-hostname>
    
    dig <vpe-hostname>
    
  3. VPC DNS 서비스를 사용하여 직접 DNS 확인을 테스트합니다.

    dig <vpe-hostname> @161.26.0.7
    
    dig <vpe-hostname> @161.26.0.8
    
  4. 클러스터에서 사용자 지정 DNS 구성(예: 수정된 CoreDNS 설정)을 사용하는 경우 구성을 검사합니다.

    kubectl get configmap coredns -n kube-system -o yaml
    
  5. 필요한 경우 CoreDNS 구성을 업데이트하여 VPE 확인 DNS 서버가 포함되도록 한 다음 CoreDNS 을 다시 로드합니다.

    kubectl rollout restart deployment coredns -n kube-system
    
  6. VPC DNS 설정에서 VPE 호스트 이름에 대한 액세스를 허용하는지 확인합니다. IBM Cloud 콘솔에서 VPC > DNS 서비스로 이동하여 DNS 규칙의 유효성을 검사합니다.

  • IBM Cloud Kubernetes Service 의 VPE(Virtual private endpoint) 게이트웨이에 대한 자세한 내용은 VPE(Virtual private endpoint)게이트웨이를 참조하세요.

  • 수정 후 몇 분 기다렸다가 클러스터 상태를 다시 확인합니다.

  • 문제가 계속되면 지원팀에 문의하여 추가 도움을 받으십시오. 지원 케이스 열기 케이스 세부 정보에 관련 로그 파일, 오류 메시지 또는 명령 출력을 모두 포함해야 합니다.