네트워크 상태에 NHC004 오류가 표시되는 이유는 무엇인가요?
가상 사설 클라우드
네트워크 상태 확인 오류 NHC004 의 문제 해결.
ibmcloud oc cluster health issues --cluster <CLUSTER_ID> 을 실행하여 클러스터의 상태를 확인하면 다음 예와 유사한 오류가 표시됩니다.
ID Component Severity Description
NHC004 Network Warning Some worker nodes in the cluster can not resolve VPE gateway hostnames.
이 경고는 VPE(가상 사설 엔드포인트)와 연결된 호스트 이름에 대해 DNS 확인이 실패했음을 나타냅니다. 이는 서비스에 IBM Cloud 대한 비공개 연결성에 의존하는 서비스에 영향을 미칠 수 있습니다.
작업자 노드에 올바른 DNS 확인자가 구성되어 있고 VPE 게이트웨이 호스트 이름을 확인할 수 있는지 확인하세요. 다음 단계는 DNS 확인 문제가 연결할 수 없는 VPE 엔드포인트 또는 잘못된 구성으로 인한 것인지 확인하는 데 도움이 됩니다.
VPC 클러스터용 VPE 게이트웨이를 찾는 방법
IBM Cloud Kubernetes Service 클러스터에서 사용하는 VPE 게이트웨이를 식별하려면 다음 단계를 따르세요:
1단계. IBM Cloud CLI를 사용하여 엔드포인트 게이트웨이를 나열합니다
-
다음 명령을 실행하여 VPC의 모든 VPE(엔드포인트) 게이트웨이를 나열합니다.
ibmcloud is endpoint-gateways특정 VPC에 대한 VPE를 나열하는 명령 예시입니다.
ibmcloud is endpoint-gateways --vpc <VPC-ID> -
iks-cluster_ID에 대한 출력을 필터링하고Service Endpoints을 찾습니다. 여기에는 관련 서비스, IP 주소 및 엔드포인트 이름이 표시됩니다.
2단계. IBM Cloud 콘솔을 사용하여 엔드포인트 게이트웨이를 나열합니다
- VPC 인프라 > 엔드포인트 게이트웨이로 이동합니다
- VPC 선택
- 비공개 서비스 액세스를 위해 구성된 게이트웨이를 검토하고 DNS/IP 정보 보기
3단계. VPE 게이트웨이 호스트 이름을 찾은 후 다음 단계를 완료합니다.
-
워커 노드에서 실행 중인 파드에서 디버그 셸을 실행합니다:
kubectl run -i --tty debug --image=us.icr.io/armada-master/network-alpine:latest --restart=Never -- sh -
포드 내에서 VPE 게이트웨이 호스트 이름을 확인해보세요.
nslookup <vpe-hostname>dig <vpe-hostname> -
VPC DNS 서비스를 사용하여 직접 DNS 확인을 테스트합니다.
dig <vpe-hostname> @161.26.0.7dig <vpe-hostname> @161.26.0.8 -
클러스터에서 사용자 지정 DNS 구성(예: 수정된 CoreDNS 설정)을 사용하는 경우 구성을 검사합니다.
kubectl get configmap coredns -n kube-system -o yaml -
필요한 경우 CoreDNS 구성을 업데이트하여 VPE 확인 DNS 서버가 포함되도록 한 다음 CoreDNS 을 다시 로드합니다.
kubectl rollout restart deployment coredns -n kube-system -
VPC DNS 설정에서 VPE 호스트 이름에 대한 액세스를 허용하는지 확인합니다. IBM Cloud 콘솔에서 VPC > DNS 서비스로 이동하여 DNS 규칙의 유효성을 검사합니다.
-
IBM Cloud Kubernetes Service 의 VPE(Virtual private endpoint) 게이트웨이에 대한 자세한 내용은 VPE(Virtual private endpoint)게이트웨이를 참조하세요.
-
수정 후 몇 분 기다렸다가 클러스터 상태를 다시 확인합니다.
-
문제가 계속되면 지원팀에 문의하여 추가 도움을 받으십시오. 지원 케이스 열기 케이스 세부 정보에 관련 로그 파일, 오류 메시지 또는 명령 출력을 모두 포함해야 합니다.