IBM Cloud 호스트 유지 관리 업데이트 및 보안 기능 강화 준비

IBM Cloud 작업자들이 호스트 유지 관리 업데이트에 대비할 수 있도록 준비하고, 서비스 중단을 최소화하며, 보안 강화 조치가 원활하게 적용되도록 하는 방법을 알아보세요.

IBM 엔지니어들은 안정성을 높이고, 보안을 강화하며, 향후 출시될 새로운 기능을 지원하기 위해 호스트 유지보수를 수행합니다. IBM Cloud 인프라 제공업체는 클러스터에서 워커로 사용되는 Virtual Servers 를 호스팅하는 호스트에 대한 유지보수를 수행하며, 이로 인해 일부 워커가 잠시 오프라인 상태가 될 수 있습니다. 그러나 작업자 노드에 대한 중단을 최소화할 수 있는 유지보수 기간 전에 수행할 수 있는 조치가 있습니다. 유지보수 세부사항 및 영향을 받는 작업자 목록이 있는 알림은 유지보수 기간 전에 고객에게 전송됩니다. 다음 단계에 따라 향후 유지보수 기간 동안 작업자를 준비하십시오.

영향을 받는 작업자 식별

작업자가 유지보수를 수행하도록 스케줄된 경우 유지보수 창이 시작되기 전에 알림을 수신합니다. 영향을 받는 작업자 목록이 알림에 포함됩니다.

영향을 받는 구성 요소 목록은 다음 예시와 비슷할 수 있습니다. 여기에 문서화된 단계는 IBM Kubernetes Service 또는 Red Hat OpenShift on IBM Cloud Workers 섹션에 나열된 작업자에게 적용됩니다.

**Virtual Server Instances scheduled for maintenance**
    Virtual Server Instances in your account:
           ID                                           Name
           1111_1a111aaa-1a1a-1aa1-1111-a11a111a1111    my_vpc_cluster_1
    Virtual Server Instances in service accounts:
        Application Load Balancer
            alb-11aa111a-1111111
    
        IBM Kubernetes Service or Red Hat OpenShift on IBM Cloud workers
            kube-aaaa1aaa111aa11aa11a-aaaaaaaaaaa-aaaaaaa-00001a11
            kube-aaaa2aaa222aa22aa22a-aaaaaaaaaaa-aaaaaaa-00002a22
            kube-aaaa3aaa333aa33aa33a-aaaaaaaaaaa-aaaaaaa-00003a33

유지보수 기간 전에 수행할 조치

유지보수 기간 동안 작업자를 준비하려면 다음 단계를 수행하십시오. 유지보수를 위해 스케줄된 호스트에서 작업자를 스케줄할 수 없습니다. 유지보수 중이 아닌 다른 호스트로 이동하도록 작업자를 다시 부팅하거나 대체하여 워크로드가 중단되지 않도록 할 수 있습니다.

클래식 클러스터의 작업자

유지보수 기간이 시작되기 전에 작업자를 다시 부팅하는 단계를 수행하십시오.

  1. 작업자를 확인하십시오.

    oc adm cordon <worker_id>
    
  2. 작업자를 비우십시오.

    배수 명령 예제

    oc adm drain <worker_id>
    

    다음에 대한 배수 명령 예제 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. 작업자를 다시 부팅하십시오. --hard 옵션을 포함해야 합니다.

    ibmcloud oc worker reboot --cluster <cluster_name_or_id> --worker <worker_id> --hard
    
  4. 작업자를 스케줄에 사용 가능한 것으로 표시하십시오.

    oc adm uncordon <worker_id>
    

VPC 클러스터의 작업자

VPC 클러스터에 있는 작업자의 경우 수행할 단계는 작업자 노드의 특성에 따라 다릅니다. 작업자 노드의 특성을 확인하려면 ibmcloud oc worker get --worker <worker_id> --cluster <cluster_name_or_id> 를 실행하십시오.

VPC 가상 서버 인스턴스(VSI) 워커(로컬 스토리지가 없는 워커)의 경우:

  1. 작업자를 확인하십시오.

    oc adm cordon <worker_id>
    
  2. 작업자를 비우십시오. Cloud Pak for Data 와 같은 일부 시나리오에서는 추가 드레인 옵션을 지정해야 할 수도 있습니다.

    배수 명령 예제

    oc adm drain <worker_id>
    

    다음에 대한 배수 명령 예제 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. 작업자를 교체하십시오.

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>
    
  4. 작업자를 스케줄에 사용 가능한 것으로 표시하십시오.

    oc adm uncordon <worker_id>
    

VPC 베어 메탈 담당자분들께:

VPC 베어 메탈 워커는 worker reload 명령어를 지원하며, 이 명령어를 사용하면 새로운 워커 노드를 프로비저닝하지 않고도 해당 노드를 그대로 재시작할 수 있습니다. 노드는 자신의 IP 주소와 기타 식별자를 유지합니다. 펌웨어 업데이트가 대기 중인 경우, 재시작 과정의 일부로 자동으로 적용되며, 이로 인해 총 재시작 시간이 30분 이상 늘어날 수 있습니다. 베어 메탈 작업자가 로컬 스토리지를 사용하는 경우, 작업을 시작하기 전에 영구 스토리지에 저장되지 않은 모든 데이터를 백업하십시오. 재로딩 과정에서 로컬 디스크에 있는 데이터는 손실되기 때문입니다.

1부: 유지보수를 위해 작업자 준비하기

  1. 작업자에 로컬 저장소가 있는 경우, 작업을 진행하기 전에 보존하고자 하는 데이터를 모두 백업하십시오. 재로드 과정에서 로컬 디스크에 저장된 데이터가 손실됩니다.

  2. 해당 작업자에 대한 새로운 작업 부하가 스케줄링되지 않도록 차단하십시오.

    oc adm cordon <worker_id>
    
  3. 워커를 비워 기존 워크로드를 제거합니다. Cloud Pak for Data 와 같은 일부 시나리오에서는 추가 드레인 옵션을 지정해야 할 수도 있습니다.

    배수 명령 예제

    oc adm drain <worker_id>
    

    다음에 대한 배수 명령 예제 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    

2부: 유지 관리 적용

  1. 워커를 다시 불러오세요. 해당 노드는 유지보수 중이 아닌 호스트에서 그대로 다시 로드되며, IP 주소를 유지합니다.

    ibmcloud oc worker reload --cluster <cluster_name_or_id> --worker <worker_id>
    

    또는, 워커를 다시 불러오는 대신 교체할 수도 있습니다. 작업자를 교체하면 기존 노드가 삭제되고, 새로운 IP 주소를 가진 새로운 노드가 프로비저닝됩니다.

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>