準備 IBM Cloud 主機維護更新與安全性強化措施

瞭解如何協助您的 IBM Cloud 工作人員為主機維護更新做好準備、將中斷影響降至最低,並確保安全強化措施能順利套用。

IBM 工程師會執行主機維護,以提升系統穩定性、強化安全性,並支援即將推出的新功能。IBM Cloud 基礎架構供應商會對託管 Virtual Servers 的主機進行維護,這些主機在您的叢集中用作工作節點,這可能會導致部分工作節點短暫離線。 不過,在維護期間之前,您可以採取一些動作,將工作者節點的毀壞降到最低。 在維護時間之前,會將含有維護詳細資料及受影響工作者清單的通知傳送給客戶。 請遵循下列步驟,讓工作者準備好迎接即將到來的維護期間。

識別受影響的工作者

如果您的工作者已排定進行維護,則您會在維護時間開始之前收到通知。 受影響的工作者清單包括在通知中。

受影響元件的清單可能與以下範例類似。 這裡說明的步驟適用於 IBM Kubernetes Service 或 IBM Cloud Workers 區段上 Red Hat OpenShift 中列出的工作者節點。

**Virtual Server Instances scheduled for maintenance**
    Virtual Server Instances in your account:
           ID                                           Name
           1111_1a111aaa-1a1a-1aa1-1111-a11a111a1111    my_vpc_cluster_1
    Virtual Server Instances in service accounts:
        Application Load Balancer
            alb-11aa111a-1111111
    
        IBM Kubernetes Service or Red Hat OpenShift on IBM Cloud workers
            kube-aaaa1aaa111aa11aa11a-aaaaaaaaaaa-aaaaaaa-00001a11
            kube-aaaa2aaa222aa22aa22a-aaaaaaaaaaa-aaaaaaa-00002a22
            kube-aaaa3aaa333aa33aa33a-aaaaaaaaaaa-aaaaaaa-00003a33

維護期間之前要採取的動作

請遵循下列步驟,為工作者準備維護期間。 無法在排定進行維護的主機上排定工作者。 您可以透過重新開機或更換工作者節點,讓它們移至未進行維護的不同主機,來避免中斷工作量。

標準叢集中的工作者節點

遵循步驟,在維護期間開始之前將工作者重新開機。

  1. 封鎖工人

    oc adm cordon <worker_id>
    
  2. 排除工作者。

    排水命令範例

    oc adm drain <worker_id>
    

    排水命令範例 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. 將工作者重新開機。 請確定您包含 --hard 選項。

    ibmcloud oc worker reboot --cluster <cluster_name_or_id> --worker <worker_id> --hard
    
  4. 將工作者標示為可排程。

    oc adm uncordon <worker_id>
    

VPC 叢集裡的工作者節點

對於 VPC 叢集裡的工作者節點,要採取的步驟取決於工作者節點的特性。 若要檢查工作者節點的特性,請執行 ibmcloud oc worker get --worker <worker_id> --cluster <cluster_name_or_id>。

針對 VPC 虛擬伺服器實例 (VSI) 工作執行個體(不具備本機儲存空間的工作執行個體):

  1. 封鎖工人

    oc adm cordon <worker_id>
    
  2. 排除工作者。 在某些情況下,例如 Cloud Pak for Data,您可能需要指定額外的排水選項。

    排水命令範例

    oc adm drain <worker_id>
    

    排水命令範例 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. 取代工作者。

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>
    
  4. 將工作者標示為可排程。

    oc adm uncordon <worker_id>
    

致 VPC 裸機工作人員:

VPC 裸機工作節點支援 worker reload 指令,該指令可在不配置新工作節點的情況下,直接重新載入現有節點。 該節點保留其 IP 位址及其他識別碼。 若尚有韌體更新待處理,系統將在重新載入過程中自動執行該更新,這可能會使總重新載入時間增加 30 分鐘或更久。 如果您的裸機工作器具備本機儲存空間,請在開始之前備份所有未儲存於持久性儲存裝置上的資料,因為在重新載入過程中,本機磁碟上的資料將會遺失。

第一部分:為維修作業做好人員準備

  1. 如果您的 Worker 具備本地儲存空間,請在繼續操作之前,先備份任何您希望保留的資料。 在重新載入過程中,本地磁碟上的資料將會遺失。

  2. 將該工作程序隔離,以防止新的工作負載被排程至該程序上。

    oc adm cordon <worker_id>
    
  3. 將工作節點清空,以移除現有的工作負載。 在某些情況下,例如 Cloud Pak for Data,您可能需要指定額外的排水選項。

    排水命令範例

    oc adm drain <worker_id>
    

    排水命令範例 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    

第 2 部分:執行維護

  1. 重新載入工作程序。 該節點會在未進行維護的主機上就地重新載入,並保留其 IP 位址。

    ibmcloud oc worker reload --cluster <cluster_name_or_id> --worker <worker_id>
    

    此外,您也可以直接替換該工作程序,而非重新載入它。 替換工作節點會刪除現有節點,並配置一個具有新 IP 位址的新節點。

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>