準備 IBM Cloud 主機維護更新與安全性強化措施
瞭解如何協助您的 IBM Cloud 工作人員為主機維護更新做好準備、將中斷影響降至最低,並確保安全強化措施能順利套用。
IBM 工程師會執行主機維護,以提升系統穩定性、強化安全性,並支援即將推出的新功能。IBM Cloud 基礎架構供應商會對託管 Virtual Servers 的主機進行維護,這些主機在您的叢集中用作工作節點,這可能會導致部分工作節點短暫離線。 不過,在維護期間之前,您可以採取一些動作,將工作者節點的毀壞降到最低。 在維護時間之前,會將含有維護詳細資料及受影響工作者清單的通知傳送給客戶。 請遵循下列步驟,讓工作者準備好迎接即將到來的維護期間。
識別受影響的工作者
如果您的工作者已排定進行維護,則您會在維護時間開始之前收到通知。 受影響的工作者清單包括在通知中。
受影響元件的清單可能與以下範例類似。 這裡說明的步驟適用於 IBM Kubernetes Service 或 IBM Cloud Workers 區段上 Red Hat OpenShift 中列出的工作者節點。
**Virtual Server Instances scheduled for maintenance**
Virtual Server Instances in your account:
ID Name
1111_1a111aaa-1a1a-1aa1-1111-a11a111a1111 my_vpc_cluster_1
Virtual Server Instances in service accounts:
Application Load Balancer
alb-11aa111a-1111111
IBM Kubernetes Service or Red Hat OpenShift on IBM Cloud workers
kube-aaaa1aaa111aa11aa11a-aaaaaaaaaaa-aaaaaaa-00001a11
kube-aaaa2aaa222aa22aa22a-aaaaaaaaaaa-aaaaaaa-00002a22
kube-aaaa3aaa333aa33aa33a-aaaaaaaaaaa-aaaaaaa-00003a33
維護期間之前要採取的動作
請遵循下列步驟,為工作者準備維護期間。 無法在排定進行維護的主機上排定工作者。 您可以透過重新開機或更換工作者節點,讓它們移至未進行維護的不同主機,來避免中斷工作量。
標準叢集中的工作者節點
遵循步驟,在維護期間開始之前將工作者重新開機。
-
封鎖工人
oc adm cordon <worker_id> -
排除工作者。
排水命令範例
oc adm drain <worker_id>排水命令範例 Cloud Pak for Data
oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets -
將工作者重新開機。 請確定您包含
--hard選項。ibmcloud oc worker reboot --cluster <cluster_name_or_id> --worker <worker_id> --hard -
將工作者標示為可排程。
oc adm uncordon <worker_id>
VPC 叢集裡的工作者節點
對於 VPC 叢集裡的工作者節點,要採取的步驟取決於工作者節點的特性。 若要檢查工作者節點的特性,請執行 ibmcloud oc worker get --worker <worker_id> --cluster <cluster_name_or_id>。
針對 VPC 虛擬伺服器實例 (VSI) 工作執行個體(不具備本機儲存空間的工作執行個體):
-
封鎖工人
oc adm cordon <worker_id> -
排除工作者。 在某些情況下,例如 Cloud Pak for Data,您可能需要指定額外的排水選項。
排水命令範例
oc adm drain <worker_id>排水命令範例 Cloud Pak for Data
oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets -
取代工作者。
ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id> -
將工作者標示為可排程。
oc adm uncordon <worker_id>
致 VPC 裸機工作人員:
VPC 裸機工作節點支援 worker reload 指令,該指令可在不配置新工作節點的情況下,直接重新載入現有節點。 該節點保留其 IP 位址及其他識別碼。 若尚有韌體更新待處理,系統將在重新載入過程中自動執行該更新,這可能會使總重新載入時間增加 30 分鐘或更久。 如果您的裸機工作器具備本機儲存空間,請在開始之前備份所有未儲存於持久性儲存裝置上的資料,因為在重新載入過程中,本機磁碟上的資料將會遺失。
第一部分:為維修作業做好人員準備
-
如果您的 Worker 具備本地儲存空間,請在繼續操作之前,先備份任何您希望保留的資料。 在重新載入過程中,本地磁碟上的資料將會遺失。
-
將該工作程序隔離,以防止新的工作負載被排程至該程序上。
oc adm cordon <worker_id> -
將工作節點清空,以移除現有的工作負載。 在某些情況下,例如 Cloud Pak for Data,您可能需要指定額外的排水選項。
排水命令範例
oc adm drain <worker_id>排水命令範例 Cloud Pak for Data
oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
第 2 部分:執行維護
-
重新載入工作程序。 該節點會在未進行維護的主機上就地重新載入,並保留其 IP 位址。
ibmcloud oc worker reload --cluster <cluster_name_or_id> --worker <worker_id>此外,您也可以直接替換該工作程序,而非重新載入它。 替換工作節點會刪除現有節點,並配置一個具有新 IP 位址的新節點。
ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>