針對工作者節點進行除錯

虛擬專用雲端 經典基礎設施

檢閱針對工作者節點進行除錯的選項,並尋找故障的主要原因。

檢查工作者節點通知及維護更新

請檢查 IBM Cloud 性能及狀態儀表板,以取得可能與工作者節點相關的任何通知或維護更新項目。 這些通知或更新項目可能有助於判斷工作者節點失敗的原因。

  1. 標準叢集 檢查性能儀表板 是否有任何 IBM Cloud 緊急維護通知可能會影響您帳戶中的標準工作者節點。 視維護通知的本質而定,您可能需要重新開機或重新載入工作者節點。
  2. 請檢查 IBM Cloud 狀態儀表板,以找出可能影響工作者節點或叢集的任何已知問題。 如果下列任何元件顯示錯誤狀態,則該元件可能是工作者節點中斷的原因。
    • 對於所有叢集,請檢查 Kubernetes ServiceContainer Registry 元件。
    • 若為 VPC 叢集,請檢查 Virtual Private CloudVirtual Private EndpointVirtual Server for VPC 元件。
    • 若為標準叢集,請檢查 標準基礎架構供應Virtual Servers 元件。

解決工作者節點問題的快速步驟

如果工作者節點未如預期般運作,您可以遵循下列步驟來更新叢集及指令行工具,或執行診斷測試。 如果問題持續存在,請參閱 對工作者節點進行除錯,以取得其他步驟。

  1. 將叢集和工作者節點更新至最新版本
  2. 更新指令行工具

對工作者節點進行除錯

步驟 1: 取得工作者節點狀態

如果叢集處於 CriticalDelete failedWarning 狀況,或停留在 Pending 狀況很長一段時間,請檢閱工作者節點的狀況。

ibmcloud ks worker ls --cluster CLUSTER_NAME_OR_ID

步驟 2: 檢閱工作者節點狀態

請檢閱 CLI 輸出中每個工作者節點的 StateStatus 欄位。

如需更多資訊,請參閱「工作節點狀態」。

步驟 3:取得每個工作節點的詳細資訊

取得工作節點的詳細資訊。 如果詳細資料包含錯誤訊息,請檢閱工作者節點的一般錯誤訊息清單,以瞭解如何解決問題。

ibmcloud ks worker get --cluster CLUSTER_NAME_OR_ID --worker WORKER_NODE_ID

步驟 4: 檢閱工作者節點的基礎架構提供者

請檢閱基礎架構環境,以檢查可能導致工作者節點問題的其他原因。

  1. 請洽詢您的網路團隊,以確保最近沒有任何維護 (例如防火牆或子網路更新項目) 可能會影響工作者節點連線。
  2. 針對 IBM Cloud Kubernetes Service 及基礎架構提供者 (例如 Virtual Servers for classic、VPC 相關元件或 Satellite),檢閱 IBM Cloud
  3. 如果您有權存取基礎架構 (例如標準 Virtual Servers),請檢閱工作者節點對應機器的詳細資料。