IBM Cloud のホストメンテナンス更新プログラムおよびセキュリティ強化機能の準備

IBM Cloud のワーカーをホストのメンテナンス更新に備えさせ、業務への影響を最小限に抑え、セキュリティ強化が円滑に適用されるようにする方法について学びましょう。

IBM エンジニアは、安定性の向上、セキュリティ強化、および今後導入される新機能への対応を目的として、ホストのメンテナンスを実施します。 IBM Cloud インフラストラクチャプロバイダーは、クラスター内のワーカーとして使用される Virtual Servers を収容するホストのメンテナンスを実施しますが、これにより一部のワーカーが一時的にオフラインになる場合があります。 ただし、ワーカー・ノードの中断を最小限に抑えるために、保守期間の前に実行できるアクションがあります。 保守期間の前に、保守の詳細と影響を受ける作業者のリストが記載された通知が顧客に送信されます。 今後の保守期間に備えて作業者を準備するには、以下の手順を実行します。

影響を受けるワーカーの識別

作業者が保守を受けるようにスケジュールされている場合は、保守期間の開始前に通知を受け取ります。 影響を受けるワーカーのリストが通知に含まれます。

影響を受けるコンポーネントの一覧は、以下の例のようなものになる可能性があります。 ここに記載されているステップは、 IBM Cloud ワーカーの IBM Kubernetes Service または Red Hat OpenShift セクションにリストされているワーカーに適用されます。

**Virtual Server Instances scheduled for maintenance**
    Virtual Server Instances in your account:
           ID                                           Name
           1111_1a111aaa-1a1a-1aa1-1111-a11a111a1111    my_vpc_cluster_1
    Virtual Server Instances in service accounts:
        Application Load Balancer
            alb-11aa111a-1111111
    
        IBM Kubernetes Service or Red Hat OpenShift on IBM Cloud workers
            kube-aaaa1aaa111aa11aa11a-aaaaaaaaaaa-aaaaaaa-00001a11
            kube-aaaa2aaa222aa22aa22a-aaaaaaaaaaa-aaaaaaa-00002a22
            kube-aaaa3aaa333aa33aa33a-aaaaaaaaaaa-aaaaaaa-00003a33

保守期間の前に実行するアクション

保守期間の作業者を準備するには、以下の手順を実行します。 保守がスケジュールされているホスト上でワーカーをスケジュールすることはできません。 保守が行われていない別のホストにワーカーが移動するようにリブートまたは置換することで、ワークロードの中断を回避できます。

クラシック・クラスターのワーカー

保守期間が始まる前に、手順に従ってワーカーをリブートします。

  1. 作業者にコードンを付けます。

    oc adm cordon <worker_id>
    
  2. ワーカーをドレーンします。

    ドレイン・コマンドの例

    oc adm drain <worker_id>
    

    ドレインコマンドの例 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. ワーカーをリブートします。 必ず --hard。

    ibmcloud oc worker reboot --cluster <cluster_name_or_id> --worker <worker_id> --hard
    
  4. ワーカーにスケジュール可能としてマークを付けます。

    oc adm uncordon <worker_id>
    

VPC クラスター内のワーカー

VPC クラスター内のワーカーの場合、実行するステップはワーカー・ノードのフレーバーによって異なります。 ワーカー・ノードのフレーバーを確認するには、 ibmcloud oc worker get --worker <worker_id> --cluster <cluster_name_or_id> を実行します。

VPC 仮想サーバーインスタンス(VSI)のワーカー(ローカルストレージを持たないワーカー)の場合:

  1. 作業者にコードンを付けます。

    oc adm cordon <worker_id>
    
  2. ワーカーをドレーンします。 Cloud Pak for Data のようなシナリオでは、追加のドレインオプションを指定する必要があるかもしれない。

    ドレイン・コマンドの例

    oc adm drain <worker_id>
    

    ドレインコマンドの例 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. ワーカーを置き換えます。

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>
    
  4. ワーカーにスケジュール可能としてマークを付けます。

    oc adm uncordon <worker_id>
    

VPCのベアメタル担当者の方へ:

VPCベアメタルワーカーは、 worker reload コマンドをサポートしています。このコマンドを実行すると、新しいワーカーノードをプロビジョニングすることなく、その場でノードを再読み込みします。 そのノードは、IPアドレスやその他の識別子を保持し続けます。 ファームウェアの更新が保留中の場合、再読み込みの一環として自動的に適用され、再読み込みにかかる合計時間が30分以上長くなる可能性があります。 ベアメタルワーカーにローカルストレージがある場合は、作業を開始する前に、永続ストレージに保存されていないデータをすべてバックアップしてください。リロードを行うと、ローカルディスク上のデータは失われてしまうためです。

第1部:作業員による保守作業の準備

  1. ワーカーにローカルストレージがある場合は、作業を進める前に、保存しておきたいデータをすべてバックアップしてください。 リロード中に、ローカルディスク上のデータが失われます。

  2. そのワーカーを隔離し、新たなワークロードがそこにスケジューリングされないようにする。

    oc adm cordon <worker_id>
    
  3. ワーカーの処理を終了させ、既存のワークロードを強制終了させます。 Cloud Pak for Data のようなシナリオでは、追加のドレインオプションを指定する必要があるかもしれない。

    ドレイン・コマンドの例

    oc adm drain <worker_id>
    

    ドレインコマンドの例 Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    

第2部:メンテナンスの実施

  1. ワーカーを再読み込みしてください。 そのノードは、メンテナンスが行われていないホスト上でその場から再読み込みされ、IPアドレスは維持されます。

    ibmcloud oc worker reload --cluster <cluster_name_or_id> --worker <worker_id>
    

    あるいは、ワーカーを再読み込みする代わりに、ワーカーを置き換えることもできます。 ワーカーを置き換えると、既存のノードが削除され、新しいIPアドレスを持つ新しいノードがプロビジョニングされます。

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>