ワーカー・ノードのデバッグ

仮想プライベートクラウド クラシック・インフラストラクチャー

ワーカー・ノードをデバッグするためのオプションを確認し、障害の根本原因を探します。

ワーカー・ノードの通知と保守更新を確認する

IBM Cloud の正常性と状況のダッシュボードで、ワーカー・ノードに関連する可能性がある通知や保守更新がないかを確認します。 これらの通知または更新は、ワーカー・ノードの障害の原因を判別するのに役立ちます。

  1. クラシック・クラスター アカウント内のクラシック・ワーカー・ノードに影響を与える可能性がある IBM Cloud の緊急時保守通知がないか、正常性ダッシュボード を確認します。 保守通知の性質によっては、ワーカー・ノードのリブートまたは再ロードが必要になる場合があります。
  2. ワーカー・ノードまたはクラスターに影響する可能性がある既知の問題がないか、 IBM Cloud 状況ダッシュボード を確認します。 以下のいずれかのコンポーネントがエラー状況を示している場合、そのコンポーネントがワーカー・ノードの中断の原因である可能性があります。
    • すべてのクラスターについて、 Kubernetes Service および Container Registry コンポーネントを確認します。
    • VPC クラスターの場合は、 仮想プライベート・クラウド仮想プライベート・エンドポイント 、および Virtual Server for VPC の各コンポーネントを確認します。
    • クラシック・クラスターの場合は、 「クラシック・インフラストラクチャーのプロビジョニング」 コンポーネントと Virtual Servers コンポーネントを確認します。

ワーカー・ノードの問題を解決するためのクイック・ステップ

ワーカー・ノードが予期したとおりに機能しない場合は、以下の手順に従って、クラスターおよびコマンド・ライン・ツールを更新するか、診断テストを実行してください。 問題が解決しない場合は、ワーカー・ノードのデバッグで追加の手順を参照してください。

  1. クラスターとワーカー・ノードを最新バージョンに更新します
  2. コマンド・ライン・ツールを更新します

ワーカー・ノードのデバッグ

ステップ 1: ワーカー・ノードの状態を取得する

クラスターが CriticalDelete failed、または Warning 状態の場合、あるいは Pending 状態が長時間続いている場合は、ワーカー・ノードの状態を確認してください。

ibmcloud ks worker ls --cluster CLUSTER_NAME_OR_ID

ステップ 2: ワーカー・ノードの状態を確認する

CLI 出力内ですべてのワーカー・ノードの State フィールドと Status フィールドを確認します。

詳しくは、ワーカー・ノードの状態を参照してください。

ステップ 3: 各ワーカー・ノードの詳細を取得する

ワーカー・ノードの詳細情報を取得します。 詳細情報にエラー・メッセージが含まれている場合は、ワーカー・ノードに関する一般的なエラー・メッセージのリストを参照して、問題の解決方法を確認してください。

ibmcloud ks worker get --cluster CLUSTER_NAME_OR_ID --worker WORKER_NODE_ID

ステップ 4: ワーカー・ノードのインフラストラクチャー・プロバイダーを確認する

インフラストラクチャー環境を確認して、ワーカー・ノードの問題の原因になっている他の理由があるかどうかを調べます。

  1. ネットワーキング・チームに問い合わせて、ファイアウォールやサブネットの更新などの最近の保守がワーカー・ノード接続に影響していないかどうかを確認します。
  2. レビュー IBM Cloud 対象: IBM Cloud Kubernetes Service および基盤となるインフラストラクチャプロバイダー(例: Virtual Servers クラシック版や VPC 関連のコンポーネントについては、あるいは Satellite など。
  3. 基礎となるインフラストラクチャー (クラシックの Virtual Servers など) に対するアクセス権限がある場合は、ワーカー・ノードに対応するマシンの詳細を確認します。