ワーカー・ノードのデバッグ
仮想プライベートクラウド クラシック・インフラストラクチャー
ワーカー・ノードをデバッグするためのオプションを確認し、障害の根本原因を探します。
ワーカー・ノードの通知と保守更新を確認する
IBM Cloud の正常性と状況のダッシュボードで、ワーカー・ノードに関連する可能性がある通知や保守更新がないかを確認します。 これらの通知または更新は、ワーカー・ノードの障害の原因を判別するのに役立ちます。
- クラシック・クラスター アカウント内のクラシック・ワーカー・ノードに影響を与える可能性がある IBM Cloud の緊急時保守通知がないか、正常性ダッシュボード を確認します。 保守通知の性質によっては、ワーカー・ノードのリブートまたは再ロードが必要になる場合があります。
- ワーカー・ノードまたはクラスターに影響する可能性がある既知の問題がないか、 IBM Cloud 状況ダッシュボード を確認します。 以下のいずれかのコンポーネントがエラー状況を示している場合、そのコンポーネントがワーカー・ノードの中断の原因である可能性があります。
- すべてのクラスターについて、 Kubernetes Service および Container Registry コンポーネントを確認します。
- VPC クラスターの場合は、 仮想プライベート・クラウド、 仮想プライベート・エンドポイント 、および Virtual Server for VPC の各コンポーネントを確認します。
- クラシック・クラスターの場合は、 「クラシック・インフラストラクチャーのプロビジョニング」 コンポーネントと Virtual Servers コンポーネントを確認します。
ワーカー・ノードの問題を解決するためのクイック・ステップ
ワーカー・ノードが予期したとおりに機能しない場合は、以下の手順に従って、クラスターおよびコマンド・ライン・ツールを更新するか、診断テストを実行してください。 問題が解決しない場合は、ワーカー・ノードのデバッグで追加の手順を参照してください。
ワーカー・ノードのデバッグ
ステップ 1: ワーカー・ノードの状態を取得する
クラスターが Critical、Delete failed、または Warning 状態の場合、あるいは Pending 状態が長時間続いている場合は、ワーカー・ノードの状態を確認してください。
ibmcloud ks worker ls --cluster CLUSTER_NAME_OR_ID
ステップ 2: ワーカー・ノードの状態を確認する
CLI 出力内ですべてのワーカー・ノードの State フィールドと Status フィールドを確認します。
詳しくは、ワーカー・ノードの状態を参照してください。
ステップ 3: 各ワーカー・ノードの詳細を取得する
ワーカー・ノードの詳細情報を取得します。 詳細情報にエラー・メッセージが含まれている場合は、ワーカー・ノードに関する一般的なエラー・メッセージのリストを参照して、問題の解決方法を確認してください。
ibmcloud ks worker get --cluster CLUSTER_NAME_OR_ID --worker WORKER_NODE_ID
ステップ 4: ワーカー・ノードのインフラストラクチャー・プロバイダーを確認する
インフラストラクチャー環境を確認して、ワーカー・ノードの問題の原因になっている他の理由があるかどうかを調べます。
- ネットワーキング・チームに問い合わせて、ファイアウォールやサブネットの更新などの最近の保守がワーカー・ノード接続に影響していないかどうかを確認します。
- レビュー IBM Cloud 対象: IBM Cloud Kubernetes Service および基盤となるインフラストラクチャプロバイダー(例: Virtual Servers クラシック版や VPC 関連のコンポーネントについては、あるいは Satellite など。
- 基礎となるインフラストラクチャー (クラシックの Virtual Servers など) に対するアクセス権限がある場合は、ワーカー・ノードに対応するマシンの詳細を確認します。