OpenShift Data Foundation のリージョン間災害復旧設定の確認

仮想プライベートクラウド 4.21 そしてその後

OpenShift Data Foundation (ODF) の地域災害復旧 (RDR) を設定したら、スタックを構成する各コンポーネントが正常に動作しており、適切に構成されていることを確認してください。 指示に従い、各セクションを、該当するクラスター、ハブ、またはマネージド環境ごとに順に処理してください。

ハブ・クラスタ上のACMアドオンの検証

ハブクラスタ

ハブクラスタで、以下の手順を実行してください。

  1. ACMアドオンがインストールされており、 normal の状態にあることを確認してください。 出力結果の中から「 acm 」アドオンを探し、ステータスが「 Addon Ready 」と表示されていることを確認してください。

    ibmcloud oc cluster addon ls --cluster HUB_CLUSTER_NAME | grep -i acm
    

    出力例:

    acm   2.15.0   normal   Addon Ready. For more info: http://ibm.biz/addon-state (H1500)
    

    ACM アドオンが一覧に表示されていない場合は、 ACM アドオンをインストールしてください

  2. ACM アドオン・ポッドが「 kube-system 」ネームスペースで実行されていることを確認してください。 「 acm-agent 」および「 ibm-acm-operator-controller-manager 」のポッドを探し、両方が「 Running 」ステータスを示していることを確認してください。

    oc get pods -n kube-system | grep acm
    

    出力例:

    acm-agent-6d9d49cbf6-tsmxd                           1/1   Running   118 (107m ago)   19d
    ibm-acm-operator-controller-manager-bc7b7f969-pr9lj   1/1   Running   3 (7d17h ago)    19d
    
  3. ACMオペレーターポッドと MultiClusterHub ポッドが、 open-cluster-management ネームスペース内で実行されていることを確認してください。

    oc get pods -n open-cluster-management
    

    出力例:

    multiclusterhub-operator-dcd787649-sqrcx     1/1   Running   0   14d
    console-chart-console-v2-7c8c6649cc-hmg6g    1/1   Running   0   15d
    submariner-addon-76986fdf45-v9kgm            1/1   Running   0   15d
    volsync-addon-controller-6575568dc6-6pjsb    1/1   Running   0   15d
    

    ポッドが欠落している場合や、「 Running 」ステータスになっていない場合は、「 ACM アドオンのインストール」を 参照してください。

マネージドクラスタがインポートされ、利用可能であることを確認する

ハブクラスタ

ハブクラスタで、次の手順を実行してください。

すべての管理対象クラスタが正常にインポートされていることを確認し、「 JOINED 」および「 AVAILABLE 」の両方の列に「 True 」と表示されていることを確認してください。

oc get managedclusters

出力例:

NAME             HUB ACCEPTED   MANAGED CLUSTER URLS                                 JOINED   AVAILABLE   AGE
local-cluster    true           https://c100.au-syd.containers.cloud.ibm.com:30253   True     True        14d
managedcluster1  true           https://c100.au-syd.containers.cloud.ibm.com:31003   True     True        14d
managedcluster2  true           https://c100.au-syd.containers.cloud.ibm.com:31888   True     True        14d

管理対象クラスタが存在しない、または利用できない場合は、 そのクラスタを再インポートしてください

サブマリーナーの接続確認

ハブクラスター マネージドクラスター

Submarinerは、管理対象のクラスター間でネットワーク接続を提供します。 指定されたクラスタについて、各サブセクションの手順をすべて実行してください。

ハブクラスタ上のSubmarinerオペレーターを確認してください

ハブクラスタ

  1. ハブクラスター 上でSubmarinerオペレーターポッドが実行されていることを確認してください。

    oc get pods -n submariner-operator
    

    出力例:

    NAME                                  READY   STATUS    RESTARTS      AGE
    submariner-operator-6bf8d56f74-7v44v  1/1     Running   3 (17h ago)   14d
    
  2. 各管理対象クラスターに対して、「Submariner」アドオンが登録されていることを確認してください。 各管理対象クラスタについて、「 AVAILABLE 」列に「 True 」と表示されていることを確認してください。

    oc get managedclusteraddon -A | grep submariner
    

    出力例:

    managedcluster1   submariner   True   False
    managedcluster2   submariner   True   False
    
  3. Submarinerブローカーが存在することを確認してください。

    oc get broker -A
    

    出力例:

    NAMESPACE                 NAME                AGE
    submariner-set1-broker    submariner-broker   12d
    

管理対象クラスター上のSubmarinerを確認する

マネージド・クラスター

各管理対象クラスター で、以下の手順を実行してください。

  1. 必要なSubmarinerポッドが実行されていることを確認してください。 submariner-gatewaysubmariner-routeagent、および submariner-globalnet の各ポッドが存在し、ステータスが「 Running 」となっていることを確認してください。

    oc get pods -n submariner-operator
    

    出力例:

    NAME                                              READY   STATUS    RESTARTS      AGE
    submariner-addon-bc6bbf579-wjqhq                  1/1     Running   0             12d
    submariner-gateway-hxcbh                          1/1     Running   0             12d
    submariner-globalnet-jbmxw                        1/1     Running   3 (12d ago)   12d
    submariner-lighthouse-agent-858896855b-xghxn      1/1     Running   0             12d
    submariner-lighthouse-coredns-66d5579b66-52f6j    1/1     Running   0             12d
    submariner-lighthouse-coredns-66d5579b66-jhqkm    1/1     Running   0             12d
    submariner-metrics-proxy-65n4c                    2/2     Running   3 (12d ago)   12d
    submariner-operator-7c99f89cfb-rppth              1/1     Running   2 (17h ago)   12d
    submariner-routeagent-27p7v                       1/1     Running   0             12d
    submariner-routeagent-jjw66                       1/1     Running   0             12d
    submariner-routeagent-nt78s                       1/1     Running   0             12d
    
  2. サブマリーナーとの接続が正常であることを確認してください。 出力結果において、 RouteAgentConnectionDegradedstatus"False" となっていることを確認してください。これにより、リモートエンドポイントへのすべてのルートエージェント接続が確立されており、正常に動作していることが確認できます。

    oc -n <managed_cluster_name> get managedclusteraddons submariner -o yaml
    

    出力例:

    status:
      - lastTransitionTime: "2026-03-18T03:36:24Z"
        message: All RouteAgent connections to remote endpoints are established and healthy.
        reason: ConnectionsEstablished
        status: "False"
        type: RouteAgentConnectionDegraded
    

    接続状態が悪化した場合は、 ODF地域災害復旧設定の手順4 に従って、Submarinerを再インストールしてください。

管理対象クラスタでのODFの検証

マネージド・クラスター

各管理対象クラスター で、以下の手順を実行してください。

  1. ODF( StorageCluster )の準備が整っていること、およびCephのヘルス状態が「 HEALTH_OK 」であることを確認してください。 出力結果において、 PHASE 列に StorageCluster に対して Ready が表示され、 HEALTH 列に CephCluster に対して HEALTH_OK が表示されていることを確認してください。

    oc get storagecluster -n openshift-storage
    oc get cephcluster -n openshift-storage
    

    出力例:

    NAME                 AGE   PHASE   EXTERNAL   CREATED AT             VERSION
    ocs-storagecluster   12d   Ready              2026-03-17T10:51:46Z   4.20.7
    NAME                              DATADIRHOSTPATH   MONCOUNT   AGE   PHASE   MESSAGE                       HEALTH      EXTERNAL   FSID
    ocs-storagecluster-cephcluster    /var/lib/rook     3          12d   Ready   Cluster created successfully  HEALTH_OK              5fb59e70-bd54-438f-9190-c09ddcf04c0c
    

    ODFを新規にインストールしたばかりで、アプリケーションがまだ展開されていない場合は、 ODFのインストールガイド に従ってODFを再インストールすることを検討してください。

  2. 必要な ServiceExports が存在することを確認してください。 「 ocs-provider-server 」および「 rook-ceph-mon-* 」と「 rook-ceph-osd-* 」のエントリが一覧に表示されていることを確認してください。

    oc get serviceexports -n openshift-storage
    

    出力例:

    NAME                  AGE
    ocs-provider-server   12d
    rook-ceph-mon-d       12d
    rook-ceph-mon-e       12d
    rook-ceph-mon-f       12d
    rook-ceph-osd-0       12d
    rook-ceph-osd-1       12d
    rook-ceph-osd-2       12d
    

    ocs-provider-server ( ServiceExport )が存在しない場合は、 ODF 地域災害復旧設定の手順 5 に従って、これを再作成してください。

  3. StorageCluster で、マルチクラスタネットワーク構成が正しく設定されていることを確認してください。 出力結果において、 multiClusterService.enabledtrue となっていること、および clusterID が管理対象クラスタの名前と一致していることを確認してください。 また、 ocs.openshift.io/api-server-exported-address アノテーションが存在し、正しく設定されていることも確認してください。

    oc get storagecluster -n openshift-storage -o yaml
    

    出力の中から、以下の値を探してください:

    network:
      multiClusterService:
        clusterID: <cluster-name>
        enabled: true
    

    そして、以下の注釈:

    ocs.openshift.io/api-server-exported-address: <cluster-name>.ocs-provider-server.openshift-storage.svc.clusterset.local:50051
    

ハブ・クラスタにおける ODF マルチクラスタ・オーケストレーターの検証

ハブクラスタ

ハブクラスタで、以下の手順を実行してください。

  1. OpenShift GitOps のオペレーター・ポッドが実行されていることを確認してください。 ODF Multicluster Orchestrator を使用するには、まず GitOps をインストールする必要があります。

    oc get pods -n openshift-gitops
    

    出力例:

    NAME                                                           READY   STATUS    RESTARTS   AGE
    cluster-6484df7d8f-fbk9b                                       1/1     Running   0          4d12h
    gitops-plugin-8646dcfd5d-kj5mf                                 1/1     Running   0          4d12h
    openshift-gitops-application-controller-0                      1/1     Running   0          4d12h
    openshift-gitops-applicationset-controller-664645457b-8n9gj    1/1     Running   0          4d12h
    openshift-gitops-dex-server-74ddb4bb94-trxk6                   1/1     Running   0          4d12h
    openshift-gitops-redis-68469975f8-mlkrq                        1/1     Running   0          14d
    openshift-gitops-repo-server-76567d7c46-j9fjq                  1/1     Running   0          4d12h
    openshift-gitops-server-6d74f8d998-f97zx                       1/1     Running   0          4d12h
    

    GitOps がインストールされていない場合は、 Webコンソールで「 Red Hat OpenShift GitOps オペレーターのインストール 」を参照してください。

  2. ODF Multicluster Orchestrator のオペレーターポッドが、 openshift-operators ネームスペースで実行されていることを確認してください。 odf-multicluster-console および odfmo-controller-manager の両方のポッドが、 Running というステータスを示していることを確認してください。

    oc get pods -n openshift-operators | grep -i odf
    

    出力例:

    odf-multicluster-console-cdd786658-2bdbz   1/1   Running   0             12d
    odfmo-controller-manager-8585c4bf9-mwhvf   1/1   Running   2 (16h ago)   12d
    
  3. submariner-operator ネームスペース内で、Ramen Hub オペレーターポッドが実行されていることを確認してください。

    oc get pods -n submariner-operator
    

    出力例:

    NAME                                  READY   STATUS    RESTARTS      AGE
    submariner-operator-6bf8d56f74-7v44v  1/1     Running   3 (17h ago)   14d
    
  4. openshift-dr-system ネームスペース内の各管理対象クラスター 上で、Ramen DR クラスターオペレーターポッドが実行されていることを確認してください。

    oc get pods -n openshift-dr-system | grep -i ramen
    

    出力例:

    ramen-dr-cluster-operator-785d878dbc-lbrgz   2/2   Running   0   2d15h
    

ハブクラスタにおけるDRポリシーおよび MirrorPeer の確認

ハブクラスタ

ハブクラスタで、以下の手順を実行してください。

  1. DRPolicy が検証済みであることを確認してください。 出力において、 Validated という条件の status"True" となっていることを確認してください。

    oc get drpolicy -A
    oc describe drpolicy <drpolicy_name>
    

    oc describe の出力例:

    status:
      conditions:
        - type: Validated
          status: "True"
    

    DRPolicyの検証に失敗した場合は、両方の管理対象クラスター上で NooBaa オブジェクトのバケットが正常に作成されていることを確認してください。

  2. MirrorPeer フェーズが ExchangedSecret であることを確認してください。 「 MirrorPeer 」リソースを記述し、「 Phase 」フィールドを確認してください。

    oc get mirrorpeers -A
    oc describe mirrorpeer <mirrorpeer_name>
    

    oc describe の出力例:

    Status:
      Phase: ExchangedSecret
    Events: <none>
    

    フェーズに「 ExchangingSecret 」と表示された場合は、 「Submarinerの接続確認」 の手順に従って、Submarinerの接続状態を確認してください。

マネージドクラスタ上のオプション演算子の検証

マネージド・クラスター

ODF RDRのセットアップの一環としてオプションのオペレーターをインストールした場合は、 各管理対象クラスター でそれらが実行されていることを確認してください。

オプションのオペレーターの管理(更新、監視、復旧、再インストールを含む)は、お客様の責任となります。

  1. OpenShift GitOps のオペレーター・ポッドが実行されていることを確認してください。 openshift-gitops-application-controlleropenshift-gitops-server、およびその他の GitOps ポッドのステータスが「 Running 」となっていることを確認してください。

    oc get pods -n openshift-gitops
    
  2. OpenShift のデータ保護用API( OADP )のオペレーターポッドが実行中であることを確認してください。 openshift-adp-controller-manager および velero の両方のポッドが、 Running というステータスを示していることを確認してください。

    oc get pods -n openshift-adp
    

    出力例:

    NAME                                                  READY   STATUS    RESTARTS   AGE
    openshift-adp-controller-manager-7c8fc7f964-j2jnq    1/1     Running   1          12d
    velero-9cdf64b8b-9c2kk                               1/1     Running   1          12d
    

    オペレーターが欠けている場合は、該当する設置ガイドに従って再設置してください。

必ず収集すべきログの収集

ハブクラスター マネージドクラスター

前述の確認手順を実行しても問題が解決しない場合は、ハブおよびマネージドクラスタから必須のログを収集し、 IBM サポートに提供してください。

ハブクラスタのログを収集する

ハブクラスタ

ハブ・クラスタで次のスクリプトを実行し、診断情報を収集してください。

#!/bin/bash
# Usage: ./hub-check.sh <cluster-name>
CLUSTER_NAME=$1
if [[ -z "$CLUSTER_NAME" ]]; then
  echo "Usage: $0 <cluster-name>"
  exit 1
fi
echo "===== Verify ACM ====="
ibmcloud oc cluster addon ls --cluster "$CLUSTER_NAME" | grep -i acm
oc get pods -n kube-system | grep acm
oc get pods -n open-cluster-management
oc get managedclusters
echo "===== Verify Submariner ====="
oc get pods -n submariner-operator
oc get managedclusteraddon -A | grep submariner
oc get managedclusteraddon -A -o yaml
oc get broker -A
echo "===== Verify Multicluster Operator ====="
oc get pods -n openshift-operators | grep -i odf
oc get drpolicy -A
oc get mirrorpeers -A
echo "===== Verify Additional Operators ====="
oc get pods -n openshift-gitops
oc get pods -n openshift-adp

管理対象クラスタのログを収集する

マネージド・クラスター

各管理対象クラスターで以下のスクリプトを実行し、診断情報を収集してください。

#!/bin/bash
# Usage: ./managedCluster-check.sh
echo "===== Verify Submariner ====="
oc get pods -n submariner-operator
oc get submariner -A
echo "===== Verify DR Operator ====="
oc get pods -n openshift-dr-system | grep -i ramen
echo "===== Verify ODF ====="
oc get storagecluster -n openshift-storage
oc get cephcluster -n openshift-storage
oc get serviceexports -n openshift-storage
oc get storagecluster -n openshift-storage -o yaml
echo "===== Verify Additional Operators ====="
oc get pods -n openshift-gitops
oc get pods -n openshift-adp

その他、必ず確認すべきガイダンスについては、以下のリソースをご覧ください:

次のステップ