Comprobación de la configuración regional de recuperación ante desastres de Data Foundation de OpenShift

Nube privada virtual 4.21 y más tarde

Una vez que haya configurado la recuperación ante desastres regional (RDR) de la Base de datos de OpenShift (ODF), compruebe que todos los componentes de la pila estén en buen estado y correctamente configurados. Sigue las instrucciones de cada sección en el clúster, nodo central o entorno gestionado correspondiente, tal y como se indica.

Comprobación del complemento ACM en el clúster de concentradores

Conjunto de concentradores

Sigue los siguientes pasos en el clúster de concentradores.

  1. Comprueba que el complemento ACM esté instalado y se encuentre en estado « normal ». Busca el complemento « acm » en la salida y comprueba que el estado indique « Addon Ready ».

    ibmcloud oc cluster addon ls --cluster HUB_CLUSTER_NAME | grep -i acm
    

    Salida de ejemplo:

    acm   2.15.0   normal   Addon Ready. For more info: http://ibm.biz/addon-state (H1500)
    

    Si el complemento ACM no aparece en la lista, instálalo.

  2. Comprueba que los pods complementarios de ACM se estén ejecutando en el espacio de nombres kube-system. Busca los pods « acm-agent » y « ibm-acm-operator-controller-manager » y comprueba que ambos muestren el estado « Running ».

    oc get pods -n kube-system | grep acm
    

    Salida de ejemplo:

    acm-agent-6d9d49cbf6-tsmxd                           1/1   Running   118 (107m ago)   19d
    ibm-acm-operator-controller-manager-bc7b7f969-pr9lj   1/1   Running   3 (7d17h ago)    19d
    
  3. Comprueba que los pods del operador ACM y los de MultiClusterHub se estén ejecutando en el espacio de nombres open-cluster-management.

    oc get pods -n open-cluster-management
    

    Salida de ejemplo:

    multiclusterhub-operator-dcd787649-sqrcx     1/1   Running   0   14d
    console-chart-console-v2-7c8c6649cc-hmg6g    1/1   Running   0   15d
    submariner-addon-76986fdf45-v9kgm            1/1   Running   0   15d
    volsync-addon-controller-6575568dc6-6pjsb    1/1   Running   0   15d
    

    Si falta algún pod o no se encuentra en estado « Running », consulta la sección « Instalación del complemento ACM ».

Comprobación de que los clústeres gestionados se han importado y están disponibles

Conjunto de concentradores

Realiza el siguiente paso en el clúster de concentradores.

Comprueba que todos los clústeres gestionados se hayan importado correctamente y que aparezca « True » tanto en la columna « JOINED » como en la columna « AVAILABLE ».

oc get managedclusters

Salida de ejemplo:

NAME             HUB ACCEPTED   MANAGED CLUSTER URLS                                 JOINED   AVAILABLE   AGE
local-cluster    true           https://c100.au-syd.containers.cloud.ibm.com:30253   True     True        14d
managedcluster1  true           https://c100.au-syd.containers.cloud.ibm.com:31003   True     True        14d
managedcluster2  true           https://c100.au-syd.containers.cloud.ibm.com:31888   True     True        14d

Si falta un clúster gestionado o no está disponible, vuelve a importarlo.

Comprobación de la conectividad del Submariner

Conjunto de concentradores Clúster gestionado

Submariner proporciona conectividad de red entre tus clústeres gestionados. Sigue los pasos que se indican en cada subsección del grupo indicado.

Comprueba el operador Submariner en el clúster de concentradores

Conjunto de concentradores

  1. Comprueba que el pod del operador de Submariner se esté ejecutando en el clúster central.

    oc get pods -n submariner-operator
    

    Salida de ejemplo:

    NAME                                  READY   STATUS    RESTARTS      AGE
    submariner-operator-6bf8d56f74-7v44v  1/1     Running   3 (17h ago)   14d
    
  2. Comprueba que el complemento Submariner esté registrado para cada clúster gestionado. Comprueba que la columna « AVAILABLE » muestre « True » para cada clúster gestionado.

    oc get managedclusteraddon -A | grep submariner
    

    Salida de ejemplo:

    managedcluster1   submariner   True   False
    managedcluster2   submariner   True   False
    
  3. Comprueba que el agente Submariner existe.

    oc get broker -A
    

    Salida de ejemplo:

    NAMESPACE                 NAME                AGE
    submariner-set1-broker    submariner-broker   12d
    

Verificar Submariner en los clústeres gestionados

Clúster gestionado

Sigue estos pasos en cada clúster gestionado.

  1. Comprueba que los módulos de Submariner necesarios estén en funcionamiento. Comprueba que los pods submariner-gateway, submariner-routeagent y submariner-globalnet estén presentes y muestren el estado « Running ».

    oc get pods -n submariner-operator
    

    Salida de ejemplo:

    NAME                                              READY   STATUS    RESTARTS      AGE
    submariner-addon-bc6bbf579-wjqhq                  1/1     Running   0             12d
    submariner-gateway-hxcbh                          1/1     Running   0             12d
    submariner-globalnet-jbmxw                        1/1     Running   3 (12d ago)   12d
    submariner-lighthouse-agent-858896855b-xghxn      1/1     Running   0             12d
    submariner-lighthouse-coredns-66d5579b66-52f6j    1/1     Running   0             12d
    submariner-lighthouse-coredns-66d5579b66-jhqkm    1/1     Running   0             12d
    submariner-metrics-proxy-65n4c                    2/2     Running   3 (12d ago)   12d
    submariner-operator-7c99f89cfb-rppth              1/1     Running   2 (17h ago)   12d
    submariner-routeagent-27p7v                       1/1     Running   0             12d
    submariner-routeagent-jjw66                       1/1     Running   0             12d
    submariner-routeagent-nt78s                       1/1     Running   0             12d
    
  2. Comprueba que la conexión con el Submariner sea correcta. En la salida, comprueba que « RouteAgentConnectionDegraded » tenga un « status » de « "False" », lo que confirma que todas las conexiones de los agentes de ruta a los puntos finales remotos están establecidas y funcionan correctamente.

    oc -n <managed_cluster_name> get managedclusteraddons submariner -o yaml
    

    Salida de ejemplo:

    status:
      - lastTransitionTime: "2026-03-18T03:36:24Z"
        message: All RouteAgent connections to remote endpoints are established and healthy.
        reason: ConnectionsEstablished
        status: "False"
        type: RouteAgentConnectionDegraded
    

    Si la conectividad se ve afectada, reinstala Submariner siguiendo el paso 4 de la configuración de recuperación ante desastres regional de ODF.

Verificación de ODF en los clústeres gestionados

Clúster gestionado

Sigue estos pasos en cada clúster gestionado.

  1. Comprueba que el ODF StorageCluster esté listo y que el estado de Ceph sea HEALTH_OK. En la salida, comprueba que la columna « PHASE » muestre « Ready » para « StorageCluster » y que la columna « HEALTH » muestre « HEALTH_OK » para « CephCluster ».

    oc get storagecluster -n openshift-storage
    oc get cephcluster -n openshift-storage
    

    Salida de ejemplo:

    NAME                 AGE   PHASE   EXTERNAL   CREATED AT             VERSION
    ocs-storagecluster   12d   Ready              2026-03-17T10:51:46Z   4.20.7
    NAME                              DATADIRHOSTPATH   MONCOUNT   AGE   PHASE   MESSAGE                       HEALTH      EXTERNAL   FSID
    ocs-storagecluster-cephcluster    /var/lib/rook     3          12d   Ready   Cluster created successfully  HEALTH_OK              5fb59e70-bd54-438f-9190-c09ddcf04c0c
    

    Si se trata de una instalación nueva de ODF y aún no se ha implementado ninguna aplicación, plantéate reinstalar ODF siguiendo la guía de instalación de ODF.

  2. Comprueba que estén presentes los archivos « ServiceExports » necesarios. Comprueba que aparezcan en la lista las entradas ocs-provider-server, rook-ceph-mon-* y rook-ceph-osd-*.

    oc get serviceexports -n openshift-storage
    

    Salida de ejemplo:

    NAME                  AGE
    ocs-provider-server   12d
    rook-ceph-mon-d       12d
    rook-ceph-mon-e       12d
    rook-ceph-mon-f       12d
    rook-ceph-osd-0       12d
    rook-ceph-osd-1       12d
    rook-ceph-osd-2       12d
    

    Si falta el archivo « ocs-provider-server » ( ServiceExport ), vuelve a crearlo siguiendo el paso 5 de la configuración de la recuperación ante desastres regional de ODF.

  3. Comprueba que la configuración de red multiclúster esté correctamente establecida en StorageCluster. En la salida, comprueba que « multiClusterService.enabled » sea « true » y que « clusterID » coincida con el nombre del clúster gestionado. Comprueba también que la anotación « ocs.openshift.io/api-server-exported-address » esté presente y configurada correctamente.

    oc get storagecluster -n openshift-storage -o yaml
    

    Busca los siguientes valores en la salida:

    network:
      multiClusterService:
        clusterID: <cluster-name>
        enabled: true
    

    Y la siguiente anotación:

    ocs.openshift.io/api-server-exported-address: <cluster-name>.ocs-provider-server.openshift-storage.svc.clusterset.local:50051
    

Verificación del ODF Multicluster Orchestrator en el clúster central

Conjunto de concentradores

Sigue los siguientes pasos en el clúster de concentradores.

  1. Comprueba que los pods del operador OpenShift GitOps estén en ejecución. El ODF Multicluster Orchestrator requiere que se instale primero el « GitOps ».

    oc get pods -n openshift-gitops
    

    Salida de ejemplo:

    NAME                                                           READY   STATUS    RESTARTS   AGE
    cluster-6484df7d8f-fbk9b                                       1/1     Running   0          4d12h
    gitops-plugin-8646dcfd5d-kj5mf                                 1/1     Running   0          4d12h
    openshift-gitops-application-controller-0                      1/1     Running   0          4d12h
    openshift-gitops-applicationset-controller-664645457b-8n9gj    1/1     Running   0          4d12h
    openshift-gitops-dex-server-74ddb4bb94-trxk6                   1/1     Running   0          4d12h
    openshift-gitops-redis-68469975f8-mlkrq                        1/1     Running   0          14d
    openshift-gitops-repo-server-76567d7c46-j9fjq                  1/1     Running   0          4d12h
    openshift-gitops-server-6d74f8d998-f97zx                       1/1     Running   0          4d12h
    

    Si no tienes instalado « GitOps », consulta la sección «Instalación de Red Hat OpenShift GitOps Operator» en la consola web.

  2. Comprueba que los pods del operador ODF Multicluster Orchestrator se estén ejecutando en el espacio de nombres « openshift-operators ». Comprueba que los pods « odf-multicluster-console » y « odfmo-controller-manager » muestren ambos el estado « Running ».

    oc get pods -n openshift-operators | grep -i odf
    

    Salida de ejemplo:

    odf-multicluster-console-cdd786658-2bdbz   1/1   Running   0             12d
    odfmo-controller-manager-8585c4bf9-mwhvf   1/1   Running   2 (16h ago)   12d
    
  3. Comprueba que el pod del operador del hub de Ramen se esté ejecutando en el espacio de nombres submariner-operator.

    oc get pods -n submariner-operator
    

    Salida de ejemplo:

    NAME                                  READY   STATUS    RESTARTS      AGE
    submariner-operator-6bf8d56f74-7v44v  1/1     Running   3 (17h ago)   14d
    
  4. Comprueba que el pod del operador del clúster Ramen DR se esté ejecutando en cada clúster gestionado del espacio de nombres openshift-dr-system.

    oc get pods -n openshift-dr-system | grep -i ramen
    

    Salida de ejemplo:

    ramen-dr-cluster-operator-785d878dbc-lbrgz   2/2   Running   0   2d15h
    

Comprobación de la política de recuperación ante desastres (DR) y de la función de recuperación de datos ( MirrorPeer ) en el clúster central

Conjunto de concentradores

Sigue los siguientes pasos en el clúster de concentradores.

  1. Comprueba que la política DRPolicy esté validada. En la salida, comprueba que la condición « Validated » tenga un valor de « status » de « "True" ».

    oc get drpolicy -A
    oc describe drpolicy <drpolicy_name>
    

    Ejemplo de resultado obtenido en oc describe:

    status:
      conditions:
        - type: Validated
          status: "True"
    

    Si la política DRPolicy no se valida, comprueba que se hayan creado correctamente los buckets de objetos « NooBaa » en ambos clústeres gestionados.

  2. Comprueba que la fase « MirrorPeer » sea « ExchangedSecret ». Describe el recurso « MirrorPeer » y marca la casilla « Phase ».

    oc get mirrorpeers -A
    oc describe mirrorpeer <mirrorpeer_name>
    

    Ejemplo de resultado obtenido en oc describe:

    Status:
      Phase: ExchangedSecret
    Events: <none>
    

    Si la fase muestra « ExchangingSecret », comprueba la conectividad del Submariner siguiendo las instrucciones de la sección « Comprobación de la conectividad del Submariner ».

Comprobación de los operadores opcionales en los clústeres gestionados

Clúster gestionado

Si has instalado operadores opcionales como parte de la configuración de ODF RDR, comprueba que se estén ejecutando en cada clúster gestionado.

Eres responsable de gestionar los componentes opcionales, lo que incluye su actualización, supervisión, recuperación y reinstalación.

  1. Comprueba que los pods del operador OpenShift GitOps estén en ejecución. Comprueba que los pods « openshift-gitops-application-controller », « openshift-gitops-server » y otros de « GitOps » muestren el estado « Running ».

    oc get pods -n openshift-gitops
    
  2. Comprueba que los pods del operador de la API de OpenShift para la protección de datos ( OADP ) estén en ejecución. Comprueba que los pods « openshift-adp-controller-manager » y « velero » muestren ambos el estado « Running ».

    oc get pods -n openshift-adp
    

    Salida de ejemplo:

    NAME                                                  READY   STATUS    RESTARTS   AGE
    openshift-adp-controller-manager-7c8fc7f964-j2jnq    1/1     Running   1          12d
    velero-9cdf64b8b-9c2kk                               1/1     Running   1          12d
    

    Si falta un operador, vuelve a instalarlo siguiendo la guía de instalación correspondiente.

Recopilación de los registros imprescindibles

Conjunto de concentradores Clúster gestionado

Si no consigues resolver un problema siguiendo los pasos de verificación anteriores, recopila los registros imprescindibles de tu hub y de tus clústeres gestionados y envíalos al servicio de asistencia de IBM.

Recopilar los registros del clúster de concentradores

Conjunto de concentradores

Ejecuta el siguiente script en el clúster del hub para recopilar información de diagnóstico.

#!/bin/bash
# Usage: ./hub-check.sh <cluster-name>
CLUSTER_NAME=$1
if [[ -z "$CLUSTER_NAME" ]]; then
  echo "Usage: $0 <cluster-name>"
  exit 1
fi
echo "===== Verify ACM ====="
ibmcloud oc cluster addon ls --cluster "$CLUSTER_NAME" | grep -i acm
oc get pods -n kube-system | grep acm
oc get pods -n open-cluster-management
oc get managedclusters
echo "===== Verify Submariner ====="
oc get pods -n submariner-operator
oc get managedclusteraddon -A | grep submariner
oc get managedclusteraddon -A -o yaml
oc get broker -A
echo "===== Verify Multicluster Operator ====="
oc get pods -n openshift-operators | grep -i odf
oc get drpolicy -A
oc get mirrorpeers -A
echo "===== Verify Additional Operators ====="
oc get pods -n openshift-gitops
oc get pods -n openshift-adp

Recopilar los registros de los clústeres gestionados

Clúster gestionado

Ejecuta el siguiente script en cada clúster gestionado para recopilar información de diagnóstico.

#!/bin/bash
# Usage: ./managedCluster-check.sh
echo "===== Verify Submariner ====="
oc get pods -n submariner-operator
oc get submariner -A
echo "===== Verify DR Operator ====="
oc get pods -n openshift-dr-system | grep -i ramen
echo "===== Verify ODF ====="
oc get storagecluster -n openshift-storage
oc get cephcluster -n openshift-storage
oc get serviceexports -n openshift-storage
oc get storagecluster -n openshift-storage -o yaml
echo "===== Verify Additional Operators ====="
oc get pods -n openshift-gitops
oc get pods -n openshift-adp

Para obtener más orientación imprescindible, consulta los siguientes recursos:

Próximos pasos