Comprobación de la configuración regional de recuperación ante desastres de Data Foundation de OpenShift
Nube privada virtual 4.21 y más tarde
Una vez que haya configurado la recuperación ante desastres regional (RDR) de la Base de datos de OpenShift (ODF), compruebe que todos los componentes de la pila estén en buen estado y correctamente configurados. Sigue las instrucciones de cada sección en el clúster, nodo central o entorno gestionado correspondiente, tal y como se indica.
Comprobación del complemento ACM en el clúster de concentradores
Conjunto de concentradores
Sigue los siguientes pasos en el clúster de concentradores.
-
Comprueba que el complemento ACM esté instalado y se encuentre en estado «
normal». Busca el complemento «acm» en la salida y comprueba que el estado indique «Addon Ready».ibmcloud oc cluster addon ls --cluster HUB_CLUSTER_NAME | grep -i acmSalida de ejemplo:
acm 2.15.0 normal Addon Ready. For more info: http://ibm.biz/addon-state (H1500)Si el complemento ACM no aparece en la lista, instálalo.
-
Comprueba que los pods complementarios de ACM se estén ejecutando en el espacio de nombres
kube-system. Busca los pods «acm-agent» y «ibm-acm-operator-controller-manager» y comprueba que ambos muestren el estado «Running».oc get pods -n kube-system | grep acmSalida de ejemplo:
acm-agent-6d9d49cbf6-tsmxd 1/1 Running 118 (107m ago) 19d ibm-acm-operator-controller-manager-bc7b7f969-pr9lj 1/1 Running 3 (7d17h ago) 19d -
Comprueba que los pods del operador ACM y los de MultiClusterHub se estén ejecutando en el espacio de nombres
open-cluster-management.oc get pods -n open-cluster-managementSalida de ejemplo:
multiclusterhub-operator-dcd787649-sqrcx 1/1 Running 0 14d console-chart-console-v2-7c8c6649cc-hmg6g 1/1 Running 0 15d submariner-addon-76986fdf45-v9kgm 1/1 Running 0 15d volsync-addon-controller-6575568dc6-6pjsb 1/1 Running 0 15dSi falta algún pod o no se encuentra en estado «
Running», consulta la sección « Instalación del complemento ACM ».
Comprobación de que los clústeres gestionados se han importado y están disponibles
Conjunto de concentradores
Realiza el siguiente paso en el clúster de concentradores.
Comprueba que todos los clústeres gestionados se hayan importado correctamente y que aparezca « True » tanto en la columna « JOINED » como en la columna « AVAILABLE ».
oc get managedclusters
Salida de ejemplo:
NAME HUB ACCEPTED MANAGED CLUSTER URLS JOINED AVAILABLE AGE
local-cluster true https://c100.au-syd.containers.cloud.ibm.com:30253 True True 14d
managedcluster1 true https://c100.au-syd.containers.cloud.ibm.com:31003 True True 14d
managedcluster2 true https://c100.au-syd.containers.cloud.ibm.com:31888 True True 14d
Si falta un clúster gestionado o no está disponible, vuelve a importarlo.
Comprobación de la conectividad del Submariner
Conjunto de concentradores Clúster gestionado
Submariner proporciona conectividad de red entre tus clústeres gestionados. Sigue los pasos que se indican en cada subsección del grupo indicado.
Comprueba el operador Submariner en el clúster de concentradores
Conjunto de concentradores
-
Comprueba que el pod del operador de Submariner se esté ejecutando en el clúster central.
oc get pods -n submariner-operatorSalida de ejemplo:
NAME READY STATUS RESTARTS AGE submariner-operator-6bf8d56f74-7v44v 1/1 Running 3 (17h ago) 14d -
Comprueba que el complemento Submariner esté registrado para cada clúster gestionado. Comprueba que la columna «
AVAILABLE» muestre «True» para cada clúster gestionado.oc get managedclusteraddon -A | grep submarinerSalida de ejemplo:
managedcluster1 submariner True False managedcluster2 submariner True False -
Comprueba que el agente Submariner existe.
oc get broker -ASalida de ejemplo:
NAMESPACE NAME AGE submariner-set1-broker submariner-broker 12d
Verificar Submariner en los clústeres gestionados
Clúster gestionado
Sigue estos pasos en cada clúster gestionado.
-
Comprueba que los módulos de Submariner necesarios estén en funcionamiento. Comprueba que los pods
submariner-gateway,submariner-routeagentysubmariner-globalnetestén presentes y muestren el estado «Running».oc get pods -n submariner-operatorSalida de ejemplo:
NAME READY STATUS RESTARTS AGE submariner-addon-bc6bbf579-wjqhq 1/1 Running 0 12d submariner-gateway-hxcbh 1/1 Running 0 12d submariner-globalnet-jbmxw 1/1 Running 3 (12d ago) 12d submariner-lighthouse-agent-858896855b-xghxn 1/1 Running 0 12d submariner-lighthouse-coredns-66d5579b66-52f6j 1/1 Running 0 12d submariner-lighthouse-coredns-66d5579b66-jhqkm 1/1 Running 0 12d submariner-metrics-proxy-65n4c 2/2 Running 3 (12d ago) 12d submariner-operator-7c99f89cfb-rppth 1/1 Running 2 (17h ago) 12d submariner-routeagent-27p7v 1/1 Running 0 12d submariner-routeagent-jjw66 1/1 Running 0 12d submariner-routeagent-nt78s 1/1 Running 0 12d -
Comprueba que la conexión con el Submariner sea correcta. En la salida, comprueba que «
RouteAgentConnectionDegraded» tenga un «status» de «"False"», lo que confirma que todas las conexiones de los agentes de ruta a los puntos finales remotos están establecidas y funcionan correctamente.oc -n <managed_cluster_name> get managedclusteraddons submariner -o yamlSalida de ejemplo:
status: - lastTransitionTime: "2026-03-18T03:36:24Z" message: All RouteAgent connections to remote endpoints are established and healthy. reason: ConnectionsEstablished status: "False" type: RouteAgentConnectionDegradedSi la conectividad se ve afectada, reinstala Submariner siguiendo el paso 4 de la configuración de recuperación ante desastres regional de ODF.
Verificación de ODF en los clústeres gestionados
Clúster gestionado
Sigue estos pasos en cada clúster gestionado.
-
Comprueba que el ODF StorageCluster esté listo y que el estado de Ceph sea
HEALTH_OK. En la salida, comprueba que la columna «PHASE» muestre «Ready» para « StorageCluster » y que la columna «HEALTH» muestre «HEALTH_OK» para « CephCluster ».oc get storagecluster -n openshift-storage oc get cephcluster -n openshift-storageSalida de ejemplo:
NAME AGE PHASE EXTERNAL CREATED AT VERSION ocs-storagecluster 12d Ready 2026-03-17T10:51:46Z 4.20.7 NAME DATADIRHOSTPATH MONCOUNT AGE PHASE MESSAGE HEALTH EXTERNAL FSID ocs-storagecluster-cephcluster /var/lib/rook 3 12d Ready Cluster created successfully HEALTH_OK 5fb59e70-bd54-438f-9190-c09ddcf04c0cSi se trata de una instalación nueva de ODF y aún no se ha implementado ninguna aplicación, plantéate reinstalar ODF siguiendo la guía de instalación de ODF.
-
Comprueba que estén presentes los archivos « ServiceExports » necesarios. Comprueba que aparezcan en la lista las entradas
ocs-provider-server,rook-ceph-mon-*yrook-ceph-osd-*.oc get serviceexports -n openshift-storageSalida de ejemplo:
NAME AGE ocs-provider-server 12d rook-ceph-mon-d 12d rook-ceph-mon-e 12d rook-ceph-mon-f 12d rook-ceph-osd-0 12d rook-ceph-osd-1 12d rook-ceph-osd-2 12dSi falta el archivo «
ocs-provider-server» ( ServiceExport ), vuelve a crearlo siguiendo el paso 5 de la configuración de la recuperación ante desastres regional de ODF. -
Comprueba que la configuración de red multiclúster esté correctamente establecida en StorageCluster. En la salida, comprueba que «
multiClusterService.enabled» sea «true» y que «clusterID» coincida con el nombre del clúster gestionado. Comprueba también que la anotación «ocs.openshift.io/api-server-exported-address» esté presente y configurada correctamente.oc get storagecluster -n openshift-storage -o yamlBusca los siguientes valores en la salida:
network: multiClusterService: clusterID: <cluster-name> enabled: trueY la siguiente anotación:
ocs.openshift.io/api-server-exported-address: <cluster-name>.ocs-provider-server.openshift-storage.svc.clusterset.local:50051
Verificación del ODF Multicluster Orchestrator en el clúster central
Conjunto de concentradores
Sigue los siguientes pasos en el clúster de concentradores.
-
Comprueba que los pods del operador OpenShift GitOps estén en ejecución. El ODF Multicluster Orchestrator requiere que se instale primero el « GitOps ».
oc get pods -n openshift-gitopsSalida de ejemplo:
NAME READY STATUS RESTARTS AGE cluster-6484df7d8f-fbk9b 1/1 Running 0 4d12h gitops-plugin-8646dcfd5d-kj5mf 1/1 Running 0 4d12h openshift-gitops-application-controller-0 1/1 Running 0 4d12h openshift-gitops-applicationset-controller-664645457b-8n9gj 1/1 Running 0 4d12h openshift-gitops-dex-server-74ddb4bb94-trxk6 1/1 Running 0 4d12h openshift-gitops-redis-68469975f8-mlkrq 1/1 Running 0 14d openshift-gitops-repo-server-76567d7c46-j9fjq 1/1 Running 0 4d12h openshift-gitops-server-6d74f8d998-f97zx 1/1 Running 0 4d12hSi no tienes instalado « GitOps », consulta la sección «Instalación de Red Hat OpenShift GitOps Operator» en la consola web.
-
Comprueba que los pods del operador ODF Multicluster Orchestrator se estén ejecutando en el espacio de nombres «
openshift-operators». Comprueba que los pods «odf-multicluster-console» y «odfmo-controller-manager» muestren ambos el estado «Running».oc get pods -n openshift-operators | grep -i odfSalida de ejemplo:
odf-multicluster-console-cdd786658-2bdbz 1/1 Running 0 12d odfmo-controller-manager-8585c4bf9-mwhvf 1/1 Running 2 (16h ago) 12d -
Comprueba que el pod del operador del hub de Ramen se esté ejecutando en el espacio de nombres
submariner-operator.oc get pods -n submariner-operatorSalida de ejemplo:
NAME READY STATUS RESTARTS AGE submariner-operator-6bf8d56f74-7v44v 1/1 Running 3 (17h ago) 14d -
Comprueba que el pod del operador del clúster Ramen DR se esté ejecutando en cada clúster gestionado del espacio de nombres
openshift-dr-system.oc get pods -n openshift-dr-system | grep -i ramenSalida de ejemplo:
ramen-dr-cluster-operator-785d878dbc-lbrgz 2/2 Running 0 2d15h
Comprobación de la política de recuperación ante desastres (DR) y de la función de recuperación de datos ( MirrorPeer ) en el clúster central
Conjunto de concentradores
Sigue los siguientes pasos en el clúster de concentradores.
-
Comprueba que la política DRPolicy esté validada. En la salida, comprueba que la condición «
Validated» tenga un valor de «status» de «"True"».oc get drpolicy -A oc describe drpolicy <drpolicy_name>Ejemplo de resultado obtenido en
oc describe:status: conditions: - type: Validated status: "True"Si la política DRPolicy no se valida, comprueba que se hayan creado correctamente los buckets de objetos « NooBaa » en ambos clústeres gestionados.
-
Comprueba que la fase « MirrorPeer » sea «
ExchangedSecret». Describe el recurso « MirrorPeer » y marca la casilla «Phase».oc get mirrorpeers -A oc describe mirrorpeer <mirrorpeer_name>Ejemplo de resultado obtenido en
oc describe:Status: Phase: ExchangedSecret Events: <none>Si la fase muestra «
ExchangingSecret», comprueba la conectividad del Submariner siguiendo las instrucciones de la sección « Comprobación de la conectividad del Submariner ».
Comprobación de los operadores opcionales en los clústeres gestionados
Clúster gestionado
Si has instalado operadores opcionales como parte de la configuración de ODF RDR, comprueba que se estén ejecutando en cada clúster gestionado.
Eres responsable de gestionar los componentes opcionales, lo que incluye su actualización, supervisión, recuperación y reinstalación.
-
Comprueba que los pods del operador OpenShift GitOps estén en ejecución. Comprueba que los pods «
openshift-gitops-application-controller», «openshift-gitops-server» y otros de « GitOps » muestren el estado «Running».oc get pods -n openshift-gitops -
Comprueba que los pods del operador de la API de OpenShift para la protección de datos ( OADP ) estén en ejecución. Comprueba que los pods «
openshift-adp-controller-manager» y «velero» muestren ambos el estado «Running».oc get pods -n openshift-adpSalida de ejemplo:
NAME READY STATUS RESTARTS AGE openshift-adp-controller-manager-7c8fc7f964-j2jnq 1/1 Running 1 12d velero-9cdf64b8b-9c2kk 1/1 Running 1 12dSi falta un operador, vuelve a instalarlo siguiendo la guía de instalación correspondiente.
Recopilación de los registros imprescindibles
Conjunto de concentradores Clúster gestionado
Si no consigues resolver un problema siguiendo los pasos de verificación anteriores, recopila los registros imprescindibles de tu hub y de tus clústeres gestionados y envíalos al servicio de asistencia de IBM.
Recopilar los registros del clúster de concentradores
Conjunto de concentradores
Ejecuta el siguiente script en el clúster del hub para recopilar información de diagnóstico.
#!/bin/bash
# Usage: ./hub-check.sh <cluster-name>
CLUSTER_NAME=$1
if [[ -z "$CLUSTER_NAME" ]]; then
echo "Usage: $0 <cluster-name>"
exit 1
fi
echo "===== Verify ACM ====="
ibmcloud oc cluster addon ls --cluster "$CLUSTER_NAME" | grep -i acm
oc get pods -n kube-system | grep acm
oc get pods -n open-cluster-management
oc get managedclusters
echo "===== Verify Submariner ====="
oc get pods -n submariner-operator
oc get managedclusteraddon -A | grep submariner
oc get managedclusteraddon -A -o yaml
oc get broker -A
echo "===== Verify Multicluster Operator ====="
oc get pods -n openshift-operators | grep -i odf
oc get drpolicy -A
oc get mirrorpeers -A
echo "===== Verify Additional Operators ====="
oc get pods -n openshift-gitops
oc get pods -n openshift-adp
Recopilar los registros de los clústeres gestionados
Clúster gestionado
Ejecuta el siguiente script en cada clúster gestionado para recopilar información de diagnóstico.
#!/bin/bash
# Usage: ./managedCluster-check.sh
echo "===== Verify Submariner ====="
oc get pods -n submariner-operator
oc get submariner -A
echo "===== Verify DR Operator ====="
oc get pods -n openshift-dr-system | grep -i ramen
echo "===== Verify ODF ====="
oc get storagecluster -n openshift-storage
oc get cephcluster -n openshift-storage
oc get serviceexports -n openshift-storage
oc get storagecluster -n openshift-storage -o yaml
echo "===== Verify Additional Operators ====="
oc get pods -n openshift-gitops
oc get pods -n openshift-adp
Para obtener más orientación imprescindible, consulta los siguientes recursos:
Próximos pasos
- Si todos los componentes funcionan correctamente, comprueba la configuración de recuperación ante desastres ejecutando un escenario de conmutación por error y reubicación.
- Si necesitas más ayuda, ponte en contacto con el servicio de asistencia de IBM e incluye los registros imprescindibles que hayas recopilado.
- Consulta la guía de configuración de la recuperación ante desastres regional de ODF para comprobar que todos los pasos de instalación se han completado correctamente.