Por que OpenShift¿Mostrar que la versión del clúster no está actualizada?

Nube privada virtual Infraestructura clásica Satellite

Verá uno o más de los siguientes durante un periodo de tiempo prolongado.

  • La consola web de OpenShift muestra un banner que indica que la agrupación se está actualizando y la página Valores de clúster muestra que la versión actual tiene un estado de Partial.

  • Cuando se ejecuta el comando ibmcloud oc cluster get --cluster <cluster_name> se ve un estado warning y un estado que indica que los operadores de cluster no están en la última versión.

    State:                          warning
    Status:                         Some Cluster Operators are down-level and need to be updated, see 'https://ibm.biz/rhos_clusterversion_ts'
    
  • Cuando ejecute el mandato oc get clusterversion, verá una versión anterior.

    NAME      VERSION   AVAILABLE   PROGRESSING   SINCE   STATUS
    version   4.11.27   True        True          27h     Unable to apply 4.12.3: an unknown error has occurred: MultipleErrors
    
  • Ves que una actualización de maestro de clúster se canceló con un estado similar al siguiente.

    Version update canceled. CAE012: Cannot complete cluster master operations because the current OpenShift clusterversion rollout is not complete. For more information, see the troubleshooting docs: 'https://ibm.biz/rhos_clusterversion_ts'
    

Una actualización maestra de clúster a una nueva versión de parche o una actualización a una nueva versión menor no se ha completado.

Una actualización de nodo maestro de clúster finaliza poco después de actualizar el operador de versión de clúster. El operador de versiones de clúster gestiona las actualizaciones de varios operadores de clúster, que continúan una vez finalizada la actualización del maestro de clúster.

$ oc get clusterversion
NAME      VERSION   AVAILABLE   PROGRESSING   SINCE   STATUS
version   4.13.11   True        False         33h     Cluster version is 4.13.11

$ oc get co
NAME                                       VERSION   AVAILABLE   PROGRESSING   DEGRADED   SINCE   MESSAGE
console                                    4.13.11   True        False         False      2d3h    
csi-snapshot-controller                    4.13.11   True        False         False      2d4h    
dns                                        4.13.11   True        False         False      2d4h    
image-registry                             4.13.11   True        False         False      2d4h    
ingress                                    4.13.11   True        False         False      2d4h    
insights                                   4.13.11   True        False         False      2d4h    
kube-apiserver                             4.13.11   True        False         False      2d4h    
kube-controller-manager                    4.13.11   True        False         False      2d4h    
kube-scheduler                             4.13.11   True        False         False      2d4h    
kube-storage-version-migrator              4.13.11   True        False         False      2d4h    
marketplace                                4.13.11   True        False         False      2d4h    
monitoring                                 4.13.11   True        False         False      2d4h    
network                                    4.13.11   True        False         False      2d4h    
node-tuning                                4.13.11   True        False         False      32h     
openshift-apiserver                        4.13.11   True        False         False      2d4h    
openshift-controller-manager               4.13.11   True        False         False      2d4h    
openshift-samples                          4.13.11   True        False         False      33h     
operator-lifecycle-manager                 4.13.11   True        False         False      2d4h    
operator-lifecycle-manager-catalog         4.13.11   True        False         False      2d4h    
operator-lifecycle-manager-packageserver   4.13.11   True        False         False      2d4h    
service-ca                                 4.13.11   True        False         False      2d4h    
storage                                    4.13.11   True        False         False      2d4h    

Si el clúster se acaba de actualizar, los operadores del clúster pueden tardar varios minutos en actualizarse. Es normal ver un estado como el siguiente con el número de pasos completados aumentando con el tiempo.

Working towards 4.13.11: 511 of 616 done (82% complete), waiting on network

Si el clúster continúa mostrando una actualización parcial durante un periodo prolongado, hay un problema en el clúster que impide que los operadores del clúster se actualicen a la versión actual. Esto puede ser causado por muchas cosas, como los siguientes ejemplos.

  • Componentes de clúster que no están en buen estado como, por ejemplo, los nodos trabajadores que bloquean el despliegue de las actualizaciones del operador.
  • Cambio incorrecto en una configuración de operador de clúster.
  • Cambios conflictivos en las configuraciones de clúster, como los cambios de RBAC que afectan a los componentes de OpenShift.

Empiece obteniendo información más detallada sobre el progreso y los problemas de la actualización del operador del clúster.

  1. Ejecute los siguientes comandos para obtener más información.

    oc get clusterversion
    
    oc get clusteroperators
    
    oc describe clusteroperator NAME
    
  2. Revise la columna MESSAGE en la salida del mandato para identificar qué operadores de clúster están bloqueando actualmente el progreso y proporcionar una indicación del problema. La forma en que OpenShift actualiza los operadores puede dar como resultado dependencias inesperadas; por ejemplo, algunas actualizaciones de operador de clúster pueden estar esperando a que otros operadores completen el paso que están ejecutando ahora.

  3. Compruebe el estado del nodo trabajador utilizando el mandato oc get nodes. A veces los nodos no son Ready, lo que puede deberse a una falta de recursos en un nodo o a un problema con kube-proxy o kubelet. Esto puede provocar problemas durante una actualización.

    • Si ha cambiado recientemente la configuración de uno de los operadores incompletos, describa el operador para obtener más detalles ejecutando oc describe clusteroperator NAME.Por ejemplo, oc describe cluster-operator image-registry puede mostrar un error que ayuda a identificar el problema.

    • Continúe comprobando el estado y los registros de los pods de operador para realizar una depuración adicional del problema. A veces los operadores están degradados, pero eso no significa que las actualizaciones hayan fallado o no estén funcionando.

  4. Si no puede identificar o resolver los problemas, o si el problema persiste, póngase en contacto con el servicio de soporte. Abra un caso de soporte. En los detalles del caso, asegúrese de incluir los archivos de registro relevantes, los mensajes de error o las salidas de mandato.