Estados de nodo trabajador

Para ver el estado del nodo de trabajo actual, ejecute el mandato ibmcloud oc worker ls --cluster CLUSTER_NAME_OR_ID y localice los campos State y Status.

Critical state

Un nodo de trabajo puede entrar en un estado Critical por muchas razones. Consulte Resolución de problemas de nodos trabajadores en estado Critical o NotReady para obtener más información y pasos de resolución de problemas.

Deleting state

El estado Deleting significa que se ha solicitado la supresión del nodo de trabajador, probablemente como parte del redimensionamiento de una agrupación de trabajadores o de un escalado automático del clúster. No se pueden realizar otras operaciones en el nodo de trabajo mientras se está llevando a cabo el proceso de eliminación. No puede invertir el proceso de supresión. Cuando finalice el proceso de eliminación, ya no se le facturará el nodo de trabajo.

Deleted state

Un estado Deleted de este tipo significa que tu nodo de trabajo se ha eliminado y ya no aparece en la lista del clúster ni se factura. Este estado no se puede deshacer. También se eliminan todos los datos que se almacenaban únicamente en el nodo de trabajo, como las imágenes de contenedores.

Deployed state

Las actualizaciones se han desplegado correctamente en el nodo trabajador. Después de desplegar las actualizaciones, Red Hat OpenShift on IBM Cloud inicia una comprobación de estado en el nodo trabajador. Después de que la comprobación de estado sea correcta, el nodo trabajador pasa a un estado Normal. Los nodos trabajadores con un estado Deployed normalmente están preparados para recibir cargas de trabajo, lo que puede comprobar ejecutando oc get nodes y confirmando que el estado es Normal.

Deploying state

El estado Deploying significa que, cuando se actualiza la versión de Kubernetes del nodo de trabajador, este se vuelve a desplegar para instalar las actualizaciones. Si vuelve a cargar o rearrancar el nodo trabajador, el nodo trabajador se vuelve a desplegar para instalar automáticamente la última versión del parche. Si el nodo trabajador queda bloqueado en este estado durante mucho tiempo, compruebe si se ha producido un problema durante la recarga.

Deploy_failed state

El estado Deploy_failed significa que no se ha podido desplegar el nodo de trabajador. Cree una lista de los detalles del nodo de trabajador para consultar los detalles del error ejecutando ibmcloud oc worker get --cluster CLUSTER_NAME_OR_ID --worker WORKER_NODE_ID.

Normal state

El estado Normal significa que el nodo de trabajador se ha suministrado completamente y está listo para su uso en el clúster. Este estado se considera correcto y no requiere ninguna acción por parte del usuario.

Aunque los nodos trabajadores podrían poseer un estado normal, otros recursos de infraestructura como, por ejemplo la red y el almacenamiento, podrían requerir su atención.

NotReady state

Los nodos de trabajo pueden estar sobrecargados cuando informan con frecuencia de un estado de NotReady o expulsan pods debido a la falta de memoria u otros recursos. Considere la posibilidad de volver a evaluar los requisitos de capacidad para el nodo trabajador.

Provisioned state

El estado Provisioned significa que el nodo de trabajador ha completado el suministro y forma parte del clúster. Se empieza a facturar el nodo trabajador. El estado del nodo trabajador pronto muestra el estado y el estatus, como por ejemplo normal y listo (ready).

Provisioning state

El estado Provisioning significa que el nodo de trabajador se está suministrando y aún no está disponible en el clúster. Puede supervisar el proceso de suministro en la columna Estado de la salida de la CLI. Si tu nodo de trabajo permanece en este estado durante mucho tiempo, comprueba si se ha producido algún problema durante el aprovisionamiento.

Provision pending state

El estado Provision pending significa que el proceso de suministro del nodo de trabajador está esperando a que se complete otro proceso. Puede supervisar el otro proceso que se debe completar en la columna Estatus (Status) de la salida de la CLI. Por ejemplo, en los clústeres VPC, el estado Pending security group creation indica que el grupo de seguridad de los nodos de trabajo se está creando primero, antes de que se puedan aprovisionar dichos nodos. Si el nodo trabajador queda bloqueado en este estado durante mucho tiempo, compruebe si se ha producido un problema durante el otro proceso.

Provision_failed state

El nodo trabajador no se ha podido suministrar. Cree una lista de los detalles del nodo de trabajador para consultar los detalles del error ejecutando ibmcloud oc worker get --cluster CLUSTER_NAME_OR_ID --worker WORKER_NODE_ID.

Reloading state

El estado Reloading significa que el nodo de trabajador se está recargando y no está disponible en el clúster. Puede supervisar el proceso de recarga en la columna Estado de la salida de la CLI. Si tu nodo de trabajo permanece en este estado durante mucho tiempo, comprueba si se ha producido algún problema durante la recarga.

reload_failed state

Un estado reload_failed de este tipo significa que no se ha podido recargar tu nodo de trabajo. Ejecuta el siguiente comando para conocer los detalles del fallo.

ibmcloud oc worker get --cluster CLUSTER_NAME_OR_ID --worker WORKER_NODE_ID

Revisa el campo Estado en el resultado. En la siguiente lista se describen las causas más comunes y los pasos para solucionar el problema.

Error en la actualización del firmware (solo VPC bare metal)
Si el nodo de trabajo es un servidor bare metal de VPC, el fallo de recarga podría deberse a una actualización de firmware que se aplicó automáticamente como parte de la recarga. El nodo de trabajo entra en el estado reload_failed con el estado y Failed to reload worker los detalles del estado The infrastructure firmware update has failed. (P4056). Para solucionar el problema, prueba a seguir estos pasos en el orden indicado:
  1. Vuelve a intentar la recarga ejecutando ibmcloud oc worker reload --cluster CLUSTER_NAME_OR_ID --worker WORKER_NODE_ID.
  2. Si los intentos de recarga siguen fallando debido a un error en la actualización del firmware, abre un caso de soporte técnico en IBM Cloud.
Otras causas
Para fallos no relacionados con el firmware, consulta Solución de problemas en nodos de trabajo para conocer pasos de recuperación adicionales.

Reload_pending state

Se han solicitado la recarga o la actualización de la versión de Kubernetes del nodo de trabajador. Cuando comienza la recarga, el estado cambia a Reloading.

Unknown state

El estado Unknown significa que no se puede acceder al nodo maestro de Kubernetes por alguna de las siguientes razones:

  • Ha solicitado una actualización del nodo maestro de Kubernetes. El estado del nodo de trabajador no se puede recuperar durante la actualización. Si el nodo de trabajador permanece en este estado durante un período de tiempo prolongado, aun después de haberse actualizado correctamente el nodo maestro de Kubernetes, intente recargar el nodo de trabajador.
  • Es posible que tenga otro cortafuegos que proteja los nodos de trabajador o que haya cambiado los valores del cortafuegos recientemente. Red Hat OpenShift on IBM Cloud requiere que se abran determinados puertos y direcciones IP para permitir la comunicación desde el nodo de trabajador al nodo maestro de Kubernetes y viceversa. Para obtener más información, consulte El cortafuegos impide que los nodos trabajadores se conecten.
  • El maestro de Kubernetes está inactivo. Póngase en contacto con el equipo de soporte de IBM Cloud abriendo un caso de soporte de IBM Cloud.

Warning state

El estado Warning significa que el nodo de trabajador está alcanzando el límite de memoria o de espacio de disco. Puede reducir la carga de trabajo de su nodo de trabajo o añadir un nodo de trabajo a su clúster para ayudar a equilibrar la carga de trabajo.