Porque OpenShift mostrar que a versão do cluster não está atualizada?

Nuvem privada virtual Infraestrutura clássica Satellite

Você vê um ou mais dos itens a seguir por um período de tempo estendido

  • O OpenShift Web Console exibe um banner indicando que o cluster está atualizando e a página Configurações do cluster mostra que a versão atual tem um status de Partial.

  • Ao executar o comando ibmcloud oc cluster get --cluster <cluster_name>, você verá um estado warning e um status indicando que os operadores de cluster não estão na versão mais recente.

    State:                          warning
    Status:                         Some Cluster Operators are down-level and need to be updated, see 'https://ibm.biz/rhos_clusterversion_ts'
    
  • Ao executar o comando oc get clusterversion você vê uma versão anterior.

    NAME      VERSION   AVAILABLE   PROGRESSING   SINCE   STATUS
    version   4.11.27   True        True          27h     Unable to apply 4.12.3: an unknown error has occurred: MultipleErrors
    
  • Você vê que um upgrade de mestre de cluster foi cancelado com um status semelhante ao seguinte.

    Version update canceled. CAE012: Cannot complete cluster master operations because the current OpenShift clusterversion rollout is not complete. For more information, see the troubleshooting docs: 'https://ibm.biz/rhos_clusterversion_ts'
    

Uma atualização de cluster mestre para uma nova versão de correção ou um upgrade para uma nova versão secundária não foi concluída

Uma atualização do cluster principal é concluída logo após a atualização do Cluster Version Operator. O Cluster Version Operator gerencia as atualizações de vários Cluster Operators, que continuam após a conclusão de uma atualização do mestre do cluster.

$ oc get clusterversion
NAME      VERSION   AVAILABLE   PROGRESSING   SINCE   STATUS
version   4.13.11   True        False         33h     Cluster version is 4.13.11

$ oc get co
NAME                                       VERSION   AVAILABLE   PROGRESSING   DEGRADED   SINCE   MESSAGE
console                                    4.13.11   True        False         False      2d3h    
csi-snapshot-controller                    4.13.11   True        False         False      2d4h    
dns                                        4.13.11   True        False         False      2d4h    
image-registry                             4.13.11   True        False         False      2d4h    
ingress                                    4.13.11   True        False         False      2d4h    
insights                                   4.13.11   True        False         False      2d4h    
kube-apiserver                             4.13.11   True        False         False      2d4h    
kube-controller-manager                    4.13.11   True        False         False      2d4h    
kube-scheduler                             4.13.11   True        False         False      2d4h    
kube-storage-version-migrator              4.13.11   True        False         False      2d4h    
marketplace                                4.13.11   True        False         False      2d4h    
monitoring                                 4.13.11   True        False         False      2d4h    
network                                    4.13.11   True        False         False      2d4h    
node-tuning                                4.13.11   True        False         False      32h     
openshift-apiserver                        4.13.11   True        False         False      2d4h    
openshift-controller-manager               4.13.11   True        False         False      2d4h    
openshift-samples                          4.13.11   True        False         False      33h     
operator-lifecycle-manager                 4.13.11   True        False         False      2d4h    
operator-lifecycle-manager-catalog         4.13.11   True        False         False      2d4h    
operator-lifecycle-manager-packageserver   4.13.11   True        False         False      2d4h    
service-ca                                 4.13.11   True        False         False      2d4h    
storage                                    4.13.11   True        False         False      2d4h    

Se o cluster acabou de ser atualizado, os operadores do cluster podem levar vários minutos para fazer upgrade É normal ver um status como o seguinte com o número de etapas concluídas aumentando com o tempo.

Working towards 4.13.11: 511 of 616 done (82% complete), waiting on network

Se o cluster continuar mostrando atualização parcial por um período estendido, há um problema no cluster que está impedindo os operadores de cluster de atualizar para a versão atual. Isso pode ser causado por muitas coisas, como os seguintes exemplos.

  • Componentes de cluster não funcionais, como nós do trabalhador, que bloqueiam o lançamento de atualizações do operador
  • Mudança incorreta para uma configuração do operador de cluster
  • Mudanças conflitantes em configurações de cluster, como mudanças de RBAC que afetam os componentes do OpenShift

Comece obtendo informações mais detalhadas sobre o progresso e os problemas de atualização do operador do cluster

  1. Execute os seguintes comandos para obter mais informações.

    oc get clusterversion
    
    oc get clusteroperators
    
    oc describe clusteroperator NAME
    
  2. Revise a coluna MESSAGE na saída de comando para identificar quais operadores de cluster estão atualmente bloqueando o progresso e fornecer uma indicação do problema.. A maneira na qual os operadores de atualizações do OpenShift podem resultar em dependências inesperadas; por exemplo, algumas atualizações do operador do cluster podem estar esperando que outros operadores concluam a etapa em que eles estão executando agora

  3. Verifique o status do nó do trabalhador usando o comando oc get nodes Às vezes os nós não são Ready, o que pode ser devido a uma falta de recursos em um nó ou um problema com kube-proxy ou kubelet. Isso pode causar problemas durante uma atualização

    • Se você tiver mudado recentemente a configuração de um dos operadores incompletos, descreva o operador para obter mais detalhes executando oc describe clusteroperator NAME Por exemplo oc describe cluster-operator image-registry pode mostrar um erro que ajuda a identificar o problema.

    • Continue verificando o status e os logs dos pods do operador para depuração adicional do problema. Às vezes, os operadores são degradados, mas isso não significa que as atualizações falharam ou não estão funcionando

  4. Se não for possível identificar ou resolver os problemas ou se o problema persistir, entre em contato com o suporte. Abrir um caso de suporte. No caso de detalhes, certifique-se de incluir quaisquer arquivos de log relevantes, mensagens de erros ou saídas de comando...