Perché viene visualizzato un messaggio di errore di timeout quando si tenta di accedere a un pod?

Risolvere i problemi relativi al timeout nell'esecuzione dei pod sui nodi di lavoro.

Infrastrutture classiche

Hai eliminato un nodo di lavoro nel tuo cluster e quindi aggiunto un nodo di lavoro. Quando si distribuisce un pod o un servizi Kubernetes, la risorsa non riesce ad accedere al nodo di lavoro appena creato e la connessione va in timeout.

Se elimini un nodo di lavoro dal tuo cluster e quindi ne aggiungi un altro, è possibile che al nuovo nodo di lavoro venga assegnato l'indirizzo IP privato nel nodo di lavoro eliminato. Calico utilizza questo indirizzo IP come una tag e continua a provare a raggiungere il nodo eliminato.

Aggiorna manualmente i riferimenti all'indirizzo IP privato in modo che puntino al nodo corretto.

  1. Conferma di avere due nodi di lavoro con lo stesso indirizzo IP privato. Prendi nota di IP privato e ID del nodo di lavoro eliminato.

    ibmcloud oc worker ls --cluster CLUSTER_NAME_OR_ID
    
    ID                                                 Public IP       Private IP       Machine Type   State     Status   Zone   Version
    kube-dal10-cr9b7371a7fcbe46d08e04f046d5e6d8b4-w1   169.xx.xxx.xxx  10.xxx.xx.xxx    b3c.4x16       normal    Ready    dal10      1.35
    kube-dal10-cr9b7371a7fcbe46d08e04f046d5e6d8b4-w2   169.xx.xxx.xxx  10.xxx.xx.xxx    b3c.4x16       deleted    -       dal10      1.35
    
  2. Installa la CLI Calico.

  3. Elenca i nodi di lavoro disponibili in Calico. Sostituire " <path_to_file> " con il percorso locale del file di configurazione " Calico ".

    calicoctl get nodes --config=filepath/calicoctl.cfg
    
    NAME
    kube-dal10-cr9b7371a7faaa46d08e04f046d5e6d8b4-w1
    kube-dal10-cr9b7371a7faaa46d08e04f046d5e6d8b4-w2
    
  4. Elimina il nodo di lavoro duplicato in Calico. Sostituisci NODE_ID con l'ID del nodo di lavoro.

    calicoctl delete node NODE_ID --config=<path_to_file>/calicoctl.cfg
    
  5. Riavvia il nodo di lavoro che non è stato eliminato.

    ibmcloud oc worker reboot --cluster <cluster_name_or_id> --worker <worker_id>
    

Il nodo di lavoro non è più elencato in Calico.