Preparazione di IBM Cloud: aggiornamenti di manutenzione e miglioramenti alla sicurezza

Scopri come preparare i tuoi collaboratori di IBM Cloud agli aggiornamenti di manutenzione degli host, ridurre al minimo le interruzioni e garantire che i miglioramenti alla sicurezza vengano applicati senza intoppi.

IBM Gli ingegneri eseguono operazioni di manutenzione sugli host per migliorarne la stabilità, apportare miglioramenti alla sicurezza e garantire il supporto per le nuove funzionalità in arrivo. IBM Cloud I fornitori di infrastrutture eseguono operazioni di manutenzione sugli host che ospitano i server Virtual Servers utilizzati come worker nel cluster, il che potrebbe causare una breve interruzione del servizio di alcuni worker. Tuttavia, ci sono delle azioni che puoi intraprendere prima del periodo di manutenzione che possono ridurre al minimo le interruzioni ai tuoi nodi di lavoro. Una notifica con i dettagli di manutenzione e un elenco di operatori interessati viene inviata ai clienti prima della finestra di manutenzione. Attieniti a questi passi per preparare i tuoi dipendenti per un periodo di manutenzione imminente.

Identificazione dei lavoratori interessati

Se i tuoi lavoratori sono pianificati per essere sottoposti a manutenzione, ricevi una notifica prima dell'inizio della finestra di manutenzione. Un elenco degli operatori interessati viene incluso nella notifica.

L'elenco dei componenti interessati potrebbe essere simile al seguente esempio. I passi qui documentati si applicano ai nodi di lavoro elencati nella sezione IBM Kubernetes Service o Red Hat OpenShift on IBM Cloud Workers.

**Virtual Server Instances scheduled for maintenance**
    Virtual Server Instances in your account:
           ID                                           Name
           1111_1a111aaa-1a1a-1aa1-1111-a11a111a1111    my_vpc_cluster_1
    Virtual Server Instances in service accounts:
        Application Load Balancer
            alb-11aa111a-1111111
    
        IBM Kubernetes Service or Red Hat OpenShift on IBM Cloud workers
            kube-aaaa1aaa111aa11aa11a-aaaaaaaaaaa-aaaaaaa-00001a11
            kube-aaaa2aaa222aa22aa22a-aaaaaaaaaaa-aaaaaaa-00002a22
            kube-aaaa3aaa333aa33aa33a-aaaaaaaaaaa-aaaaaaa-00003a33

Azioni da intraprendere prima del periodo di mantenimento

Attieniti a questi passi per preparare i tuoi dipendenti per il periodo di manutenzione. I nodi di lavoro non possono essere pianificati sugli host pianificati per la manutenzione. Puoi evitare interruzioni del tuo carico di lavoro riavviando o sostituendo i tuoi nodi di lavoro in modo che si spostino su host diversi che non sono in manutenzione.

Operatori nei cluster classici

Segui la procedura per riavviare il nodo di lavoro prima che inizi il periodo di manutenzione.

  1. Cordon l'operaio.

    oc adm cordon <worker_id>
    
  2. Svuotare l'operatore.

    Esempio di comando di scarico

    oc adm drain <worker_id>
    

    Esempio di comando di scarico per Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. Riavviare il nodo di lavoro. Assicuratevi di includere l'opzione --hard.

    ibmcloud oc worker reboot --cluster <cluster_name_or_id> --worker <worker_id> --hard
    
  4. Contrassegna l'operatore come disponibile per la pianificazione.

    oc adm uncordon <worker_id>
    

Nodi di lavoro nei cluster VPC

Per i nodi di lavoro nei cluster VPC, i passi da eseguire dipendono dal profilo del nodo di lavoro. Per controllare il profilo di un nodo di lavoro, esegui ibmcloud oc worker get --worker <worker_id> --cluster <cluster_name_or_id>.

Per i worker delle istanze di server virtuali (VSI) VPC (worker senza memoria locale):

  1. Cordon l'operaio.

    oc adm cordon <worker_id>
    
  2. Svuotare l'operatore. In alcuni scenari, come Cloud Pak for Data, potrebbe essere necessario specificare ulteriori opzioni di scarico.

    Esempio di comando di scarico

    oc adm drain <worker_id>
    

    Esempio di comando di scarico per Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    
  3. Sostituisci l'operatore.

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>
    
  4. Contrassegna l'operatore come disponibile per la pianificazione.

    oc adm uncordon <worker_id>
    

Per chi lavora con VPC bare metal:

I worker bare metal di VPC supportano il comando worker reload , che ricarica il nodo sul posto senza provisionare un nuovo nodo worker. Il nodo conserva il proprio indirizzo IP e gli altri identificatori. Se è in sospeso un aggiornamento del firmware, questo viene applicato automaticamente durante il ricaricamento e può allungare il tempo totale di ricaricamento di 30 minuti o più. Se il tuo Bare Metal Worker dispone di uno spazio di archiviazione locale, esegui il backup di tutti i dati che non sono memorizzati su uno spazio di archiviazione persistente prima di iniziare, poiché i dati presenti sui dischi locali andranno persi durante il ricaricamento.

Parte 1: Preparare l'addetto alla manutenzione

  1. Se il dispositivo dispone di memoria locale, esegui il backup dei dati che desideri conservare prima di procedere. Durante un ricaricamento, i dati presenti sui dischi locali vanno persi.

  2. Bloccare il processo per impedire che vengano pianificati nuovi carichi di lavoro su di esso.

    oc adm cordon <worker_id>
    
  3. Svuotare il worker per liberarlo dai carichi di lavoro esistenti. In alcuni scenari, come Cloud Pak for Data, potrebbe essere necessario specificare ulteriori opzioni di scarico.

    Esempio di comando di scarico

    oc adm drain <worker_id>
    

    Esempio di comando di scarico per Cloud Pak for Data

    oc adm drain <worker_id> --force --delete-emptydir-data --ignore-daemonsets
    

Parte 2: Eseguire la manutenzione

  1. Ricarica il worker. Il nodo viene ricaricato in loco su un host che non è in fase di manutenzione e mantiene il proprio indirizzo IP.

    ibmcloud oc worker reload --cluster <cluster_name_or_id> --worker <worker_id>
    

    In alternativa, è possibile sostituire il worker invece di ricaricarlo. La sostituzione del worker comporta l'eliminazione del nodo esistente e la creazione di uno nuovo con un nuovo indirizzo IP.

    ibmcloud oc worker replace --cluster <cluster_name_or_id> --worker <worker_id>