Installazione del componente aggiuntivo Red Hat OpenShift AI

Seguire i passaggi per installare il componente aggiuntivo AI ( OpenShift ) su un cluster esistente.

Vuoi implementare l'operatore OpenShift AI su un nuovo cluster? Prova l 'intelligenza OpenShift artificiale sull'architettura IBM Cloud implementabile.

Requisiti minimi

Prima di configurare il componente aggiuntivo, è necessario tenere conto delle seguenti considerazioni.

  • Esaminare le versioni dei componenti aggiuntivi del cluster supportate e determinare quale versione del componente aggiuntivo installare nel cluster.
  • Il cluster deve avere almeno 2 nodi worker. Ogni nodo worker deve avere almeno 8vCPU e 32GB memoria.
  • I nodi worker devono utilizzare il sistema operativo RHCOS.
  • È necessario consentire il traffico in uscita dal cluster per installare gli operatori richiesti.

Versioni supportate

Esamina le versioni supportate del componente aggiuntivo OpenShift AI e le corrispondenti versioni OpenShift AI e Red Hat OpenShift on IBM Cloud.

Versioni del componente aggiuntivo AI supportate e versioni corrispondenti per Red Hat OpenShift AI e Red Hat OpenShift on IBM Cloud.
OpenShift Versione aggiuntiva AI Red Hat OpenShift Versione AI Versioni del cluster supportate
420 3.4.2 420.421
419 3.4.0 4.19, 4.20, 4.21
418 2.25.6 4.18, 4.19
417 2.25.6 4.17, 4.18
416 2.25.6 4.16, 4.17

L'aggiornamento dalla versione 418 alla 419 non è supportato. Sono consentite solo le nuove installazioni della versione 419. Per ulteriori informazioni, consultare la sezione " Informazioni sul componente aggiuntivo AI ' OpenShift ' ".

Considerazioni

  • Per utilizzare tutte le funzionalità offerte da OpenShift AI, si consiglia almeno 1 GPU.
  • Il cluster può avere un mix di nodi GPU e non GPU. Tuttavia, se si utilizza questa configurazione, assicurarsi di distribuire l'applicazione su un nodo GPU per sfruttarne le risorse.
  • A partire dalla versione 2.19.0 di OpenShift AI Operator, KServe è disponibile in modalità avanzata o standard. Per impostazione predefinita, quando si installa KServe tramite il sito OpenShift AI utilizzando il componente aggiuntivo IBM Cloud, viene installato in modalità Standard. Se si desidera utilizzare la modalità avanzata, è necessario completare i passaggi opzionali dopo l'installazione del componente aggiuntivo.

Prima di iniziare

Completate questi passaggi prima di installare il componente aggiuntivo.

  1. Accedi al tuo account. Se applicabile, specifica il gruppo di risorse appropriato. Imposta il contesto per il tuo cluster.

  2. Facoltativo: se non ne avete già uno, create un VPC Public Gateway.

  3. Se si desidera utilizzare gli operatori OpenShift Pipelines, Node Feature Discovery o NVIDIA GPU con il componente aggiuntivo OpenShift AI, è necessario abilitare OperatorHub sul cluster e disabilitare la protezione del traffico in uscita. Se non si desidera utilizzare questi operatori, saltare questo passaggio.

    1. Abilitare OperatorHub sul cluster.
    oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'
    
    1. Disattivare la protezione del traffico in uscita.

    Disattivando la protezione del traffico in uscita, si possono consentire tutte le connessioni di rete esterne. Per ulteriori informazioni, vedere Gestione della protezione del traffico in uscita nei cluster VPC.

    ibmcloud oc vpc outbound-traffic-protection disable --cluster CLUSTER
    

Prerequisiti

Completate questi passaggi prima di installare il componente aggiuntivo.

  1. Accedi al tuo account. Se applicabile, specifica il gruppo di risorse appropriato. Imposta il contesto per il tuo cluster.

  2. Facoltativo: se non ne avete già uno, create un VPC Public Gateway.

  3. Se si desidera utilizzare gli operatori OpenShift Pipelines, Node Feature Discovery o NVIDIA GPU con il componente aggiuntivo OpenShift AI, è necessario abilitare OperatorHub sul cluster e disabilitare la protezione del traffico in uscita. Se non si desidera utilizzare questi operatori, saltare questo passaggio.

    1. Abilitare OperatorHub sul cluster.
    oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'
    
    1. Disattivare la protezione del traffico in uscita.

    Disattivando la protezione del traffico in uscita, si possono consentire tutte le connessioni di rete esterne. Per ulteriori informazioni, vedere Gestione della protezione del traffico in uscita nei cluster VPC.

    1. Nella console, navigare nella pagina Cluster e fare clic sul cluster pertinente.
    2. Nella pagina Panoramica del cluster, individuare la sezione Rete e selezionare l'opzione Protezione del traffico in uscita disattivata.

Passo 1: Scegliere le opzioni di personalizzazione

È possibile migliorare i progetti di AI di Red Hat OpenShift specificando diverse opzioni da includere nell'installazione del componente aggiuntivo, come le pipeline di dati per la creazione di flussi di lavoro di apprendimento automatico portatili o gli strumenti per la gestione e la scalabilità delle risorse. È inoltre possibile personalizzare i criteri di aggiornamento e di eliminazione. Per la descrizione di ciascuna opzione disponibile, vedere OpenShift Opzioni di personalizzazione AI. Se non si include un'opzione specifica quando si installa il componente aggiuntivo, si applica il valore predefinito. Queste opzioni sono gestite dalla piattaforma Red Hat OpenShift AI.

Nella CLI, eseguire il comando per elencare tutte le opzioni. Nell'interfaccia utente, queste opzioni sono elencate nella sezione Capacità durante l'installazione.

ibmcloud oc cluster addon options --addon openshift-ai

Fase 2: Esaminare gli operatori aggiuntivi consigliati

È possibile scegliere di installare anche operatori aggiuntivi consigliati per l'utilizzo di alcune funzioni di OpenShift AI. Se non sono già installati sul cluster, si può scegliere di includerli nell'installazione del componente aggiuntivo. In alternativa, è possibile installarli in qualsiasi momento utilizzando il sito OperatorHub o seguendo la procedura di installazione specifica per l'operatore. Per utilizzare questi operatori, è necessario disabilitare la protezione del traffico in uscita per il cluster.

L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.

Si consigliano i seguenti operatori.

Alcuni di questi operatori possono includere personalizzazioni aggiuntive che l'utente può scegliere di specificare quando installa il componente aggiuntivo. Esaminare l'elenco delle personalizzazioni disponibili per gli operatori consigliati.

Passo 3: installare il componente aggiuntivo nella CLI

Eseguire il comando per installare il componente aggiuntivo Red Hat OpenShift AI. Specificare le personalizzazioni con il formato --parameter PARAM=VALUE. Ad esempio, per includere l'opzione Data Science Pipelines, specificare --parameter oaiDataSciencePipelines=Managed.

Per includere gli operatori consigliati quando si installa il componente aggiuntivo con la CLI, specificare le seguenti opzioni quando si esegue il comando di installazione.

  • OpenShift Condotte: --parameter pipelineEnabled=true
  • Node Scoperta delle caratteristiche: --parameter nfdEnabled=true
  • NVIDIA Operatore GPU: --parameter nvidiaEnabled=true

Per un elenco delle versioni disponibili, vedere Versioni supportate.

Comando di installazione.

ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER [-f] [--param PARAM] [-q] [--version VERSION]

Esempio di comando per installare il componente aggiuntivo con gli aggiornamenti automatici di minor e patch, CodeFlare, e KServe abilitati.

ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER --param oaiInstallPlanApproval=Automatic --param oaiCodeflare=Managed --param oaiKserve=Managed

Fase 2: Esaminare gli operatori aggiuntivi consigliati

È possibile scegliere di installare anche operatori aggiuntivi consigliati per l'utilizzo di alcune funzioni di OpenShift AI. Se non sono già installati sul cluster, si può scegliere di includerli nell'installazione del componente aggiuntivo. In alternativa, è possibile installarli in qualsiasi momento utilizzando il sito OperatorHub o seguendo la procedura di installazione specifica per l'operatore. Per utilizzare questi operatori, è necessario disabilitare la protezione del traffico in uscita per il cluster.

L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.

Si consigliano i seguenti operatori.

Alcuni di questi operatori possono includere personalizzazioni aggiuntive che l'utente può scegliere di specificare quando installa il componente aggiuntivo. Esaminare l'elenco delle personalizzazioni disponibili per gli operatori consigliati.

Passo 3: installare il componente aggiuntivo nell'interfaccia utente

Installare il componente aggiuntivo Red Hat OpenShift AI con l'interfaccia utente.

  1. Vai alla pagina del cluster e clicca sul cluster pertinente.

  2. Nella pagina dei dettagli del cluster, si trova la sezione Componenti aggiuntivi. Individuare l'opzione Red Hat OpenShift AI e fare clic su Installa.

  3. Nella sezione Capacità, esaminare la descrizione delle opzioni di personalizzazione dei componenti aggiuntivi disponibili e abilitare le opzioni che si desidera includere nell'installazione.

  4. Nella sezione Operatori aggiuntivi consigliati, fare clic per espandere ciascun operatore e selezionare le opzioni di personalizzazione che si desidera includere. Questi operatori aggiuntivi e queste personalizzazioni sono consigliati per alcune funzioni di Red Hat OpenShift AI. È possibile scegliere di installare queste opzioni in un secondo momento utilizzando il sito OperatorHub o seguendo i passaggi di installazione specifici per l'operatore.

    L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.

  5. Fai clic su Install.

Passo 4: accedere alla dashboard di OpenShift AI

Dopo aver installato il componente aggiuntivo OpenShift AI, è possibile accedere alla dashboard di OpenShift AI.

  1. Dalla pagina di panoramica del cluster, fare clic su “ OpenShift ” nella console web.
  2. Da Application launcher Application launcher, selezionare l'opzione Red Hat OpenShift AI dashboard.
  3. Se richiesto, fare clic su Log in with OpenShift.

Opzionale: Impostazione di KServe in modalità avanzata

Se si desidera utilizzare KServe in modalità avanzata, è necessario completare i seguenti passaggi.

  1. Installare OpenShift Serverless Operator da OperatorHub.
  2. Installare il Service Mesh Operator di OpenShift da OperatorHub.
  3. Impostare lo stato di gestione della rete di servizi su Managed nel CR di inizializzazione del cluster Data Science.
    serviceMesh:
        controlPlane:
            metricsCollection: Istio
            name: data-science-smcp
            namespace: istio-system
        managementState: Managed
    
  4. Impostare lo stato di gestione del servizio KServe su Managed nella risorsa personalizzata Data Science Cluster.
    kserve:
        managementState: Managed
        serving:
          managementState: Managed
          name: knative-serving
    

OpenShift Opzioni di personalizzazione dell'intelligenza artificiale

Esaminare le opzioni di personalizzazione disponibili per il componente aggiuntivo OpenShift AI. Questi operatori sono gestiti dalla piattaforma Red Hat OpenShift AI.

Per includere un'opzione durante l 'installazione dell'add-on OpenShift AI con la CLI, includere l'opzione con il --parameter PARAM=VALUE formato quando si esegue il comando ibmcloud oc cluster addon enable openshift-ai. Ad esempio, per installare il componente aggiuntivo con l'opzione Data Science Pipelines, specificare --parameter oaiDataSciencePipelines=Managed.

Per includere un'opzione durante l 'installazione del componente OpenShift aggiuntivo AI con l'interfaccia utente, fare clic per abilitare l'opzione quando richiesto. Queste opzioni sono incluse nella sezione Capacità.

OpenShift Opzioni di personalizzazione del componente aggiuntivo AI e parametri CLI.
Personalizzazione Parametro CLI Descrizione Valori Valore predefinito
OpenShift Politica di approvazione degli aggiornamenti minori e delle patch della piattaforma AI oaiInstallPlanApproval Applicare aggiornamenti minori e patch automaticamente o manualmente. Automatic oppure Manual Automatic
OpenShift Politica di cancellazione dell'IA oaiDeletePolicy Conservare o eliminare gli operatori o i componenti installati dal componente aggiuntivo se questo viene rimosso. Retain oppure Delete Retain
Cruscotto Open Data Hub oaiDashboard Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)
Kueue oaiKueue Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)
CodeFlare oaiCodeflare Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)
ModelMesh Servire oaiModelmeshserving Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)
Workbench oaiWorkbenches Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)
Pipeline di scienza dei dati oaiDataSciencePipelines Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)
KServe oaiKserve Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)
Ray oaiRay Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. Managed per abilitare
Removed per disabilitare
Managed (abilitato)

Altri operatori consigliati

Esaminare gli operatori consigliati e le personalizzazioni opzionali che si possono includere durante l'installazione. L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.

Per includere una personalizzazione per un operatore quando si installa l'add-on OpenShift AI con la CLI, includere l'opzione con il --parameter PARAM=VALUE formato quando si esegue il ibmcloud oc cluster addon enable openshift-ai. Ad esempio, per includere la personalizzazione NVIDIA GPUDirect Storage per NVIDIA l'operatore, specificare --parameter nvidiaGpuDirectStorageEnabled=true.

Per includere una personalizzazione per un operatore quando si installa il componente OpenShift aggiuntivo AI con l'interfaccia utente, fare clic per abilitare l'opzione quando richiesto. Si noti che esistono ulteriori NVIDIA operatori con impostazioni predefinite che possono essere modificate solo nella CLI o modificando il file ClusterPolicy.

OpenShift Opzioni di personalizzazione AI per operatori aggiuntivi. Queste impostazioni possono essere modificate durante l'installazione nella CLI o nell'interfaccia utente.
Personalizzazione Parametro CLI Descrizione Valore Impostazione predefinita
Node Politica di eliminazione delle funzionalità di Discovery nfdDeletePolicy Mantenere o eliminare l'operatore se il componente aggiuntivo OpenShift AI viene rimosso. Retain (impostazione predefinita) o Delete Retain
NVIDIA Politica di cancellazione dell'operatore GPU nvidiaDeletePolicy Mantenere o eliminare l'operatore se il componente aggiuntivo OpenShift AI viene rimosso. Retain (impostazione predefinita) o Delete Retain
NVIDIA Test post-installazione di CUDA nvidiaCudaTest Abilitare i test CUDA di NVIDIA. true (abilitato, predefinito)
false (disabilitato)
false (disattivato)
Politica di cancellazione dell'operatore del gasdotto pipelineDeletePolicy Mantenere o eliminare l'operatore se il componente aggiuntivo OpenShift AI viene rimosso. Retain (impostazione predefinita) o Delete

I seguenti operatori GPU NVIDIA si applicano con le impostazioni predefinite. È possibile modificare queste impostazioni durante l'installazione solo se si installa il componente aggiuntivo con la CLI. Dopo l'installazione, è possibile modificare queste impostazioni, sia nell'interfaccia utente che nella CLI, modificando il file ClusterPolicy.

OpenShift Opzioni di personalizzazione AI per operatori aggiuntivi. Queste impostazioni possono essere modificate solo durante l'installazione nella CLI.
Personalizzazione Parametro CLI Descrizione Valori CLI Impostazione predefinita dell'interfaccia utente
NVIDIA Carichi di lavoro in Sandbox nvidiaSandboxWorkloads Abilita la gestione di operandi aggiuntivi necessari per i carichi di lavoro sandbox. true (abilitato, predefinito)
false (disabilitato)
Enabled
NVIDIA vGPU Direttore nvidiaVgpuManagerEnabled Abilitare NVIDIA vGPU Manager. true (abilitato, predefinito)
false (disabilitato)
Enabled
NVIDIA Conservazione diretta GPUD nvidiaGpuDirectStorageEnabled Abilitare l'archiviazione GPUDirect. true (abilitato, predefinito)
false (disabilitato)
Enabled
NVIDIA Node Esportatore di stati nvidiaNodeStatusExporterEnabled Abilita l’esportatore di stato “ Node ”. true (abilitato, predefinito)
false (disabilitato)
Enabled
NVIDIA Gestore I/O delle funzioni virtuali nvidiaVfioManagerEnabled Abilitare VFIO Manager per la configurazione della distribuzione di VFIO-PCI. true (abilitato, predefinito)
false (disabilitato)
Enabled
NVIDIA Plug-in per dispositivi Sandbox nvidiaSandboxDevicePluginEnabled Abilitare il plug-in del dispositivo NVIDIA Sandbox. true (abilitato, predefinito)
false (disabilitato)
Enabled
Gestione GPU multi-istanza NVIDIA nvidiaMigManagerEnabled Abilitare NVIDIA Multi Instance GPU Manager. true (abilitato, predefinito)
false (disabilitato)
Enabled
NVIDIA Distribuzione di Hostengine Data Center GPU Manager nvidiaDcgmEnabled Abilitare la distribuzione di NVIDIA Data Center GPU Manager Hostengine come pod separato. true (abilitato, predefinito)
false (disabilitato)
Enabled
NVIDIA vGPU Gestione dispositivi nvidiaVgpuDeviceManagerEnabled Abilitare NVIDIA vGPU Gestione dispositivi. true (abilitato, predefinito)
false (disabilitato)
Enabled

Operazioni successive