Installazione del componente aggiuntivo Red Hat OpenShift AI
Seguire i passaggi per installare il componente aggiuntivo AI ( OpenShift ) su un cluster esistente.
Vuoi implementare l'operatore OpenShift AI su un nuovo cluster? Prova l 'intelligenza OpenShift artificiale sull'architettura IBM Cloud implementabile.
Requisiti minimi
Prima di configurare il componente aggiuntivo, è necessario tenere conto delle seguenti considerazioni.
- Esaminare le versioni dei componenti aggiuntivi del cluster supportate e determinare quale versione del componente aggiuntivo installare nel cluster.
- Il cluster deve avere almeno 2 nodi worker. Ogni nodo worker deve avere almeno 8vCPU e 32GB memoria.
- I nodi worker devono utilizzare il sistema operativo RHCOS.
- È necessario consentire il traffico in uscita dal cluster per installare gli operatori richiesti.
Versioni supportate
Esamina le versioni supportate del componente aggiuntivo OpenShift AI e le corrispondenti versioni OpenShift AI e Red Hat OpenShift on IBM Cloud.
| OpenShift Versione aggiuntiva AI | Red Hat OpenShift Versione AI | Versioni del cluster supportate |
|---|---|---|
| 420 | 3.4.2 | 420.421 |
| 419 | 3.4.0 | 4.19, 4.20, 4.21 |
| 418 | 2.25.6 | 4.18, 4.19 |
| 417 | 2.25.6 | 4.17, 4.18 |
| 416 | 2.25.6 | 4.16, 4.17 |
L'aggiornamento dalla versione 418 alla 419 non è supportato. Sono consentite solo le nuove installazioni della versione 419. Per ulteriori informazioni, consultare la sezione " Informazioni sul componente aggiuntivo AI ' OpenShift ' ".
Considerazioni
- Per utilizzare tutte le funzionalità offerte da OpenShift AI, si consiglia almeno 1 GPU.
- Il cluster può avere un mix di nodi GPU e non GPU. Tuttavia, se si utilizza questa configurazione, assicurarsi di distribuire l'applicazione su un nodo GPU per sfruttarne le risorse.
- A partire dalla versione 2.19.0 di OpenShift AI Operator, KServe è disponibile in modalità avanzata o standard. Per impostazione predefinita, quando si installa KServe tramite il sito OpenShift AI utilizzando il componente aggiuntivo IBM Cloud, viene installato in modalità Standard. Se si desidera utilizzare la modalità avanzata, è necessario completare i passaggi opzionali dopo l'installazione del componente aggiuntivo.
Prima di iniziare
Completate questi passaggi prima di installare il componente aggiuntivo.
-
Facoltativo: se non ne avete già uno, create un VPC Public Gateway.
-
Se si desidera utilizzare gli operatori OpenShift Pipelines, Node Feature Discovery o NVIDIA GPU con il componente aggiuntivo OpenShift AI, è necessario abilitare OperatorHub sul cluster e disabilitare la protezione del traffico in uscita. Se non si desidera utilizzare questi operatori, saltare questo passaggio.
- Abilitare OperatorHub sul cluster.
oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'- Disattivare la protezione del traffico in uscita.
Disattivando la protezione del traffico in uscita, si possono consentire tutte le connessioni di rete esterne. Per ulteriori informazioni, vedere Gestione della protezione del traffico in uscita nei cluster VPC.
ibmcloud oc vpc outbound-traffic-protection disable --cluster CLUSTER
Prerequisiti
Completate questi passaggi prima di installare il componente aggiuntivo.
-
Facoltativo: se non ne avete già uno, create un VPC Public Gateway.
-
Se si desidera utilizzare gli operatori OpenShift Pipelines, Node Feature Discovery o NVIDIA GPU con il componente aggiuntivo OpenShift AI, è necessario abilitare OperatorHub sul cluster e disabilitare la protezione del traffico in uscita. Se non si desidera utilizzare questi operatori, saltare questo passaggio.
- Abilitare OperatorHub sul cluster.
oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'- Disattivare la protezione del traffico in uscita.
Disattivando la protezione del traffico in uscita, si possono consentire tutte le connessioni di rete esterne. Per ulteriori informazioni, vedere Gestione della protezione del traffico in uscita nei cluster VPC.
- Nella console, navigare nella pagina Cluster e fare clic sul cluster pertinente.
- Nella pagina Panoramica del cluster, individuare la sezione Rete e selezionare l'opzione Protezione del traffico in uscita disattivata.
Passo 1: Scegliere le opzioni di personalizzazione
È possibile migliorare i progetti di AI di Red Hat OpenShift specificando diverse opzioni da includere nell'installazione del componente aggiuntivo, come le pipeline di dati per la creazione di flussi di lavoro di apprendimento automatico portatili o gli strumenti per la gestione e la scalabilità delle risorse. È inoltre possibile personalizzare i criteri di aggiornamento e di eliminazione. Per la descrizione di ciascuna opzione disponibile, vedere OpenShift Opzioni di personalizzazione AI. Se non si include un'opzione specifica quando si installa il componente aggiuntivo, si applica il valore predefinito. Queste opzioni sono gestite dalla piattaforma Red Hat OpenShift AI.
Nella CLI, eseguire il comando per elencare tutte le opzioni. Nell'interfaccia utente, queste opzioni sono elencate nella sezione Capacità durante l'installazione.
ibmcloud oc cluster addon options --addon openshift-ai
Fase 2: Esaminare gli operatori aggiuntivi consigliati
È possibile scegliere di installare anche operatori aggiuntivi consigliati per l'utilizzo di alcune funzioni di OpenShift AI. Se non sono già installati sul cluster, si può scegliere di includerli nell'installazione del componente aggiuntivo. In alternativa, è possibile installarli in qualsiasi momento utilizzando il sito OperatorHub o seguendo la procedura di installazione specifica per l'operatore. Per utilizzare questi operatori, è necessario disabilitare la protezione del traffico in uscita per il cluster.
L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.
Si consigliano i seguenti operatori.
Alcuni di questi operatori possono includere personalizzazioni aggiuntive che l'utente può scegliere di specificare quando installa il componente aggiuntivo. Esaminare l'elenco delle personalizzazioni disponibili per gli operatori consigliati.
Passo 3: installare il componente aggiuntivo nella CLI
Eseguire il comando per installare il componente aggiuntivo Red Hat OpenShift AI. Specificare le personalizzazioni con il formato --parameter PARAM=VALUE.
Ad esempio, per includere l'opzione Data Science Pipelines, specificare --parameter oaiDataSciencePipelines=Managed.
Per includere gli operatori consigliati quando si installa il componente aggiuntivo con la CLI, specificare le seguenti opzioni quando si esegue il comando di installazione.
- OpenShift Condotte:
--parameter pipelineEnabled=true - Node Scoperta delle caratteristiche:
--parameter nfdEnabled=true - NVIDIA Operatore GPU:
--parameter nvidiaEnabled=true
Per un elenco delle versioni disponibili, vedere Versioni supportate.
Comando di installazione.
ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER [-f] [--param PARAM] [-q] [--version VERSION]
Esempio di comando per installare il componente aggiuntivo con gli aggiornamenti automatici di minor e patch, CodeFlare, e KServe abilitati.
ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER --param oaiInstallPlanApproval=Automatic --param oaiCodeflare=Managed --param oaiKserve=Managed
Fase 2: Esaminare gli operatori aggiuntivi consigliati
È possibile scegliere di installare anche operatori aggiuntivi consigliati per l'utilizzo di alcune funzioni di OpenShift AI. Se non sono già installati sul cluster, si può scegliere di includerli nell'installazione del componente aggiuntivo. In alternativa, è possibile installarli in qualsiasi momento utilizzando il sito OperatorHub o seguendo la procedura di installazione specifica per l'operatore. Per utilizzare questi operatori, è necessario disabilitare la protezione del traffico in uscita per il cluster.
L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.
Si consigliano i seguenti operatori.
Alcuni di questi operatori possono includere personalizzazioni aggiuntive che l'utente può scegliere di specificare quando installa il componente aggiuntivo. Esaminare l'elenco delle personalizzazioni disponibili per gli operatori consigliati.
Passo 3: installare il componente aggiuntivo nell'interfaccia utente
Installare il componente aggiuntivo Red Hat OpenShift AI con l'interfaccia utente.
-
Vai alla pagina del cluster e clicca sul cluster pertinente.
-
Nella pagina dei dettagli del cluster, si trova la sezione Componenti aggiuntivi. Individuare l'opzione Red Hat OpenShift AI e fare clic su Installa.
-
Nella sezione Capacità, esaminare la descrizione delle opzioni di personalizzazione dei componenti aggiuntivi disponibili e abilitare le opzioni che si desidera includere nell'installazione.
-
Nella sezione Operatori aggiuntivi consigliati, fare clic per espandere ciascun operatore e selezionare le opzioni di personalizzazione che si desidera includere. Questi operatori aggiuntivi e queste personalizzazioni sono consigliati per alcune funzioni di Red Hat OpenShift AI. È possibile scegliere di installare queste opzioni in un secondo momento utilizzando il sito OperatorHub o seguendo i passaggi di installazione specifici per l'operatore.
L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.
-
Fai clic su Install.
Passo 4: accedere alla dashboard di OpenShift AI
Dopo aver installato il componente aggiuntivo OpenShift AI, è possibile accedere alla dashboard di OpenShift AI.
- Dalla pagina di panoramica del cluster, fare clic su “ OpenShift ” nella console web.
- Da Application launcher
, selezionare l'opzione Red Hat OpenShift AI dashboard.
- Se richiesto, fare clic su
Log in with OpenShift.
Opzionale: Impostazione di KServe in modalità avanzata
Se si desidera utilizzare KServe in modalità avanzata, è necessario completare i seguenti passaggi.
- Installare OpenShift Serverless Operator da OperatorHub.
- Installare il Service Mesh Operator di OpenShift da OperatorHub.
- Impostare lo stato di gestione della rete di servizi su
Managednel CR di inizializzazione del cluster Data Science.serviceMesh: controlPlane: metricsCollection: Istio name: data-science-smcp namespace: istio-system managementState: Managed - Impostare lo stato di gestione del servizio KServe su
Managednella risorsa personalizzata Data Science Cluster.kserve: managementState: Managed serving: managementState: Managed name: knative-serving
OpenShift Opzioni di personalizzazione dell'intelligenza artificiale
Esaminare le opzioni di personalizzazione disponibili per il componente aggiuntivo OpenShift AI. Questi operatori sono gestiti dalla piattaforma Red Hat OpenShift AI.
Per includere un'opzione durante l 'installazione dell'add-on OpenShift AI con la CLI, includere l'opzione con il --parameter PARAM=VALUE formato quando si esegue il comando ibmcloud oc cluster addon enable openshift-ai. Ad esempio, per installare il componente aggiuntivo con l'opzione Data Science Pipelines, specificare --parameter oaiDataSciencePipelines=Managed.
Per includere un'opzione durante l 'installazione del componente OpenShift aggiuntivo AI con l'interfaccia utente, fare clic per abilitare l'opzione quando richiesto. Queste opzioni sono incluse nella sezione Capacità.
| Personalizzazione | Parametro CLI | Descrizione | Valori | Valore predefinito |
|---|---|---|---|---|
| OpenShift Politica di approvazione degli aggiornamenti minori e delle patch della piattaforma AI | oaiInstallPlanApproval |
Applicare aggiornamenti minori e patch automaticamente o manualmente. | Automatic oppure Manual |
Automatic |
| OpenShift Politica di cancellazione dell'IA | oaiDeletePolicy |
Conservare o eliminare gli operatori o i componenti installati dal componente aggiuntivo se questo viene rimosso. | Retain oppure Delete |
Retain |
| Cruscotto Open Data Hub | oaiDashboard |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
| Kueue | oaiKueue |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
| CodeFlare | oaiCodeflare |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
| ModelMesh Servire | oaiModelmeshserving |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
| Workbench | oaiWorkbenches |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
| Pipeline di scienza dei dati | oaiDataSciencePipelines |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
| KServe | oaiKserve |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
| Ray | oaiRay |
Abilita o disabilita il componente. Se abilitata, è gestita dalla piattaforma OpenShift AI. | Managed per abilitareRemoved per disabilitare |
Managed (abilitato) |
Altri operatori consigliati
Esaminare gli operatori consigliati e le personalizzazioni opzionali che si possono includere durante l'installazione. L'utente è responsabile della gestione di questi operatori, compresi, ma non solo, l'aggiornamento, il monitoraggio, il ripristino e la reinstallazione.
Per includere una personalizzazione per un operatore quando si installa l'add-on OpenShift AI con la CLI, includere l'opzione con il --parameter PARAM=VALUE formato quando si esegue il ibmcloud oc cluster addon enable openshift-ai. Ad esempio, per includere la personalizzazione NVIDIA GPUDirect Storage per NVIDIA l'operatore, specificare --parameter nvidiaGpuDirectStorageEnabled=true.
Per includere una personalizzazione per un operatore quando si installa il componente OpenShift aggiuntivo AI con l'interfaccia utente, fare clic per abilitare l'opzione quando richiesto. Si noti che esistono ulteriori NVIDIA operatori con impostazioni predefinite che possono essere modificate solo nella CLI o modificando il file ClusterPolicy.
| Personalizzazione | Parametro CLI | Descrizione | Valore | Impostazione predefinita |
|---|---|---|---|---|
| Node Politica di eliminazione delle funzionalità di Discovery | nfdDeletePolicy |
Mantenere o eliminare l'operatore se il componente aggiuntivo OpenShift AI viene rimosso. | Retain (impostazione predefinita) o Delete |
Retain |
| NVIDIA Politica di cancellazione dell'operatore GPU | nvidiaDeletePolicy |
Mantenere o eliminare l'operatore se il componente aggiuntivo OpenShift AI viene rimosso. | Retain (impostazione predefinita) o Delete |
Retain |
| NVIDIA Test post-installazione di CUDA | nvidiaCudaTest |
Abilitare i test CUDA di NVIDIA. | true (abilitato, predefinito)false (disabilitato) |
false (disattivato) |
| Politica di cancellazione dell'operatore del gasdotto | pipelineDeletePolicy |
Mantenere o eliminare l'operatore se il componente aggiuntivo OpenShift AI viene rimosso. | Retain (impostazione predefinita) o Delete |
I seguenti operatori GPU NVIDIA si applicano con le impostazioni predefinite. È possibile modificare queste impostazioni durante l'installazione solo se si installa il componente aggiuntivo con la CLI. Dopo l'installazione, è possibile modificare queste impostazioni, sia nell'interfaccia utente che nella CLI, modificando il file ClusterPolicy.
| Personalizzazione | Parametro CLI | Descrizione | Valori CLI | Impostazione predefinita dell'interfaccia utente |
|---|---|---|---|---|
| NVIDIA Carichi di lavoro in Sandbox | nvidiaSandboxWorkloads |
Abilita la gestione di operandi aggiuntivi necessari per i carichi di lavoro sandbox. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| NVIDIA vGPU Direttore | nvidiaVgpuManagerEnabled |
Abilitare NVIDIA vGPU Manager. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| NVIDIA Conservazione diretta GPUD | nvidiaGpuDirectStorageEnabled |
Abilitare l'archiviazione GPUDirect. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| NVIDIA Node Esportatore di stati | nvidiaNodeStatusExporterEnabled |
Abilita l’esportatore di stato “ Node ”. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| NVIDIA Gestore I/O delle funzioni virtuali | nvidiaVfioManagerEnabled |
Abilitare VFIO Manager per la configurazione della distribuzione di VFIO-PCI. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| NVIDIA Plug-in per dispositivi Sandbox | nvidiaSandboxDevicePluginEnabled |
Abilitare il plug-in del dispositivo NVIDIA Sandbox. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| Gestione GPU multi-istanza NVIDIA | nvidiaMigManagerEnabled |
Abilitare NVIDIA Multi Instance GPU Manager. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| NVIDIA Distribuzione di Hostengine Data Center GPU Manager | nvidiaDcgmEnabled |
Abilitare la distribuzione di NVIDIA Data Center GPU Manager Hostengine come pod separato. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
| NVIDIA vGPU Gestione dispositivi | nvidiaVgpuDeviceManagerEnabled |
Abilitare NVIDIA vGPU Gestione dispositivi. | true (abilitato, predefinito)false (disabilitato) |
Enabled |
Operazioni successive
- Provate un' esercitazione sull'utilizzo dell'IA di OpenShift per il rilevamento delle frodi.
- Scoprite come utilizzare OpenShift AI per distribuire un modello addestrato con InstructLab.
- Vedere informazioni sulla gestione del componente aggiuntivo OpenShift AI.
- Assicurarsi di aver compreso il processo di aggiornamento del componente aggiuntivo OpenShift AI.