Installation des KI-Add-ons Red Hat OpenShift

Folgen Sie den Schritten, um das OpenShift-KI-Add-on in einem vorhandenen Cluster zu installieren.

Möchten Sie den OpenShift AI-Operator auf einem neuen Cluster bereitstellen? Probieren Sie die OpenShift KI auf IBM Cloud einsetzbarer Architektur aus.

Mindestvoraussetzungen

Beachten Sie die folgenden Punkte, bevor Sie das Add-on einrichten.

  • Überprüfen Sie die unterstützten Cluster-Add-on-Versionen und bestimmen Sie, welche Add-on-Version in Ihrem Cluster installiert werden soll.
  • Ihr Cluster muss mindestens 2 Worker-Knoten umfassen. Jeder Arbeitsknoten muss mindestens über 8vCPU und 32GB Speicher verfügen.
  • Ihre Arbeitsknoten müssen das RHCOS-Betriebssystem verwenden.
  • Sie müssen ausgehenden Datenverkehr von Ihrem Cluster zulassen, um die erforderlichen Operatoren zu installieren.

Unterstützte Versionen

Überprüfen Sie die unterstützten OpenShift AI-Add-on-Versionen und die entsprechenden OpenShift AI und Red Hat OpenShift on IBM Cloud versionen.

Unterstützte AI-Add-on-Versionen und entsprechende Versionen für Red Hat OpenShift AI und Red Hat OpenShift on IBM Cloud.
OpenShift AI-Zusatzversion Red Hat OpenShift KI-Version Unterstützte Clusterversionen
420 3.4.2 420.421
419 3.4.0 4.19, 4.20, 4.21
418 2.25.6 4.18, 4.19
417 2.25.6 4.17, 4.18
416 2.25.6 4.16, 4.17

Ein Upgrade von Version 418 auf 419 wird nicht unterstützt. Nur Neuinstallationen der Version 419 sind erlaubt. Weitere Informationen finden Sie unter Über das AI-Add-on für den OpenShift.

Hinweise

  • Um alle Möglichkeiten von OpenShift AI zu nutzen, wird mindestens 1 GPU empfohlen.
  • Ihr Cluster kann eine Mischung aus GPU- und Nicht-GPU-Knoten enthalten. Wenn Sie diese Konfiguration verwenden, sollten Sie jedoch sicherstellen, dass Ihre Anwendung auf einem GPU-Knoten bereitgestellt wird, um dessen Ressourcen zu nutzen.
  • Seit der Version 2.19.0 von OpenShift AI Operator ist KServe entweder im erweiterten oder im Standardmodus verfügbar. Wenn Sie KServe mit Hilfe des OpenShift AI und des IBM Cloud Add-ons installieren, wird er standardmäßig im Standardmodus installiert. Wenn Sie den erweiterten Modus verwenden möchten, müssen Sie nach der Installation des Add-ons die optionalen Schritte ausführen.

Vorbereitende Schritte

Führen Sie diese Schritte aus, bevor Sie das Add-on installieren.

  1. Melden Sie sich an Ihrem Konto an. If applicable, target the appropriate resource group. Legen Sie den Kontext für den Cluster fest.

  2. Optional: Wenn Sie noch keine haben, erstellen Sie eine VPC Public Gateway.

  3. Wenn Sie die Operatoren OpenShift Pipelines, Node Feature Discovery oder NVIDIA GPU mit dem Add-on OpenShift AI verwenden möchten, müssen Sie OperatorHub auf Ihrem Cluster aktivieren und den Schutz für ausgehenden Datenverkehr deaktivieren. Wenn Sie diese Operatoren nicht verwenden möchten, überspringen Sie diesen Schritt.

    1. Aktivieren Sie OperatorHub in Ihrem Cluster.
    oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'
    
    1. Deaktivieren Sie den Schutz des ausgehenden Datenverkehrs.

    Durch die Deaktivierung des Schutzes für ausgehenden Datenverkehr werden alle externen Netzwerkverbindungen zugelassen. Weitere Informationen finden Sie unter "Verwalten des Schutzes ausgehender Daten in VPC-Clustern ".

    ibmcloud oc vpc outbound-traffic-protection disable --cluster CLUSTER
    

Voraussetzungen

Führen Sie diese Schritte aus, bevor Sie das Add-on installieren.

  1. Melden Sie sich an Ihrem Konto an. If applicable, target the appropriate resource group. Legen Sie den Kontext für den Cluster fest.

  2. Optional: Wenn Sie noch keine haben, erstellen Sie eine VPC Public Gateway.

  3. Wenn Sie die Operatoren OpenShift Pipelines, Node Feature Discovery oder NVIDIA GPU mit dem Add-on OpenShift AI verwenden möchten, müssen Sie OperatorHub auf Ihrem Cluster aktivieren und den Schutz für ausgehenden Datenverkehr deaktivieren. Wenn Sie diese Operatoren nicht verwenden möchten, überspringen Sie diesen Schritt.

    1. Aktivieren Sie OperatorHub in Ihrem Cluster.
    oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'
    
    1. Deaktivieren Sie den Schutz des ausgehenden Datenverkehrs.

    Durch die Deaktivierung des Schutzes für ausgehenden Datenverkehr werden alle externen Netzwerkverbindungen zugelassen. Weitere Informationen finden Sie unter "Verwalten des Schutzes ausgehender Daten in VPC-Clustern ".

    1. Navigieren Sie in der Konsole zu Ihrer Clusterseite und klicken Sie auf den entsprechenden Cluster.
    2. Suchen Sie auf der Übersichtsseite des Clusters den Abschnitt Networking und wählen Sie die Option Schutz für ausgehenden Datenverkehr deaktiviert.

Schritt 1: Wählen Sie die Anpassungsoptionen

Sie können Ihre Red Hat OpenShift KI-Projekte erweitern, indem Sie verschiedene Optionen in Ihre Add-on-Installation aufnehmen, z. B. Datenpipelines für die Erstellung portabler Workflows für maschinelles Lernen oder Tools für die Verwaltung und Skalierung Ihrer Ressourcen. Sie können auch Upgrade- und Löschrichtlinien anpassen. Beschreibungen der einzelnen verfügbaren Optionen finden Sie unter OpenShift AI-Anpassungsoptionen. Wenn Sie bei der Installation des Add-ons keine bestimmte Option auswählen, gilt der Standardwert. Diese Optionen werden von der KI-Plattform Red Hat OpenShift verwaltet.

Führen Sie in der CLI den Befehl aus, um alle Optionen aufzulisten. In der Benutzeroberfläche werden diese Optionen während der Installation im Abschnitt " Fähigkeiten" aufgeführt.

ibmcloud oc cluster addon options --addon openshift-ai

Schritt 2: Prüfen Sie weitere empfohlene Betreiber

Sie können auch zusätzliche Operatoren installieren, die für die Verwendung bestimmter OpenShift-KI-Funktionen empfohlen werden. Wenn sie nicht bereits auf Ihrem Cluster installiert sind, können Sie sie in die Add-on-Installation aufnehmen. Sie können sie jederzeit installieren, indem Sie eine E-Mail an OperatorHub senden oder die betreiberspezifischen Installationsschritte befolgen. Um diese Operatoren zu verwenden, müssen Sie den Schutz für ausgehenden Datenverkehr für Ihren Cluster deaktivieren.

Sie sind für die Verwaltung dieser Betreiber verantwortlich, einschließlich, aber nicht beschränkt auf Aktualisierung, Überwachung, Wiederherstellung und Neuinstallation.

Die folgenden Operatoren werden empfohlen.

Einige dieser Betreiber bieten möglicherweise zusätzliche Anpassungen an, die Sie bei der Installation des Add-ons angeben können. Überprüfen Sie die Liste der für die empfohlenen Operatoren verfügbaren Anpassungen.

Schritt 3: Installieren Sie das Add-on in der CLI

Führen Sie den Befehl aus, um das KI-Add-on Red Hat OpenShift zu installieren. Geben Sie Anpassungen im Format --parameter PARAM=VALUE an. Um beispielsweise die Option "Data Science Pipelines" hinzuzufügen, geben Sie --parameter oaiDataSciencePipelines=Managed an.

Um die empfohlenen Operatoren bei der Installation des Add-ons mit der CLI einzuschließen, geben Sie die folgenden Optionen an, wenn Sie den Installationsbefehl ausführen.

  • OpenShift Rohrleitungen: --parameter pipelineEnabled=true
  • Node Feature-Entdeckung: --parameter nfdEnabled=true
  • NVIDIA GPU-Operator: --parameter nvidiaEnabled=true

Eine Liste der verfügbaren Versionen finden Sie unter Unterstützte Versionen.

Installationsbefehl.

ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER [-f] [--param PARAM] [-q] [--version VERSION]

Beispielbefehl zur Installation des Add-ons mit automatischen Minor- und Patch-Updates, CodeFlare, und KServe aktiviert.

ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER --param oaiInstallPlanApproval=Automatic --param oaiCodeflare=Managed --param oaiKserve=Managed

Schritt 2: Überprüfen Sie die zusätzlichen empfohlenen Betreiber

Sie können auch zusätzliche Operatoren installieren, die für die Verwendung bestimmter OpenShift-KI-Funktionen empfohlen werden. Wenn sie nicht bereits auf Ihrem Cluster installiert sind, können Sie sie in die Add-on-Installation aufnehmen. Sie können sie jederzeit installieren, indem Sie eine E-Mail an OperatorHub senden oder die betreiberspezifischen Installationsschritte befolgen. Um diese Operatoren zu verwenden, müssen Sie den Schutz für ausgehenden Datenverkehr für Ihren Cluster deaktivieren.

Sie sind für die Verwaltung dieser Betreiber verantwortlich, einschließlich, aber nicht beschränkt auf Aktualisierung, Überwachung, Wiederherstellung und Neuinstallation.

Die folgenden Operatoren werden empfohlen.

Einige dieser Betreiber bieten möglicherweise zusätzliche Anpassungen an, die Sie bei der Installation des Add-ons angeben können. Überprüfen Sie die Liste der für die empfohlenen Operatoren verfügbaren Anpassungen.

Schritt 3: Installieren Sie das Add-on in der Benutzeroberfläche

Installieren Sie das Red Hat OpenShift-KI-Add-on mit der Benutzeroberfläche.

  1. Navigieren Sie zu Ihrer Cluster-Seite und klicken Sie auf den entsprechenden Cluster.

  2. Suchen Sie auf der Seite mit den Clusterdetails den Abschnitt "Add-ons ". Suchen Sie die KI-Option Red Hat OpenShift und klicken Sie auf "Installieren ".

  3. Sehen Sie sich im Abschnitt "Funktionen" die Beschreibung der verfügbaren Zusatzoptionen zur Anpassung an und aktivieren Sie die Optionen, die Sie in die Installation einbeziehen möchten.

  4. Klicken Sie im Abschnitt "Weitere empfohlene Operatoren " auf die einzelnen Operatoren, um sie zu erweitern, und wählen Sie die Anpassungsoptionen aus, die Sie einbeziehen möchten. Diese zusätzlichen Operatoren und Anpassungen werden für bestimmte Red Hat OpenShift-KI-Funktionen empfohlen. Sie können diese Optionen später installieren, indem Sie eine E-Mail an OperatorHub senden oder die betreiberspezifischen Installationsschritte befolgen.

    Sie sind für die Verwaltung dieser Betreiber verantwortlich, einschließlich, aber nicht beschränkt auf Aktualisierung, Überwachung, Wiederherstellung und Neuinstallation.

  5. Klicken Sie auf Install.

Schritt 4: Zugriff auf das OpenShift AI Dashboard

Nachdem Sie das OpenShift AI Add-on installiert haben, können Sie auf das OpenShift AI Dashboard zugreifen.

  1. Klicken Sie auf Ihrer Cluster-Übersichtsseite auf OpenShift-Webkonsole.
  2. Wählen Sie im Anwendungsstartprogramm die Option Red Hat OpenShift AI Dashboard.
  3. Wenn Sie dazu aufgefordert werden, klicken Sie auf Log in with OpenShift.

Optional: Einrichten des KServe im erweiterten Modus

Wenn Sie den KServe im erweiterten Modus verwenden möchten, müssen Sie die folgenden Schritte ausführen.

  1. Installieren Sie den OpenShift Serverless Operator von OperatorHub.
  2. Installieren Sie den OpenShift Service Mesh Operator von OperatorHub.
  3. Setzen Sie den Verwaltungsstatus des Dienstnetzes in Ihrer Data Science Cluster Initialization CR auf Managed.
    serviceMesh:
        controlPlane:
            metricsCollection: Istio
            name: data-science-smcp
            namespace: istio-system
        managementState: Managed
    
  4. Setzen Sie den KServe-Verwaltungsstatus in Ihrer benutzerdefinierten Data Science Cluster-Ressource auf Managed.
    kserve:
        managementState: Managed
        serving:
          managementState: Managed
          name: knative-serving
    

OpenShift KI-Anpassungsoptionen

Sehen Sie sich die verfügbaren Anpassungsoptionen für das KI-Add-on OpenShift an. Diese Betreiber werden von der KI-Plattform Red Hat OpenShift verwaltet.

Um eine Option hinzuzufügen, wenn Sie das OpenShift AI-Add-on mit der CLI installieren, fügen Sie die Option im --parameter PARAM=VALUE Format hinzu, wenn Sie die ibmcloud oc cluster addon enable openshift-ai. ausführen. Um beispielsweise das Add-on mit der Option "Data Science Pipelines" zu installieren, geben Sie --parameter oaiDataSciencePipelines=Managed an.

Um eine Option bei der Installation des OpenShift AI-Add-ons mit der Benutzeroberfläche einzuschließen, klicken Sie auf die Option, um sie zu aktivieren, wenn Sie dazu aufgefordert werden. Diese Optionen sind im Abschnitt " Fähigkeiten" enthalten.

OpenShift Optionen zur Anpassung von KI-Add-ons und CLI-Parametern.
Anpassung CLI-Parameter Beschreibung Werte Standardwert
OpenShift Richtlinie zur Genehmigung von kleineren Updates und Patches für die KI-Plattform oaiInstallPlanApproval Wenden Sie kleinere Updates und Patch-Updates automatisch oder manuell an. Automatic oder Manual Automatic
OpenShift Richtlinie zur Löschung von KI oaiDeletePolicy Behalten Sie alle vom Add-on installierten Operatoren oder Komponenten bei oder löschen Sie sie, wenn das Add-on entfernt wird. Retain oder Delete Retain
Dashboard des Open Data Hub oaiDashboard Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)
Küüü oaiKueue Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)
CodeFlare oaiCodeflare Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)
ModelMesh Dienen oaiModelmeshserving Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)
Workbench oaiWorkbenches Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)
Datenwissenschaftliche Pipelines oaiDataSciencePipelines Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)
KServe oaiKserve Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)
Ray oaiRay Aktivieren oder deaktivieren Sie die Komponente. Wenn aktiviert, wird es von der KI-Plattform OpenShift verwaltet. Managed damit
Removed deaktivieren kann
Managed (aktiviert)

Zusätzliche empfohlene Operatoren

Sehen Sie sich die empfohlenen Betreiber und die optionalen Anpassungen an, die Sie während der Installation vornehmen können. Sie sind für die Verwaltung dieser Betreiber verantwortlich, einschließlich, aber nicht beschränkt auf Aktualisierung, Überwachung, Wiederherstellung und Neuinstallation.

Um eine Anpassung für einen Operator einzuschließen, wenn Sie das OpenShift AI-Add-on mit der CLI installieren, fügen Sie die Option mit dem --parameter PARAM=VALUE Format ein, wenn Sie die ausführen ibmcloud oc cluster addon enable openshift-ai. Um beispielsweise die NVIDIA GPUDirect Storage-Anpassung für den NVIDIA Operator einzuschließen, geben Sie an --parameter nvidiaGpuDirectStorageEnabled=true.

Um eine Anpassung für einen Operator einzuschließen, wenn Sie das OpenShift AI-Add-on mit der Benutzeroberfläche installieren, klicken Sie auf die Option, um sie zu aktivieren, wenn Sie dazu aufgefordert werden. Beachten Sie, dass es zusätzliche NVIDIA Operatoren mit Standardeinstellungen gibt, die nur in der CLI oder durch Bearbeiten der ClusterPolicy.

OpenShift AI-Add-on-Anpassungsoptionen für zusätzliche Bediener. Diese Einstellungen können während der Installation in der CLI oder UI geändert werden.
Anpassung CLI-Parameter Beschreibung Wert Standardeinstellung
Node Richtlinie zum Löschen von Feature Discovery nfdDeletePolicy Behalten Sie den Operator bei oder löschen Sie ihn, wenn das KI-Add-on OpenShift entfernt wird. Retain (Standard) oder Delete Retain
NVIDIA GPU Operator-Löschungspolitik nvidiaDeletePolicy Behalten Sie den Operator bei oder löschen Sie ihn, wenn das KI-Add-on OpenShift entfernt wird. Retain (Standard) oder Delete Retain
NVIDIA CUDA-Tests nach der Installation nvidiaCudaTest Aktivieren Sie NVIDIA CUDA-Tests. true (aktiviert, Standard)
false (deaktiviert)
false (deaktiviert)
Löschungspolitik des Pipeline-Betreibers pipelineDeletePolicy Behalten Sie den Operator bei oder löschen Sie ihn, wenn das KI-Add-on OpenShift entfernt wird. Retain (Standard) oder Delete

Die folgenden NVIDIA GPU-Operatoren gelten mit den Standardeinstellungen. Sie können diese Einstellungen während der Installation nur ändern, wenn Sie das Add-on mit der CLI installieren. Nach der Installation können Sie diese Einstellungen entweder in der Benutzeroberfläche oder in der Befehlszeilenschnittstelle ändern, indem Sie die Datei ClusterPolicy bearbeiten.

OpenShift AI-Add-on-Anpassungsoptionen für zusätzliche Bediener. Diese Einstellungen können während der Installation nur über die Befehlszeile geändert werden.
Anpassung CLI-Parameter Beschreibung CLI-Werte UI-Standardeinstellung
NVIDIA Sandbox-Arbeitslasten nvidiaSandboxWorkloads Ermöglichen Sie die Verwaltung zusätzlicher Operanden, die für Sandbox-Workloads erforderlich sind. true (aktiviert, Standard)
false (deaktiviert)
Enabled
vGPUNVIDIA Manager nvidiaVgpuManagerEnabled Aktivieren Sie NVIDIA vGPU Manager. true (aktiviert, Standard)
false (deaktiviert)
Enabled
NVIDIA GPUDirect-Speicher nvidiaGpuDirectStorageEnabled Aktivieren Sie GPUDirect Storage. true (aktiviert, Standard)
false (deaktiviert)
Enabled
NVIDIA Node Status-Exporter nvidiaNodeStatusExporterEnabled Node-Status-Exporter aktivieren. true (aktiviert, Standard)
false (deaktiviert)
Enabled
NVIDIA Virtual Function I/O Manager nvidiaVfioManagerEnabled Aktivieren Sie VFIO Manager für die Konfiguration zur Bereitstellung von VFIO-PCI. true (aktiviert, Standard)
false (deaktiviert)
Enabled
NVIDIA Sandbox-Geräte-Plug-in nvidiaSandboxDevicePluginEnabled Aktivieren Sie NVIDIA Sandbox Device Plug-in. true (aktiviert, Standard)
false (deaktiviert)
Enabled
NVIDA Multi-Instanz-GPU-Manager nvidiaMigManagerEnabled Aktivieren Sie NVIDIA Multi Instance GPU Manager. true (aktiviert, Standard)
false (deaktiviert)
Enabled
NVIDIA Rechenzentrum GPU Manager Hostengine-Bereitstellung nvidiaDcgmEnabled Aktivieren Sie die Bereitstellung der NVIDIA Data Center GPU Manager Hostengine als separaten Pod. true (aktiviert, Standard)
false (deaktiviert)
Enabled
NVIDIA vGPU Geräte-Manager nvidiaVgpuDeviceManagerEnabled Aktivieren Sie NVIDIA vGPU Device Manager. true (aktiviert, Standard)
false (deaktiviert)
Enabled

Weitere Schritte