Instalación del complemento Red Hat OpenShift AI

Siga los pasos para instalar el complemento de IA de OpenShift en un clúster existente.

¿Desea implementar el operador OpenShift de IA en un nuevo clúster? Prueba la OpenShift IA en IBM Cloud arquitectura desplegable.

Requisitos mínimos

Revise las siguientes consideraciones antes de configurar el complemento.

  • Revise las versiones de complementos de clúster compatibles y determine qué versión de complemento debe instalar en su clúster.
  • Tu clúster debe tener al menos dos nodos de trabajo. Cada nodo trabajador debe tener un mínimo de 8vCPU y 32GB de memoria.
  • Sus nodos trabajadores deben utilizar el sistema operativo RHCOS.
  • Debe permitir el tráfico saliente de su clúster para instalar los operadores necesarios.

Versiones soportadas

Revise las versiones compatibles del complemento OpenShift AI y las versiones correspondientes de OpenShift AI y Red Hat OpenShift on IBM Cloud.

Versiones de complementos de IA compatibles y versiones correspondientes para Red Hat OpenShift AI y Red Hat OpenShift on IBM Cloud.
OpenShift Versión complementaria de IA Red Hat OpenShift Versión generada por IA Versiones de clúster compatibles
420 3.4.2 420 421
419 3.4.0 4.19, 4.20, 4.21
418 2.25.6 4.18, 4.19
417 2.25.6 4.17, 4.18
416 2.25.6 4.16, 4.17

No se admite la actualización de la versión 418 a la 419. Sólo se permiten nuevas instalaciones de la versión 419. Para obtener más información, consulta Acerca del complemento de IA de OpenShift.

Consideraciones

  • Para utilizar todas las capacidades proporcionadas por OpenShift AI, se recomienda al menos 1 GPU.
  • Tu cluster puede tener una mezcla de nodos GPU y no GPU. Sin embargo, si utilizas esta configuración, asegúrate de desplegar tu aplicación en un nodo GPU para aprovechar sus recursos.
  • A partir de la versión 2.19.0 de OpenShift AI Operator, KServe está disponible en modo Avanzado o Estándar. Por defecto, cuando se instala KServe mediante OpenShift AI utilizando el complemento IBM Cloud, se instala en modo Estándar. Si desea utilizar el modo Avanzado, debe completar los pasos opcionales después de instalar el complemento.

Antes de empezar

Complete estos pasos antes de instalar el complemento.

  1. Inicie una sesión en la cuenta. If applicable, target the appropriate resource group. Establezca el contexto para el clúster.

  2. Opcional: Si aún no tiene una, cree una VPC Public Gateway.

  3. Si desea utilizar los operadores OpenShift Pipelines, Node Feature Discovery o NVIDIA GPU con el complemento OpenShift AI, debe activar OperatorHub en su clúster y desactivar la protección del tráfico saliente. Si no desea utilizar estos operadores, omita este paso.

    1. Active OperatorHub en su clúster.
    oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'
    
    1. Desactivar la protección del tráfico saliente.

    La desactivación de la protección del tráfico saliente permite todas las conexiones de red externas. Consulte Gestión de la protección del tráfico saliente en clústeres VPC para obtener más información.

    ibmcloud oc vpc outbound-traffic-protection disable --cluster CLUSTER
    

Requisitos previos

Complete estos pasos antes de instalar el complemento.

  1. Inicie una sesión en la cuenta. If applicable, target the appropriate resource group. Establezca el contexto para el clúster.

  2. Opcional: Si aún no tiene una, cree una VPC Public Gateway.

  3. Si desea utilizar los operadores OpenShift Pipelines, Node Feature Discovery o NVIDIA GPU con el complemento OpenShift AI, debe activar OperatorHub en su clúster y desactivar la protección del tráfico saliente. Si no desea utilizar estos operadores, omita este paso.

    1. Active OperatorHub en su clúster.
    oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'
    
    1. Desactivar la protección del tráfico saliente.

    La desactivación de la protección del tráfico saliente permite todas las conexiones de red externas. Consulte Gestión de la protección del tráfico saliente en clústeres VPC para obtener más información.

    1. En la consola, vaya a la página Clusters y haga clic en el cluster correspondiente.
    2. En la página Descripción general del clúster, busque la sección Redes y seleccione la opción Protección del tráfico saliente desactivada.

Paso 1: Elegir opciones de personalización

Puede mejorar sus proyectos de IA de Red Hat OpenShift especificando diferentes opciones para incluirlas en la instalación del complemento, como canalizaciones de datos para crear flujos de trabajo de aprendizaje automático portátiles o herramientas para gestionar y escalar sus recursos. También puede personalizar las políticas de actualización y de eliminación. Para obtener descripciones de cada opción disponible, consulte OpenShift AI customization options. Si no incluye una opción específica al instalar el complemento, se aplicará el valor predeterminado. Estas opciones son gestionadas por la plataforma Red Hat OpenShift AI.

En la CLI, ejecute el comando para listar todas las opciones. En la interfaz de usuario, estas opciones aparecen en la sección Capacidades durante la instalación.

ibmcloud oc cluster addon options --addon openshift-ai

Paso 2: Revisar los operadores adicionales recomendados

Puede optar por instalar también operadores adicionales que se recomiendan para el uso de determinadas funciones de OpenShift AI. Si aún no están instalados en su clúster, puede optar por incluirlos en la instalación del complemento. También puede instalarlos en cualquier momento a través de OperatorHub o siguiendo los pasos de instalación específicos para cada operador. Para utilizar estos operadores, debe desactivar la protección del tráfico saliente para su clúster.

Usted es responsable de la gestión de estos operadores, lo que incluye, entre otras cosas, la actualización, supervisión, recuperación y reinstalación.

Se recomiendan los siguientes operadores.

Algunos de estos operadores pueden incluir personalizaciones adicionales que puede optar por especificar al instalar el complemento. Revise la lista de personalizaciones disponibles para los operadores recomendados.

Paso 3: Instalar el complemento en la CLI

Ejecute el comando para instalar el complemento Red Hat OpenShift AI. Especifique las personalizaciones con el formato --parameter PARAM=VALUE. Por ejemplo, para incluir la opción Data Science Pipelines, especifique --parameter oaiDataSciencePipelines=Managed.

Para incluir los operadores recomendados al instalar el complemento con la CLI, especifique las siguientes opciones al ejecutar el comando de instalación.

  • OpenShift Tuberías: --parameter pipelineEnabled=true
  • Node Descubrimiento de funciones: --parameter nfdEnabled=true
  • NVIDIA Operador de GPU: --parameter nvidiaEnabled=true

Para obtener una lista de las versiones disponibles, consulte Versiones compatibles.

Comando de instalación.

ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER [-f] [--param PARAM] [-q] [--version VERSION]

Ejemplo de comando para instalar el complemento con actualizaciones menores y de parches automáticas, CodeFlare, y KServe activados.

ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER --param oaiInstallPlanApproval=Automatic --param oaiCodeflare=Managed --param oaiKserve=Managed

Paso 2: Revisar los operadores adicionales recomendados

Puede optar por instalar también operadores adicionales que se recomiendan para el uso de determinadas funciones de OpenShift AI. Si aún no están instalados en su clúster, puede optar por incluirlos en la instalación del complemento. También puede instalarlos en cualquier momento a través de OperatorHub o siguiendo los pasos de instalación específicos para cada operador. Para utilizar estos operadores, debe desactivar la protección del tráfico saliente para su clúster.

Usted es responsable de la gestión de estos operadores, lo que incluye, entre otras cosas, la actualización, supervisión, recuperación y reinstalación.

Se recomiendan los siguientes operadores.

Algunos de estos operadores pueden incluir personalizaciones adicionales que puede optar por especificar al instalar el complemento. Revise la lista de personalizaciones disponibles para los operadores recomendados.

Paso 3: Instalar el complemento en la interfaz de usuario

Instale el complemento Red Hat OpenShift AI con la interfaz de usuario.

  1. Navegue hasta su página de clúster y haga clic en el clúster correspondiente.

  2. En la página de detalles del clúster, busque la sección Complementos. Busque la opción Red Hat OpenShift AI y haga clic en Instalar.

  3. En la sección Capacidades, revise la descripción de las opciones de personalización del complemento disponibles y active las opciones que desee incluir con la instalación.

  4. En la sección Operadores adicionales recomendados, haga clic para expandir cada operador y seleccione las opciones de personalización que desee incluir. Estos operadores y personalizaciones adicionales se recomiendan para determinadas funciones de la IA de Red Hat OpenShift. Puede elegir instalar estas opciones más tarde utilizando OperatorHub o siguiendo los pasos de instalación específicos del operador.

    Usted es responsable de la gestión de estos operadores, lo que incluye, entre otras cosas, la actualización, supervisión, recuperación y reinstalación.

  5. Pulse Instalar.

Paso 4: Acceda al cuadro de mandos de OpenShift AI

Una vez instalado el complemento OpenShift AI, podrá acceder al panel de control de OpenShift AI.

  1. Desde la página de resumen de tu clúster, haz clic en OpenShift (Consola web de IBM Cloud).
  2. Desde el Lanzador de aplicaciones Lanzador de aplicaciones, seleccione la opción Red Hat OpenShift AI dashboard.
  3. Si se le solicita, haga clic en Log in with OpenShift.

Opcional: Configuración de KServe en modo avanzado

Si desea utilizar KServe en modo Avanzado, debe completar los siguientes pasos.

  1. Instale el operador sin servidor OpenShift desde OperatorHub.
  2. Instale el operador de malla de servicio OpenShift desde OperatorHub.
  3. Establezca el estado de gestión de la malla de servicios en Managed en su CR de inicialización del clúster de Data Science.
    serviceMesh:
        controlPlane:
            metricsCollection: Istio
            name: data-science-smcp
            namespace: istio-system
        managementState: Managed
    
  4. Establezca el estado de gestión del servicio KServe en Managed en su recurso personalizado Data Science Cluster.
    kserve:
        managementState: Managed
        serving:
          managementState: Managed
          name: knative-serving
    

OpenShift Opciones de personalización de la IA

Revise las opciones de personalización disponibles para el complemento OpenShift AI. Estos operadores están gestionados por la plataforma Red Hat OpenShift AI.

Para incluir una opción al instalar el complemento OpenShift de IA con la CLI, incluya la opción con el --parameter PARAM=VALUE formato al ejecutar el ibmcloud oc cluster addon enable openshift-ai. Por ejemplo, para instalar el complemento con la opción Data Science Pipelines, especifique --parameter oaiDataSciencePipelines=Managed.

Para incluir una opción al instalar el complemento OpenShift de IA con la interfaz de usuario, haga clic para habilitar la opción cuando se le solicite. Estas opciones se incluyen en la sección Capacidades.

OpenShift Opciones de personalización del complemento AI y parámetros CLI.
Personalización Parámetro CLI Descripción Valores Valor predeterminado
OpenShift Política de aprobación de actualizaciones menores y parches de la plataforma de IA oaiInstallPlanApproval Aplique actualizaciones menores y parches de forma automática o manual. Automatic o Manual Automatic
OpenShift Política de supresión de IA oaiDeletePolicy Conserve o elimine los operadores o componentes instalados por el complemento si éste se elimina. Retain o Delete Retain
Cuadro de mando del Open Data Hub oaiDashboard Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)
Colas oaiKueue Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)
CodeFlare oaiCodeflare Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)
ModelMesh Sirviendo a oaiModelmeshserving Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)
Entorno de trabajo oaiWorkbenches Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)
Canalizaciones de ciencia de datos oaiDataSciencePipelines Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)
KServe oaiKserve Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)
Ray oaiRay Activa o desactiva el componente. Si está activada, la gestiona la plataforma OpenShift AI. Managed para activar
Removed para desactivar
Managed (activado)

Otros operadores recomendados

Revise los operadores recomendados y las personalizaciones opcionales que puede incluir durante la instalación. Usted es responsable de la gestión de estos operadores, lo que incluye, entre otras cosas, la actualización, supervisión, recuperación y reinstalación.

Para incluir una personalización para un operador al instalar el complemento OpenShift de IA con la CLI, incluya la opción con el --parameter PARAM=VALUE formato al ejecutar el ibmcloud oc cluster addon enable openshift-ai. Por ejemplo, para incluir la personalización de NVIDIA almacenamiento GPUDirect para el NVIDIA operador, especifique --parameter nvidiaGpuDirectStorageEnabled=true.

Para incluir una personalización para un operador al instalar el complemento OpenShift de IA con la interfaz de usuario, haga clic para habilitar la opción cuando se le solicite. Tenga en cuenta que hay operadores NVIDIA adicionales con configuraciones predeterminadas que solo se pueden cambiar en la CLI o editando el archivo ClusterPolicy.

OpenShift Opciones de personalización de complementos de IA para operadores adicionales. Estos ajustes pueden modificarse durante la instalación en la CLI o en la UI.
Personalización Parámetro CLI Descripción Valor Valor predeterminado
Node Política de supresión de Feature Discovery nfdDeletePolicy Conserve o elimine el operador si se elimina el complemento OpenShift AI. Retain (por defecto) o Delete Retain
NVIDIA Política de eliminación de operadores de GPU nvidiaDeletePolicy Conserve o elimine el operador si se elimina el complemento OpenShift AI. Retain (por defecto) o Delete Retain
NVIDIA Pruebas posteriores a la instalación de CUDA nvidiaCudaTest Active NVIDIA CUDA testing. true (activado, por defecto)
false (desactivado)
false (Inhabilitado)
Política de supresión de operadores de oleoductos pipelineDeletePolicy Conserve o elimine el operador si se elimina el complemento OpenShift AI. Retain (por defecto) o Delete

Los siguientes operadores GPU de NVIDIA se aplican con la configuración predeterminada. Sólo puede cambiar estos ajustes durante la instalación si instala el complemento con la CLI. Tras la instalación, puede cambiar estos ajustes, tanto en la interfaz de usuario como en la CLI, editando la página ClusterPolicy.

OpenShift Opciones de personalización de complementos de IA para operadores adicionales. Estos ajustes sólo pueden modificarse durante la instalación en la CLI.
Personalización Parámetro CLI Descripción Valores CLI Configuración predeterminada de la interfaz de usuario
NVIDIA Cargas de trabajo Sandbox nvidiaSandboxWorkloads Permite la gestión de operandos adicionales necesarios para las cargas de trabajo sandbox. true (activado, por defecto)
false (desactivado)
Enabled
NVIDIA vGPU Director nvidiaVgpuManagerEnabled Active NVIDIA vGPU Manager. true (activado, por defecto)
false (desactivado)
Enabled
NVIDIA Almacenamiento GPUDirecto nvidiaGpuDirectStorageEnabled Activar el almacenamiento GPUDirect. true (activado, por defecto)
false (desactivado)
Enabled
NVIDIA Node Exportador de estado nvidiaNodeStatusExporterEnabled Habilitar el exportador de estados de Node. true (activado, por defecto)
false (desactivado)
Enabled
NVIDIA Gestor de E/S de funciones virtuales nvidiaVfioManagerEnabled Habilitar VFIO Manager para la configuración para desplegar VFIO-PCI. true (activado, por defecto)
false (desactivado)
Enabled
NVIDIA Dispositivo Sandbox Plug-in nvidiaSandboxDevicePluginEnabled Active NVIDIA Sandbox Device Plug-in. true (activado, por defecto)
false (desactivado)
Enabled
Gestor de GPU NVIDA Multi Instancia nvidiaMigManagerEnabled Active NVIDIA Multi Instance GPU Manager. true (activado, por defecto)
false (desactivado)
Enabled
NVIDIA Despliegue del motor de host del gestor de GPU del centro de datos nvidiaDcgmEnabled Habilite la implementación de NVIDIA Data Center GPU Manager Hostengine como un pod independiente. true (activado, por defecto)
false (desactivado)
Enabled
NVIDIA vGPU Administrador de dispositivos nvidiaVgpuDeviceManagerEnabled Active NVIDIA vGPU Administrador de dispositivos. true (activado, por defecto)
false (desactivado)
Enabled

¿Qué hacer a continuación?