Red Hat OpenShift 의 AI 애드온 설치
OpenShift AI 애드온을 기존 클러스터에 설치하는 단계를 따르십시오.
새로운 클러스터에 AI OpenShift 오퍼레이터를 배포하시겠습니까? 배포 가능한 IBM Cloud 아키텍처에서 AI를 OpenShift 시도해 보세요.
최소 요구사항
부가 기능을 설정하기 전에 다음 고려 사항을 검토하세요.
- 지원되는 클러스터 애드온 버전을 검토하고 클러스터에 설치할 애드온 버전을 결정하세요.
- 클러스터에는 최소 2개의 워커 노드가 있어야 합니다. 각 워커 노드에는 최소 8vCPU 및 32GB 메모리가 있어야 합니다.
- 워커 노드는 RHCOS 운영 체제를 사용해야 합니다.
- 필요한 운영자를 설치하려면 클러스터에서 아웃바운드 트래픽을 허용해야 합니다.
지원되는 버전
지원되는 OpenShift AI 애드온 버전과 해당 OpenShift AI 및 Red Hat OpenShift on IBM Cloud 버전을 확인하세요.
| OpenShift AI 애드온 버전 | Red Hat OpenShift AI 버전 | 지원되는 클러스터 버전 |
|---|---|---|
| 420 | 3.4.2 | 420,421 |
| 419 | 3.4.0 | 4.19, 4.20, 4.21 |
| 418 | 2.25.6 | 4.18, 4.19 |
| 417 | 2.25.6 | 4.17, 4.18 |
| 416 | 2.25.6 | 4.16, 4.17 |
버전 418에서 419로 업그레이드하는 것은 지원되지 않습니다. 버전 419의 신규 설치만 허용됩니다. 자세한 내용은 ‘ OpenShift AI 애드온 정보’를 참조하십시오.
고려사항
- OpenShift AI에서 제공하는 모든 기능을 사용하려면 최소 1개의 GPU가 권장됩니다.
- 클러스터에는 GPU 노드와 비 GPU 노드가 혼합되어 있을 수 있습니다. 그러나 이 구성을 사용하는 경우 GPU 노드에 앱을 배포하여 해당 노드의 리소스를 활용해야 합니다.
- OpenShift AI 오퍼레이터의 버전 2.19.0 부터는 고급 또는 표준 모드에서 KServe를 사용할 수 있습니다. IBM Cloud 애드온을 사용하여 OpenShift AI를 사용하여 KServe를 설치하면 기본적으로 표준 모드로 설치됩니다. 고급 모드를 사용하려면 애드온을 설치한 후 선택적 단계를 완료해야 합니다.
시작하기 전에
애드온을 설치하기 전에 다음 단계를 완료하세요.
-
계정에 로그인하십시오. If applicable, target the appropriate resource group. 클러스터에 대한 컨텍스트를 설정하십시오.
-
선택 사항: 아직 없으면 VPC Public Gateway 만듭니다.
-
OpenShift 파이프라인, Node 기능 검색 또는 NVIDIA GPU 오퍼레이터를 OpenShift AI 애드온과 함께 사용하려면 클러스터에서 OperatorHub 를 활성화하고 아웃바운드 트래픽 보호를 비활성화해야 합니다. 만약 이 연산자를 사용하지 않으려면 이 단계를 건너뛰십시오.
- 클러스터에서 OperatorHub 를 활성화하십시오.
oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'- 아웃바운드 트래픽 보호를 비활성화합니다.
아웃바운드 트래픽 보호 기능을 해제하면 모든 외부 네트워크 연결이 허용됩니다. 자세한 내용은 VPC 클러스터의 아웃바운드 트래픽 보호 관리를 참조하세요.
ibmcloud oc vpc outbound-traffic-protection disable --cluster CLUSTER
전제조건
애드온을 설치하기 전에 다음 단계를 완료하세요.
-
계정에 로그인하십시오. If applicable, target the appropriate resource group. 클러스터에 대한 컨텍스트를 설정하십시오.
-
선택 사항: 아직 없으면 VPC Public Gateway 만듭니다.
-
OpenShift 파이프라인, Node 기능 검색 또는 NVIDIA GPU 오퍼레이터를 OpenShift AI 애드온과 함께 사용하려면 클러스터에서 OperatorHub 를 활성화하고 아웃바운드 트래픽 보호를 비활성화해야 합니다. 만약 이 연산자를 사용하지 않으려면 이 단계를 건너뛰십시오.
- 클러스터에서 OperatorHub 를 활성화하십시오.
oc patch operatorhub cluster --type json -p '[{"op": "add", "path": "/spec/disableAllDefaultSources", "value": false}]'- 아웃바운드 트래픽 보호를 비활성화합니다.
아웃바운드 트래픽 보호 기능을 해제하면 모든 외부 네트워크 연결이 허용됩니다. 자세한 내용은 VPC 클러스터의 아웃바운드 트래픽 보호 관리를 참조하세요.
- 콘솔에서 클러스터 페이지로 이동하여 관련 클러스터를 클릭합니다.
- 클러스터의 개요 페이지에서 네트워킹 섹션을 찾아 아웃바운드 트래픽 보호 사용 안 함 옵션을 선택합니다.
1단계: 사용자 지정 옵션 선택
이동식 머신 러닝 워크플로 구축을 위한 데이터 파이프라인이나 리소스 관리 및 확장을 위한 도구 등 애드온 설치에 포함할 다양한 옵션을 지정하여 Red Hat OpenShift AI 프로젝트를 향상시킬 수 있습니다. 업그레이드 정책과 삭제 정책을 사용자 지정할 수도 있습니다. 사용 가능한 각 옵션에 대한 설명은 OpenShift AI 사용자 지정 옵션을 참조하세요. 추가 기능을 설치할 때 특정 옵션을 포함시키지 않으면 기본값이 적용됩니다. 이러한 옵션은 Red Hat OpenShift AI 플랫폼에서 관리합니다.
CLI에서 명령을 실행하여 모든 옵션을 나열합니다. 이러한 옵션은 설치 중 UI의 기능 섹션에 나열됩니다.
ibmcloud oc cluster addon options --addon openshift-ai
2단계: 추가 권장 사업자 검토
OpenShift 의 특정 AI 기능 사용을 위해 추천되는 추가 연산자를 설치할 수도 있습니다. 클러스터에 아직 설치되어 있지 않다면, 애드온 설치에 포함시킬 수 있습니다. 또는 OperatorHub 를 이용하거나 운영자별 설치 단계를 따라 언제든지 설치할 수 있습니다. 이 연산자를 사용하려면 클러스터에 대한 아웃바운드 트래픽 보호 기능을 비활성화해야 합니다.
업데이트, 모니터링, 복구, 재설치 등을 포함하되 이에 국한되지 않는 이러한 운영자의 관리를 책임집니다.
다음 연산자들을 사용하는 것이 좋습니다.
이 중 일부 연산자는 애드온을 설치할 때 지정할 수 있는 추가 사용자 정의가 포함될 수 있습니다. 권장 작업자에 사용할 수 있는 사용자 지정 목록을 검토합니다.
3단계: CLI에 애드온 설치
Red Hat OpenShift AI 애드온을 설치하는 명령어를 실행합니다. --parameter PARAM=VALUE 형식으로 사용자 지정을 지정합니다. 예를 들어, 데이터 사이언스 파이프라인 옵션을 포함하려면, --parameter oaiDataSciencePipelines=Managed 를 지정합니다.
CLI를 통해 애드온을 설치할 때 추천 연산자를 포함하려면 설치 명령을 실행할 때 다음 옵션을 지정하십시오.
- OpenShift 파이프라인:
--parameter pipelineEnabled=true - Node 기능 발견:
--parameter nfdEnabled=true - NVIDIA GPU 운영자:
--parameter nvidiaEnabled=true
사용 가능한 버전 목록은 지원되는 버전을 참조하세요.
설치 명령.
ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER [-f] [--param PARAM] [-q] [--version VERSION]
자동 마이너 및 패치 업데이트, CodeFlare, 및 KServe를 활성화하여 애드온을 설치하는 명령 예시.
ibmcloud oc cluster addon enable openshift-ai --cluster CLUSTER --param oaiInstallPlanApproval=Automatic --param oaiCodeflare=Managed --param oaiKserve=Managed
2단계: 추가 권장 운영자 검토
OpenShift 의 특정 AI 기능 사용을 위해 추천되는 추가 연산자를 설치할 수도 있습니다. 클러스터에 아직 설치되어 있지 않다면, 애드온 설치에 포함시킬 수 있습니다. 또는 OperatorHub 를 이용하거나 운영자별 설치 단계를 따라 언제든지 설치할 수 있습니다. 이 연산자를 사용하려면 클러스터에 대한 아웃바운드 트래픽 보호 기능을 비활성화해야 합니다.
업데이트, 모니터링, 복구, 재설치 등을 포함하되 이에 국한되지 않는 이러한 운영자의 관리를 책임집니다.
다음 연산자들을 사용하는 것이 좋습니다.
이 중 일부 연산자는 애드온을 설치할 때 지정할 수 있는 추가 사용자 정의가 포함될 수 있습니다. 권장 작업자에 사용할 수 있는 사용자 지정 목록을 검토합니다.
3단계: UI에 애드온 설치하기
Red Hat OpenShift 의 UI를 통해 AI 애드온을 설치하십시오.
-
클러스터 페이지로 이동한 다음, 해당 클러스터를 클릭합니다.
-
클러스터 세부사항 페이지에서 추가 기능 섹션을 찾습니다. Red Hat OpenShift AI 옵션을 찾아서 설치를 클릭합니다.
-
기능 섹션에서 사용 가능한 추가 기능 사용자 정의 옵션에 대한 설명을 검토하고 설치에 포함할 옵션을 활성화하십시오.
-
추가 추천 연산자 섹션 에서 각 연산자를 클릭하여 확장하고 포함하고자 하는 사용자 정의 옵션을 선택합니다. 이러한 추가 연산자와 사용자 지정은 특정 Red Hat OpenShift 의 AI 기능에 권장됩니다. OperatorHub 를 사용하거나 운영자별 설치 단계를 따라 나중에 이러한 옵션을 설치하도록 선택할 수 있습니다.
업데이트, 모니터링, 복구, 재설치 등을 포함하되 이에 국한되지 않는 이러한 운영자의 관리를 책임집니다.
-
설치를 클릭하십시오.
4단계: OpenShift AI 대시보드에 액세스합니다
OpenShift AI 애드온을 설치한 후 OpenShift AI 대시보드에 액세스할 수 있습니다.
- 클러스터 개요 페이지에서 ‘ OpenShift 웹 콘솔 ’을 클릭하세요.
- 애플리케이션 실행기 에서
Red Hat OpenShift AI 대시보드 옵션을 선택합니다.
- 메시지가 표시되면
Log in with OpenShift을 클릭합니다.
선택 사항입니다: 고급 모드에서 KServe 설정
고급 모드에서 KServe를 사용하려면 다음 단계를 완료해야 합니다.
- OperatorHub 에서 OpenShift 서버리스 오퍼레이터를 설치합니다.
- OperatorHub 에서 OpenShift 서비스 메시 오퍼레이터를 설치합니다.
- 데이터 과학 클러스터 초기화 CR에서 서비스 메시 관리 상태를
Managed로 설정합니다.serviceMesh: controlPlane: metricsCollection: Istio name: data-science-smcp namespace: istio-system managementState: Managed - 데이터 과학 클러스터 사용자 지정 리소스에서 KServe 서비스 관리 상태를
Managed로 설정합니다.kserve: managementState: Managed serving: managementState: Managed name: knative-serving
OpenShift AI 맞춤 설정 옵션
OpenShift AI 애드온에 사용할 수 있는 사용자 지정 옵션을 검토해 보세요. 이러한 운영자는 Red Hat OpenShift AI 플랫폼에서 관리합니다.
CLI로 AI OpenShift 애드온을 설치할 때 옵션을 포함하려면, 실행 시 해당 옵션을 ibmcloud oc cluster addon enable openshift-ai 형식으로 --parameter PARAM=VALUE 포함하십시오. 예를 들어, 데이터 사이언스 파이프라인 옵션을 사용하여 애드온을 설치하려면, --parameter oaiDataSciencePipelines=Managed 를 지정합니다.
AI OpenShift 애드온을 UI와 함께 설치할 때 옵션을 포함하려면, 메시지가 표시될 때 클릭하여 옵션을 활성화하십시오. 이러한 옵션은 기능 섹션에 포함되어 있습니다.
| 사용자 정의 | CLI 매개 변수 | 설명 | 값 | 기본값 |
|---|---|---|---|---|
| OpenShift AI 플랫폼 부차적 및 패치 업데이트 승인 정책 | oaiInstallPlanApproval |
자동 또는 수동으로 마이너 업데이트와 패치 업데이트를 적용합니다. | Automatic 또는 Manual |
Automatic |
| OpenShift AI 삭제 정책 | oaiDeletePolicy |
애드온이 제거된 경우, 애드온에 의해 설치된 운영자나 구성 요소를 유지하거나 삭제합니다. | Retain 또는 Delete |
Retain |
| 오픈 데이터 허브 대시보드 | oaiDashboard |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
| 쿠에우에 | oaiKueue |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
| CodeFlare | oaiCodeflare |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
| ModelMesh 봉사 | oaiModelmeshserving |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
| 워크벤치 | oaiWorkbenches |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
| 데이터 과학 파이프라인 | oaiDataSciencePipelines |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
| KServe | oaiKserve |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
| Ray | oaiRay |
구성 요소를 활성화하거나 비활성화합니다. 활성화된 경우, AI 플랫폼인 OpenShift 에서 관리됩니다. | ManagedRemoved 를 활성화하려면 비활성화하려면 |
Managed (활성화됨) |
추가 권장 오퍼레이터
설치 과정에서 포함시킬 수 있는 추천 연산 자와 선택적 사용자 정의 설정을 검토하십시오. 업데이트, 모니터링, 복구, 재설치 등을 포함하되 이에 국한되지 않는 이러한 운영자의 관리를 책임집니다.
CLI를 통해 AI OpenShift 애드온을 설치할 때 연산자에 대한 사용자 지정을 포함하려면, 실행 시 다음 --parameter PARAM=VALUE 형식으로 ibmcloud oc cluster addon enable openshift-ai 옵션을 포함하십시오. 예를 들어, 연산자에 대한 GPUDirect NVIDIA Storage NVIDIA 사용자 지정을 포함하려면 를 지정하십시오 --parameter nvidiaGpuDirectStorageEnabled=true.
AI OpenShift 애드온을 UI와 함께 설치할 때 운영자에 대한 사용자 지정을 포함하려면, 메시지가 표시될 때 옵션을 클릭하여 활성화하십시오. 참고: 기본 설정이 적용된 추가 NVIDIA 오퍼레이터가 있으며, 이는 CLI에서만 변경하거나. 파일을 편집하여 변경할 ClusterPolicy 수 있습니다.
| 사용자 정의 | CLI 매개 변수 | 설명 | 값 | 기본 설정 |
|---|---|---|---|---|
| Node 기능 검색 삭제 정책 | nfdDeletePolicy |
OpenShift AI 애드온이 제거되면 작업자를 유지하거나 삭제합니다. | Retain (기본값) 또는 Delete |
Retain |
| NVIDIA GPU 운영자 삭제 정책 | nvidiaDeletePolicy |
OpenShift AI 애드온이 제거되면 작업자를 유지하거나 삭제합니다. | Retain (기본값) 또는 Delete |
Retain |
| NVIDIA CUDA 설치 후 테스트 | nvidiaCudaTest |
NVIDIA CUDA 테스트를 활성화합니다. | true (활성화, 기본값)false (비활성화) |
false (사용 안함) |
| 파이프라인 운영자 삭제 정책 | pipelineDeletePolicy |
OpenShift AI 애드온이 제거되면 작업자를 유지하거나 삭제합니다. | Retain (기본값) 또는 Delete |
다음 NVIDIA GPU 연산자는 기본 설정으로 적용됩니다. CLI로 애드온을 설치하는 경우에만 설치 중에 이러한 설정을 변경할 수 있습니다. 설치 후 UI 또는 CLI에서 ClusterPolicy 을 편집하여 이러한 설정을 변경할 수 있습니다.
| 사용자 정의 | CLI 매개 변수 | 설명 | CLI 값 | UI 기본 설정 |
|---|---|---|---|---|
| NVIDIA 샌드박스 작업량 | nvidiaSandboxWorkloads |
샌드박스 작업에 필요한 추가 피연산자 관리를 활성화합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDIA vGPU 매니저 | nvidiaVgpuManagerEnabled |
NVIDIA vGPU Manager 활성화 | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDIA GPUDirect 저장소 | nvidiaGpuDirectStorageEnabled |
GPUDirect 스토리지를 활성화합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDIA Node 상태 내보내기 도구 | nvidiaNodeStatusExporterEnabled |
Node 상태 내보내기 기능을 활성화합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDIA 가상 함수 I/O 관리자 | nvidiaVfioManagerEnabled |
VFIO-PCI를 배포하기 위한 구성을 위해 VFIO 관리자를 활성화합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDIA 샌드박스 장치 플러그인 | nvidiaSandboxDevicePluginEnabled |
NVIDIA 샌드박스 장치 플러그인을 활성화합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDA 멀티 인스턴스 GPU 관리자 | nvidiaMigManagerEnabled |
NVIDIA 멀티 인스턴스 GPU 관리자를 활성화합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDIA 데이터센터 GPU 관리자 호스트엔진 배포 | nvidiaDcgmEnabled |
NVIDIA 데이터 센터 GPU 관리자 Hostengine을 별도의 포드로 배포하도록 설정합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
| NVIDIA vGPU 장치 관리자 | nvidiaVgpuDeviceManagerEnabled |
NVIDIA vGPU 장치 관리자를 활성화합니다. | true (활성화, 기본값)false (비활성화) |
Enabled |
다음에 수행할 작업
- 사기 탐지를 위한 OpenShift AI 사용 튜토리얼을 확인해 보세요.
- 방법 알아보기 OpenShift AI를 사용하여 학습한 모델을 배포합니다 InstructLab.
- OpenShift AI 애드온 관리에 대한 정보를 참조하십시오.
- OpenShift AI 애드온의 업데이트 프로세스를 이해했는지 확인하세요.