빠른 시작 watsonx.data 콘솔

IBM® watsonx.data 웹 콘솔에 처음 로그인하면 빠른 시작 마법사가 표시됩니다. 이 튜토리얼에서는 빠른 시작 마법사를 사용하여 핵심 구성 요소를 구성하고 watsonx.data 을 몇 분 안에 시작하는 방법을 배웁니다.

마법사는 watsonx.data 의 인프라 구성 요소에 대한 초기 구성 프로세스를 안내합니다.

스토리지 구성

watsonx.data 원시 데이터 파일을 저장하려면 개체 저장소 버킷이 필요합니다. IBM-관리되는 버킷을 새로 프로비저닝하거나 직접 버킷을 등록할 수 있습니다. 나중에 버킷을 더 추가하고 등록할 수 있습니다. 쿼리 모니터링 세부 정보를 구성할 수도 있습니다. 쿼리 모니터링을 활성화 또는 비활성화하여 대각선 데이터를 저장하고 관리할 수 있습니다.

저장소 구성 섹션에서 다음 단계를 완료합니다:

  1. 다음 옵션 중 하나를 선택하고 세부 정보를 입력합니다.

    • COS 인스턴스 검색: IBM Cloud 계정에서 기존 IBM COS 인스턴스와 연결된 버킷을 선택합니다. 여러 개의 IBM COS 인스턴스와 버킷이 감지되면 원하는 버킷이 포함된 IBM COS 인스턴스를 선택하여 watsonx.data 에 등록합니다.

    • 나만의 등록: 기존 인스턴스에서 기존 IBM COS 버킷을 사용하거나 새 인스턴스를 프로비저닝할 수 있습니다. 새 IBM COS 인스턴스를 프로비저닝하려면 다음 세부 정보를 제공하세요:

      버킷 추가
      필드 설명
      버킷 유형 Amazon S3, IBM Storage Ceph 또는 IBM Cloud Object Storage 에서 선택합니다.
      지역 데이터 버킷을 사용할 수 있는 지역입니다.
      버킷 이름 버킷 이름을 입력합니다.
      표시 이름 화면에 표시할 버킷 이름을 입력합니다.
      엔드포인트 엔드포인트를 입력 URL.
      액세스 키 액세스 키를 입력합니다.
      비밀 키 비밀 키를 입력합니다.
      연결 상태 연결 테스트 링크를 클릭하여 watsonx.data 로의 버킷 연결이 성공했는지 여부를 테스트합니다. 시스템에서 상태 메시지를 표시합니다.

    기존 IBM COS 버킷을 선택하는 경우 기본 크기는 10GB입니다. 탐색 목적으로만 사용되며 프로덕션 또는 민감한 데이터를 저장하는 데 사용할 수 없습니다. watsonx.data 인스턴스 관리자는 규정 준수를 위해 이 버킷을 비활성화할 수 있습니다.

    나만의 버킷을 등록할 때는 버킷 구성에 대한 정확한 세부 정보를 제공해야 합니다. 빠른 시작 마법사는 버킷 구성 세부 정보의 유효성을 검사하지 않으며 나중에 수정할 수 없습니다.

쿼리 모니터링 섹션에서 다음 단계를 완료합니다:

  1. 토글 스위치를 사용하여 쿼리 모니터링 기능을 사용(또는 사용하지 않도록) 설정합니다.

    쿼리 모니터링 버킷과 함께 표시되는 관련 카탈로그는 Hive 유형입니다.

  2. QHMM 기능을 사용하도록 설정하는 경우 QHMM 데이터를 저장하기 위한 저장소 세부 정보를 구성해야 합니다. 다음 옵션 중 하나를 선택하고 세부 정보를 입력합니다.

    • COS 인스턴스 검색: IBM Cloud 계정에서 기존 IBM COS 인스턴스와 연결된 버킷을 선택합니다. 여러 개의 IBM COS 인스턴스와 버킷이 감지되면 원하는 버킷이 포함된 IBM COS 인스턴스를 선택하여 watsonx.data 에 등록합니다.

    • 내 버킷 등록: 기존 버킷을 QHMM 버킷으로 등록할 수 있습니다. 다음 버킷 유형만 QHMM 버킷으로 등록할 수 있습니다: Amazon S3, IBM Storage Ceph, 또는 IBM Cloud Object Storage 입니다. 기존 버킷을 QHMM 버킷으로 등록하려면 다음 세부 정보를 입력하세요:

      버킷 추가
      필드 설명
      버킷 유형 Amazon S3, IBM Storage Ceph 또는 IBM Cloud Object Storage 에서 선택합니다.
      지역 데이터 버킷을 사용할 수 있는 지역입니다.
      버킷 이름 버킷 이름을 입력합니다.
      표시 이름 화면에 표시할 버킷 이름을 입력합니다.
      엔드포인트 엔드포인트를 입력 URL.
      액세스 키 액세스 키를 입력합니다.
      비밀 키 비밀 키를 입력합니다.
      연결 상태 연결 테스트 링크를 클릭하여 watsonx.data 로의 버킷 연결이 성공했는지 여부를 테스트합니다. 시스템에서 상태 메시지를 표시합니다.

    저장소(기본 또는 BYOB)는 나중에 watsonx.data 콘솔 페이지에서 변경할 수 있습니다. 쿼리 모니터링을 참조하세요.

  3. 다음 을 클릭하십시오.

카탈로그 구성

테이블 스키마를 관리하려면 watsonx.data 메타데이터 카탈로그가 필요합니다. 메타데이터 카탈로그에 대한 지원 서비스를 만들면 빠른 시작 프로세스를 완료할 때 인스턴스 실행 속도에 시간당 3RU가 추가됩니다.

카탈로그 구성 페이지에서 다음 단계를 완료합니다:

  1. 데이터 관리를 위한 테이블 형식을 선택합니다. Apache Hive 및 Apache Iceberg 카탈로그를 사용할 수 있습니다.

쿼리 모니터링 기능을 사용하려면 Apache Hive 카탈로그를 선택해야 합니다.

  1. 다음 을 클릭하십시오.

엔진 구성

watsonx.data 데이터로 작업하려면 쿼리 엔진이 필요합니다.

엔진 구성 페이지에서 다음 단계를 완료합니다:

  1. 첨부한 데이터를 실행하고 처리할 엔진을 선택합니다.

  2. 워크로드의 요구 사항에 따라 엔진의 크기를 선택하세요.

    엔진 크기
    크기 설명
    스타터/라이트 ( IBM ) (시간당 2 RU) 코디네이터 노드 1개와 워커 노드 1개를 포함합니다. 모든 노드는 스타터입니다.
    스타터 ( AWS ) ( 5.6 RU/시간 ) 코디네이터 노드 1개와 워커 노드 1개를 포함합니다. 모든 노드는 캐시에 최적화되어 있습니다.
    Small ( 11.2 RU/시간) 코디네이터 노드 1개와 워커 노드 3개를 포함합니다. 모든 노드는 캐시에 최적화되어 있습니다.
    중간 ( 19.6 RU/시간) 코디네이터 노드 1개와 워커 노드 6개를 포함합니다. 모든 노드는 캐시에 최적화되어 있습니다.
    대형 ( 36.4 RU/시간) 코디네이터 노드 1개와 워커 노드 12개를 포함합니다. 모든 노드는 캐시에 최적화되어 있습니다.
  3. 다음 을 클릭하십시오.

구성 세부 정보 검토

요약 페이지에서 다음 단계를 완료합니다:

  1. watsonx.data 설정을 완료하기 전에 구성을 검토하세요.

  2. 완료를 클릭하고 이동합니다.

설정이 완료되면 watsonx.data 홈 페이지가 나타납니다. 빠른 시작 마법사를 사용하여 지원 서비스를 만든 직후부터 리소스 단위 소비가 시작됩니다. 청구 및 사용량 탭에서 청구를 위해 제출된 실행률을 확인할 수 있습니다. 자세한 내용은 청구 및 사용량을 참조하세요.

다음 단계

watsonx.data 을 사용하도록 설정되었거나 추가로 구성할 수 있습니다.