쿼리 엔진 시작하기

Presto 엔진을 성공적으로 프로비저닝한 후에는 테스트 쿼리를 실행하고, 첫 스키마 및 테이블을 생성하여 Presto 기능을 탐색하여 watsonx.data 환경을 시작하세요.

이 튜토리얼에서는 몇 가지 테스트 쿼리를 실행하여 Presto 기능을 이해하고 첫 번째 스키마를 만들어 데이터 구성을 위한 기본 구조를 설정하는 방법을 배웁니다. 스키마가 제 위치에 있으면 테이블 작성을 진행할 수 있습니다. 테이블은 데이터를 저장하고 구성하기 위한 필수 구성요소입니다.

샘플 시나리오: 이해하려면 다음을 수행하십시오.

  • watsonx.data Presto 사용하여 테이블 쿼리하기
  • 킥스타트에 사용 가능한 데이터 정보
  • 데이터를 저장, 구성 및 조회하기 위해 스키마 및 테이블을 작성하는 방법을 학습합니다.

목표

  • 테스트 조회 실행
  • 첫 번째 스키마 및 테이블 작성

시작하기 전에

이 튜토리얼에는 다음 항목이 필요합니다.

  • IBM Cloud의 watsonx.data 에 등록하십시오.
  • watsonx.data 인스턴스를 프로비저닝합니다. 자세한 정보는 인스턴스 프로비저닝을 참조하십시오.

테스트 조회 실행

이 튜토리얼의 이 섹션에서는 쿼리 작업 영역을 사용하고 테스트 쿼리를 실행하여 Presto 엔진의 작동에 익숙해지는 방법을 설명합니다.

SQL 쿼리를 실행하려면 다음 단계를 수행합니다:

  1. 탐색 메뉴에서 SQL을 선택합니다. 쿼리 작업 영역 페이지가 열립니다.
  2. 엔진 목록에서 Presto 엔진을 선택합니다.
  3. 시스템 및 벤치마킹 데이터로 이동하십시오. watsonx.data 는 기본 카탈로그 tpcdstpch 를 제공합니다. 이 카탈로그는 벤치마킹을 위해 자동 생성된 데이터를 제공합니다. 또한 샘플 조회 및 데이터를 실행하는 데 사용할 수도 있습니다.
  4. tpch 카탈로그 (예: Tiny) 에서 스키마를 선택한 후 테이블 (예: Customer) 을 선택하십시오. 오버플로우 메뉴를 클릭하여 경로 생성또는 SELECT 생성을 선택하십시오.
  5. 선택 생성 을 선택하고 한계 (예: 100) 를 선택하십시오.
  6. 실행을 클릭하여 쿼리를 실행합니다.
  7. 결과 세트 또는 세부사항 탭을 선택하여 결과를 보십시오. 필요한 경우 조회를 저장할 수 있습니다.

데이터 저장

  1. 탐색 메뉴에서 Data Manager 를 선택하십시오. 데이터 관리자 페이지가 열립니다.
  2. Iceberg_data 카탈로그를 선택합니다. 카탈로그는 기본적으로 사용 가능합니다.
  3. 작성을 클릭하십시오. 스키마 작성 을 선택하여 iceberg_data 카탈로그 아래에 스키마를 작성하십시오. 자세한 정보는 스키마 작성을 참조하십시오.
  4. 스키마에 이름을 지정하십시오 (예: new_schema).
  5. 데이터를 저장하려면 스키마 내에 테이블을 작성해야 합니다. 다음 옵션 중 하나를 사용하여 표를 만듭니다:
  • 옵션 1: SQL 조회를 실행하여 테이블 ( tpcds 카탈로그에서 사용 가능한 기본 데이터를 사용하여) 을 작성할 수 있습니다.

    a. 조회 작업공간 페이지로 이동하십시오.

    b. 테이블 작성 조회를 실행하십시오. 샘플 조회가 표시됩니다.

      CREATE TABLE IF NOT EXISTS
      "iceberg_data"."new_schema"."new_table"
      AS SELECT * FROM "tpcds"."sf1"."catalog_returns"
      LIMIT
       100;
    

    SQL 조회는 iceberg_data catalog 내에서 new_schema 를 사용하여 new_table 테이블을 작성합니다. 또한 tpcds 카탈로그의 sf1 스키마를 사용하는 catalog_returns 테이블에서 데이터를 로드합니다.

    iceberg_data 카탈로그로 이동하여 select 쿼리 명령문을 실행하여 new_table 에 데이터가 있는지 확인할 수 있습니다.

  • 옵션 2: 사용자 고유의 데이터 (.csv, parquet, .json, .txt 형식) 를 업로드하여 테이블을 작성할 수 있습니다.

    a. Data Manager 페이지로 이동하십시오.

    b. .csv, parquet, .json, .txt 형식의 데이터로 테이블을 작성할 수 있습니다. 이를 수행하려면 테이블 작성을 참조하십시오.

    조회 작업공간 페이지로 이동할 수 있습니다. iceberg_data 카탈로그에서 새로 작성된 테이블을 선택하고 select query문을 실행하여 테이블에 데이터가 있는지 확인하십시오.

작성된 테이블에서 데이터 조회

iceberg_data 카탈로그 내에 작성된 새 테이블에서 SELECT 생성 조회를 실행할 수 있습니다. 이렇게 하려면 다음을 수행하십시오.

  1. 탐색 메뉴에서 조회 작업공간 페이지로 이동하십시오.
  2. new_table 스키마 내에서 new_schema 카탈로그 내에서 iceberg_data 테이블을 선택하십시오.
  3. SELECT 생성을 선택하십시오.
  4. 예제에 표시된 대로 한계를 100으로 편집하십시오.
      SELECT * FROM
      "iceberg_data"."new_schema"."new_table"
      LIMIT
       100;
    
  5. 다음에서 실행을 클릭하여 쿼리를 실행합니다.
  6. 결과 세트 또는 세부사항 탭을 선택하여 결과를 보십시오. 조회를 저장할 수도 있습니다.