쿼리 엔진 시작하기
Presto 엔진을 성공적으로 프로비저닝한 후에는 테스트 쿼리를 실행하고, 첫 스키마 및 테이블을 생성하여 Presto 기능을 탐색하여 watsonx.data 환경을 시작하세요.
이 튜토리얼에서는 몇 가지 테스트 쿼리를 실행하여 Presto 기능을 이해하고 첫 번째 스키마를 만들어 데이터 구성을 위한 기본 구조를 설정하는 방법을 배웁니다. 스키마가 제 위치에 있으면 테이블 작성을 진행할 수 있습니다. 테이블은 데이터를 저장하고 구성하기 위한 필수 구성요소입니다.
샘플 시나리오: 이해하려면 다음을 수행하십시오.
- watsonx.data Presto 사용하여 테이블 쿼리하기
- 킥스타트에 사용 가능한 데이터 정보
- 데이터를 저장, 구성 및 조회하기 위해 스키마 및 테이블을 작성하는 방법을 학습합니다.
목표
- 테스트 조회 실행
- 첫 번째 스키마 및 테이블 작성
시작하기 전에
이 튜토리얼에는 다음 항목이 필요합니다.
- IBM Cloud의 watsonx.data 에 등록하십시오.
- watsonx.data 인스턴스를 프로비저닝합니다. 자세한 정보는 인스턴스 프로비저닝을 참조하십시오.
테스트 조회 실행
이 튜토리얼의 이 섹션에서는 쿼리 작업 영역을 사용하고 테스트 쿼리를 실행하여 Presto 엔진의 작동에 익숙해지는 방법을 설명합니다.
SQL 쿼리를 실행하려면 다음 단계를 수행합니다:
- 탐색 메뉴에서 SQL을 선택합니다. 쿼리 작업 영역 페이지가 열립니다.
- 엔진 목록에서 Presto 엔진을 선택합니다.
- 시스템 및 벤치마킹 데이터로 이동하십시오. watsonx.data 는 기본 카탈로그 tpcds 및 tpch 를 제공합니다. 이 카탈로그는 벤치마킹을 위해 자동 생성된 데이터를 제공합니다. 또한 샘플 조회 및 데이터를 실행하는 데 사용할 수도 있습니다.
- tpch 카탈로그 (예:
Tiny) 에서 스키마를 선택한 후 테이블 (예:Customer) 을 선택하십시오. 오버플로우 메뉴를 클릭하여 경로 생성또는 SELECT 생성을 선택하십시오. - 선택 생성 을 선택하고 한계 (예: 100) 를 선택하십시오.
- 실행을 클릭하여 쿼리를 실행합니다.
- 결과 세트 또는 세부사항 탭을 선택하여 결과를 보십시오. 필요한 경우 조회를 저장할 수 있습니다.
데이터 저장
- 탐색 메뉴에서 Data Manager 를 선택하십시오. 데이터 관리자 페이지가 열립니다.
- Iceberg_data 카탈로그를 선택합니다. 카탈로그는 기본적으로 사용 가능합니다.
- 작성을 클릭하십시오. 스키마 작성 을 선택하여 iceberg_data 카탈로그 아래에 스키마를 작성하십시오. 자세한 정보는 스키마 작성을 참조하십시오.
- 스키마에 이름을 지정하십시오 (예:
new_schema). - 데이터를 저장하려면 스키마 내에 테이블을 작성해야 합니다. 다음 옵션 중 하나를 사용하여 표를 만듭니다:
-
옵션 1: SQL 조회를 실행하여 테이블 ( tpcds 카탈로그에서 사용 가능한 기본 데이터를 사용하여) 을 작성할 수 있습니다.
a. 조회 작업공간 페이지로 이동하십시오.
b. 테이블 작성 조회를 실행하십시오. 샘플 조회가 표시됩니다.
CREATE TABLE IF NOT EXISTS "iceberg_data"."new_schema"."new_table" AS SELECT * FROM "tpcds"."sf1"."catalog_returns" LIMIT 100;SQL 조회는
iceberg_data catalog내에서new_schema를 사용하여new_table테이블을 작성합니다. 또한tpcds카탈로그의sf1스키마를 사용하는catalog_returns테이블에서 데이터를 로드합니다.iceberg_data 카탈로그로 이동하여 select 쿼리 명령문을 실행하여
new_table에 데이터가 있는지 확인할 수 있습니다. -
옵션 2: 사용자 고유의 데이터 (.csv, parquet, .json, .txt 형식) 를 업로드하여 테이블을 작성할 수 있습니다.
a. Data Manager 페이지로 이동하십시오.
b. .csv, parquet, .json, .txt 형식의 데이터로 테이블을 작성할 수 있습니다. 이를 수행하려면 테이블 작성을 참조하십시오.
조회 작업공간 페이지로 이동할 수 있습니다. iceberg_data 카탈로그에서 새로 작성된 테이블을 선택하고 select query문을 실행하여 테이블에 데이터가 있는지 확인하십시오.
작성된 테이블에서 데이터 조회
iceberg_data 카탈로그 내에 작성된 새 테이블에서 SELECT 생성 조회를 실행할 수 있습니다. 이렇게 하려면 다음을 수행하십시오.
- 탐색 메뉴에서 조회 작업공간 페이지로 이동하십시오.
new_table스키마 내에서new_schema카탈로그 내에서iceberg_data테이블을 선택하십시오.- SELECT 생성을 선택하십시오.
- 예제에 표시된 대로 한계를 100으로 편집하십시오.
SELECT * FROM "iceberg_data"."new_schema"."new_table" LIMIT 100; - 다음에서 실행을 클릭하여 쿼리를 실행합니다.
- 결과 세트 또는 세부사항 탭을 선택하여 결과를 보십시오. 조회를 저장할 수도 있습니다.