스토리지 추가 및 데이터 조회

이 학습서에서는 사용자가 소유한 스토리지를 추가하는 방법을 학습하고 watsonx.data 서비스가 사용자가 가져오는 데이터와 상호작용하는 방법을 탐색합니다.

샘플 시나리오: 사용자의 팀이 보유한 데이터 버킷에서 데이터를 조회해야 하는 자동화된 데이터 파이프라인을 개발하기 위해 작업 중입니다. 관리자는 watsonx.data 인스턴스를 사용하여 데이터 버킷에서 데이터를 검색하도록 요청합니다.

이 시나리오에서는 Presto 쿼리 엔진을 만들고, 스토리지와 연결을 설정하고, 데이터 버킷에 데이터를 수집하고, watsonx.data 인스턴스에 결과를 표시해야 합니다.

목표

  • watsonx.data 서비스 내에 인프라를 작성하는 중입니다.

  • 고객 데이터 버킷과의 연결을 설정하는 중입니다.

  • 버킷에서 조회

caption-side=bottom"
워크플로 다이어그램*

시작하기 전에

이 튜토리얼에는 다음 항목이 필요합니다.

  • 클라우드에서 watsonx.data 의 등록입니다.
  • 가져온 데이터 버킷의 구성 세부사항입니다. 이는 watsonx.data를 사용하여 연결을 설정하는 데 필요합니다.
  • watsonx.data 서비스 인스턴스 프로비저닝

소유한 스토리지 추가 및 데이터 수집

학습서의 이 섹션에서는 가져온 스토리지 버킷을 등록하고 여기에 데이터를 추가하는 방법을 학습합니다.

  1. 소유한 스토리지 버킷을 추가하려면 스토리지-카탈로그 쌍 추가 를 참조하십시오.
  2. 데이터 관리자 페이지에서 테이블 작성 옵션을 사용하여 데이터 파일의 로컬 또는 외부 소스를 로드하여 테이블을 작성할 수 있습니다. CLI를 사용하여 대형 파일을 수집할 수도 있습니다. 자세한 정보는 구성 파일을 사용하여 수집 작업 작성을 참조하십시오.

데이터 조회

학습서의 이 섹션에서는 조회 작업공간을 탐색하고 버킷에서 데이터를 조회하기 위한 SQL 조회를 작성하는 방법을 학습합니다.

SQL 쿼리를 실행하려면 다음 단계를 수행합니다:

  1. 탐색 메뉴에서 SQL을 선택합니다. 쿼리 작업 영역 페이지가 열립니다.

  2. 선택Presto (Java ) 엔진의엔진 쓰러지 다.

  3. 카탈로그 (예: default 스키마) 및 테이블 (예: order_detail) 을 선택하여 조회를 실행하십시오.

  4. 오버플로우 메뉴를 클릭하고 필요한 조회를 선택하십시오.

    • 카탈로그 및 스키마의 경우 경로 생성 조회를 실행할 수 있습니다.
    • 테이블의 경우 경로 생성, SELECT 생성, ALTER 생성DROP 생성 쿼리를 실행할 수 있습니다.
    • 열의 경우 경로 생성, SELECT 생성DROP 생성 조회를 실행할 수 있습니다.

    테이블에서 세부사항을 보려면 다음 샘플 쿼리를 고려하십시오.

    예:

    SELECT * FROM "iceberg-beta"."default"."order_detail" LIMIT 10;
    
  5. 실행을 클릭하여 쿼리를 실행합니다.

  6. 결과 세트 또는 세부사항 탭을 선택하여 결과를 보십시오. 필요한 경우 조회를 저장할 수 있습니다.

  7. 저장된 조회를 보려면 저장된 조회 를 클릭하십시오.

  8. 지정된 SQL 쿼리에 대한 논리 또는 분산 실행 플랜을 보려면 설명 을 누르십시오.