스토리지 추가 및 데이터 조회
이 학습서에서는 사용자가 소유한 스토리지를 추가하는 방법을 학습하고 watsonx.data 서비스가 사용자가 가져오는 데이터와 상호작용하는 방법을 탐색합니다.
샘플 시나리오: 사용자의 팀이 보유한 데이터 버킷에서 데이터를 조회해야 하는 자동화된 데이터 파이프라인을 개발하기 위해 작업 중입니다. 관리자는 watsonx.data 인스턴스를 사용하여 데이터 버킷에서 데이터를 검색하도록 요청합니다.
이 시나리오에서는 Presto 쿼리 엔진을 만들고, 스토리지와 연결을 설정하고, 데이터 버킷에 데이터를 수집하고, watsonx.data 인스턴스에 결과를 표시해야 합니다.
목표
-
watsonx.data 서비스 내에 인프라를 작성하는 중입니다.
-
고객 데이터 버킷과의 연결을 설정하는 중입니다.
-
버킷에서 조회
시작하기 전에
이 튜토리얼에는 다음 항목이 필요합니다.
- 클라우드에서 watsonx.data 의 등록입니다.
- 가져온 데이터 버킷의 구성 세부사항입니다. 이는 watsonx.data를 사용하여 연결을 설정하는 데 필요합니다.
- watsonx.data 서비스 인스턴스 프로비저닝
소유한 스토리지 추가 및 데이터 수집
학습서의 이 섹션에서는 가져온 스토리지 버킷을 등록하고 여기에 데이터를 추가하는 방법을 학습합니다.
- 소유한 스토리지 버킷을 추가하려면 스토리지-카탈로그 쌍 추가 를 참조하십시오.
- 데이터 관리자 페이지에서 테이블 작성 옵션을 사용하여 데이터 파일의 로컬 또는 외부 소스를 로드하여 테이블을 작성할 수 있습니다. CLI를 사용하여 대형 파일을 수집할 수도 있습니다. 자세한 정보는 구성 파일을 사용하여 수집 작업 작성을 참조하십시오.
데이터 조회
학습서의 이 섹션에서는 조회 작업공간을 탐색하고 버킷에서 데이터를 조회하기 위한 SQL 조회를 작성하는 방법을 학습합니다.
SQL 쿼리를 실행하려면 다음 단계를 수행합니다:
-
탐색 메뉴에서 SQL을 선택합니다. 쿼리 작업 영역 페이지가 열립니다.
-
선택Presto (Java ) 엔진의엔진 쓰러지 다.
-
카탈로그 (예: default 스키마) 및 테이블 (예: order_detail) 을 선택하여 조회를 실행하십시오.
-
오버플로우 메뉴를 클릭하고 필요한 조회를 선택하십시오.
- 카탈로그 및 스키마의 경우 경로 생성 조회를 실행할 수 있습니다.
- 테이블의 경우 경로 생성, SELECT 생성, ALTER 생성및 DROP 생성 쿼리를 실행할 수 있습니다.
- 열의 경우 경로 생성, SELECT 생성및 DROP 생성 조회를 실행할 수 있습니다.
테이블에서 세부사항을 보려면 다음 샘플 쿼리를 고려하십시오.
예:
SELECT * FROM "iceberg-beta"."default"."order_detail" LIMIT 10; -
실행을 클릭하여 쿼리를 실행합니다.
-
결과 세트 또는 세부사항 탭을 선택하여 결과를 보십시오. 필요한 경우 조회를 저장할 수 있습니다.
-
저장된 조회를 보려면 저장된 조회 를 클릭하십시오.
-
지정된 SQL 쿼리에 대한 논리 또는 분산 실행 플랜을 보려면 설명 을 누르십시오.