시작하기 Watson Discovery

이 학습서에서는 IBM Watson® Discovery 을 소개하고 Discovery 샘플 프로젝트를 안내합니다. 샘플 프로젝트를 탐색하는 것은 몇 가지 제품의 기능을 둘러보고 시도하는 좋은 방법입니다.

시작하기 전에

배치를 위해 완료할 적절한 단계를 선택하십시오.

  • IBM Cloud Pak for Data 노즈비 IBM Software Hub Discovery 를 설치하십시오. Discovery for Cloud Pak for Data 설치를 참조하십시오.

  • IBM Cloud 다음 단계를 완료하십시오.

    1. IBM Cloud 에 가입하거나 로그인하세요.

    2. 비용 없이 30일 동안 플러스 계획을 사용할 수 있습니다. 그러나 서비스의 Plus 계획 인스턴스를 작성하려면 지불 계정이 있어야 합니다.

      유료 계정 작성에 대한 자세한 정보는 계정 업그레이드를 참조하십시오.

      Plus 플랜 사용을 중단하기로 결정하고 요금을 지불하고 싶지 않다면, 30일 체험 기간이 끝나기 전에 서비스 인스턴스를 삭제하십시오.

    3. IBM Cloud 카탈로그의 Discovery 자원 페이지로 이동하여 Plus 계획 서비스 인스턴스를 작성하십시오.

열다 Watson Discovery

IBM Cloud

이러한 지시사항은 서비스 인스턴스로 IBM Cloud Pak for Data 을 포함한 모든 관리 배치에 적용됩니다.

  1. Discovery 를 클릭하여 서비스 대시보드로 이동합니다.

  2. 관리 페이지에서 Watson Discovery 실행을 클릭하십시오.

로그인하라는 프롬프트가 표시되면 IBM Cloud 인증 정보를 제공하십오.

IBM Cloud Pak for Data IBM Software Hub

다음 지시사항은 Discovery 배치에 적용됩니다.

  1. 웹 클라이언트의 메인 메뉴에서 서비스를 확장한 다음 인스턴스를 클릭합니다.

  2. 인스턴스를 찾은 후 해당 인스턴스를 클릭하여 해당 요약 페이지를 여십시오.

    배포당 최대 10개의 인스턴스를 생성할 수 있습니다. 최대 개수에 도달하면, IBM Cloud Pak for Data 에 새로운 인스턴스 버튼이 표시되지 않습니다.

  3. 실행 도구을 클릭하십시오.

샘플 프로젝트 열기

새 브라우저 탭 또는 창이 열리고 내 프로젝트 페이지 가 표시됩니다.

단일 샘플 프로젝트 타일이 있는 기본 내 프로젝트 페이지를 표시합니다.
My projects page of the Sample project

제품에 익숙해지려면 제품 홈 페이지에서 비디오 보기 링크를 클릭하여 3분 개요 비디오를 시청할 수 있습니다.

이 학습서에서는 샘플 프로젝트를 탐색합니다.

샘플 프로젝트는 처음에 제품을 탐색할 수 있는 자원으로 제공되는 기본 제공 프로젝트입니다. 샘플 프로젝트는 문서 검색 프로젝트 유형입니다. 문서 검색 프로젝트는 데이터에서 가장 관련성 있는 답변을 검색하고 찾는 데 사용됩니다.

  1. 샘플 프로젝트를 클릭하십시오.

    개선 및 사용자 정의 페이지가 표시됩니다.

    Discovery 를 설치한 경우, 샘플 프로젝트가 문서 처리를 완료하는 데 시간이 필요합니다. 실험을 시작하기 전에 처리가 완료될 때까지 기다리십시오. 다음 단계에서 설명하는 활동 페이지에서 데이터 처리 상태를 확인할 수 있습니다.

    샘플 프로젝트의 개선 및 사용자 정의 페이지를 표시합니다.
    Sample project Improve and customize page

샘플 콜렉션에 대해 알아보기

샘플 프로젝트에서 사용할 수 있는 샘플 콜렉션을 탐색하여 콜렉션을 관리하고 향상시킬 수 있는 방법에 대해 학습합니다. 샘플 콜렉션은 업로드된 IBM 지원 PDF 문서 세트로 구성됩니다.

  1. 탐색 패널에서 컬렉션 관리 아이콘을 클릭합니다.

    프로젝트의 모든 콜렉션이 여기에 표시됩니다. 이 프로젝트에는 하나의 콜렉션만 있습니다.

    콜렉션 페이지를 샘플 콜렉션으로만 표시합니다.
    Collections page in the Sample project

  2. 샘플 콜렉션을 클릭하십시오.

    활동 페이지가 표시됩니다. 이 페이지는 컬렉션의 상태를 보여줍니다. 예를 들어, 문서의 총 수와 마지막으로 업데이트된 시간을 표시합니다. 문서가 업로드되거나 데이터 소스가 크롤될 때 발견에 문제점이 발생하면 연관된 메시지가 여기에 표시됩니다.

    샘플 콜렉션의 활동 페이지를 표시합니다.
    Activities page in the Sample project

    콜렉션을 작성한 후 이 페이지로 이동하여 콜렉션에 있는 데이터의 처리 상태에 대한 정보를 찾을 수 있습니다.

  3. 강화 탭을 클릭하십시오.

    보강 페이지에는 사용 가능한 강화 목록이 표시됩니다. 보강은 의미 있는 정보를 보다 쉽게 찾고 검색에 리턴할 수 있도록 합니다. 콜렉션에 내장된 강화를 적용하여 일반적으로 알려진 키워드와 같이 용어에 태그를 지정하는 강력한 Natural Language Understanding 모델을 활용할 수 있습니다.

    샘플 콜렉션의 보강 페이지를 표시합니다.
    Enrichments page of the Sample project

    엔티티 인리치먼트가 샘플 콜렉션에 적용됩니다.

    엔티티
    컨텐츠에 언급된 사용자, 도시 및 조직과 같은 적절한 명사를 인식합니다.

    이 인리치먼트는 문서 검색 유형의 프로젝트에 추가되는 콜렉션에 자동으로 적용됩니다.

  4. 엔티티 v2 강화의 경우 1x 선택한 필드를 클릭하십시오.

    사용 가능한 필드 목록이 표시되고 text 필드가 선택됩니다. 이 선택사항은 콜렉션의 문서가 처리될 때 엔티티 보강이 색인화되어 text 라는 필드에 추가된 컨텐츠에 적용되었음을 의미합니다.

    엔티티 보강이 텍스트 필드에 적용됨을 표시합니다.
    Entities enrichment being applied to the text field

    이 페이지에서 새 농축을 콜렉션에 적용하거나 보강이 적용되는 필드를 변경할 수 있습니다.

    검색의 강력한 기능은 사전, 패턴 및 머신 학습 모델과 같은 고유한 사용자 정의 보강을 추가할 수 있다는 점입니다. 사용자 정의 농축을 작성하면 이 페이지에도 표시됩니다. 여기서 사용되는 위치를 관리할 수 있습니다.

    사용자 정의 보강에 대한 자세한 정보는 도메인 특정 자원 추가 를 참조하십시오.

  5. 당신은 그 소장품에 또 다른 농축을 적용할 것입니다. 목록에서 키워드 보강을 찾은 다음 필드 선택을 클릭하십시오.

    키워드 보강은 컨텐츠에서 일반적으로 알려진 용어를 인식합니다.

  6. text 필드를 찾을 때까지 필드 목록을 스크롤하여 선택하십시오.

    키워드 보강을 적용할 수 있는 필드를 표시합니다.
    Fields to which you can apply the Keywords enrichment

  7. 변경사항 적용 및 재처리를 클릭하십시오.

    문서를 다시 처리하여 키워드를 찾고 태그를 지정하는 동안 콜렉션을 관리하는 데 사용할 수 있는 도구를 계속 탐색할 수 있습니다.

  8. 필드 식별을 클릭하십시오.

    문서의 대부분의 컨텐츠는 text 필드에 자동으로 색인화됩니다. text 필드에 문서당 더 적은 수의 구절이 포함되도록 다른 필드에 있는 특정 유형의 컨텐츠를 색인화하거나 대형 문서를 분할할 수 있습니다. 이를 수행하기 위해 Smart Document Understanding 모델을 콜렉션에 적용하여 감지가 문서의 중요한 필드를 인식하도록 할 수 있습니다.

    SDU (Smart Document Understanding) 는 문서의 구조를 기반으로 한 문서의 내용을 학습하는 기술이다. 사전 빌드된 SDU 모델을 적용하거나 사용자 정의 SDU 모델을 작성할 수 있습니다.

    SDU 모델 옵션을 표시합니다.
    Smart Document Understanding model options

    사용자 정의 SDU 모델을 작성하려면 사용자 학습 모델 옵션을 선택한 다음 문서의 필드에 어노테이션을 작성합니다. (이 학습서의 일부로 문서에 어노테이션을 작성하지 않습니다.)

    Smart Document Understanding 도구를 표시합니다.
    Smart Document Understanding annotation tool

    SDU에 대한 자세한 정보는 스마트 문서 이해 사용 을 참조하십시오.

  9. 필드 관리를 클릭하십시오.

    필드 관리 페이지에는 색인화된 필드가 나열됩니다. 여기에서 색인의 필드를 포함하거나 제거할 수 있습니다. 대형 문서를 여러 개의 더 작은 문서로 분할할 수도 있습니다.

    색인의 필드를 표시합니다.
    Fields in the collection index

    문서 분할에 대한 자세한 정보는 문서를 분할하여 조회 결과를 더 간결하게 만들기 를 참조하십시오.

샘플 프로젝트 검색하기

  1. 탐색 패널에서 개선 및 사용자 정의 아이콘을 클릭합니다.

    개선 및 사용자 정의 페이지는 쿼리를 시험해 보고, 사용자 정의를 추가 및 테스트하여 프로젝트의 쿼리 결과를 개선할 수 있는 곳입니다. 테스트 쿼리 제출을 시작하는 데 도움이 되는 샘플 쿼리 목록이 표시됩니다.

  2. IBM 에 대해 검색 실행 단추를 클릭하십시오.

    조회 결과가 표시됩니다.

  3. 조회 결과 중 하나에서 문서의 구절 보기를 클릭하십시오.

    결과가 발견된 문서의 미리보기가 표시됩니다.

  4. 다음 중 하나를 수행하여 검색 결과를 탐색하십시오.

    1. 고급 보기 열기를 클릭합니다.

      유용한 요약 정보 (예: 문서에서 발견된 보강의 발생 수) 가 표시됩니다.

    2. 텍스트 내에서 URL 수정을 강조표시하려면 URL 엔티티를 선택하십시오.

       URL 엔티티가 강조 표시된 고급 텍스트 보기를 표시합니다.
      Advanced view that shows entities that were recognized

    3. 문서의 정보가 JSON 형식으로 저장되는 방법을 보려면 보기 헤더에서 보기로 보기 메뉴를 클릭하고 JSON 을 선택하십시오.

      문서의 JSON 표시가 표시된다.

      문서의 JSON 표시를 표시합니다.
      JSON representation of the document

      JSON 표시를 탐색하여 감지가 문서에서 캡처한 정보를 확인할 수 있다. 예를 들어, enriched_text 섹션을 펼치고 entities 섹션을 펼치면 엔티티 보강으로 인식되고 태그 지정된 엔티티의 멘션을 볼 수 있습니다.

      JSON의 entriched_text.entities 섹션을 표시합니다.
      Shows the enrichment_text.entities section of the JSON representation

샘플 프로젝트 사용자 정의하기

이제, 패싯을 추가하여 검색 결과 보기를 사용자 정의하자. 패싯은 유사한 패턴 또는 컨텐츠를 공유하는 문서를 구성하고 분류하는 방법입니다.

  1. 개선 및 사용자 정의 페이지에서 다음과 같은 자연어 쿼리를 제출하십시오.

    How do I install Discovery?
    
  2. 표시되는 조회 결과를 검토하십시오.

    상위 엔티티 패싯이 확장된 자연어 조회의 조회 결과를 표시합니다.
    Top Entities facet results

    상위 엔티티 섹션이 표시됩니다. 엔티티를 펼치고 이들 중 하나를 클릭하여 엔티티가 언급된 결과만 표시하도록 조회 결과를 필터링할 수 있습니다. 상위 엔티티 섹션은 기본 제공 패싯입니다. 여기에서는 엔티티 보강에 의해 문서에 추가된 정보를 사용합니다.

    이전 단계에서 콜렉션에 적용한 키워드 보강을 사용하는 자체 패싯을 추가합니다.

  3. 개선 도구 패널 에서 사용자 정의 표시를 펼친 다음, 패싯을 클릭합니다.

    개선 도구 분할창의 확장된 사용자 정의 표시 섹션을 표시합니다.
    Customize display options

  4. 새 패싯을 클릭한 다음, 컬렉션의 기존 필드에서 버튼을 클릭합니다.

  5. enriched_text.keywords.mentions.text 를 선택하고, 레이블을 Keywords 로 변경한 후 적용을 클릭하십시오.

    키워드 패싯이 추가되는 패싯 패널을 표시합니다.
    Creating a Keywords-based facet

    이전에 살펴본 문서의 JSON 표시를 기억하시겠습니까? 이제 키워드 보강이 text 필드에 적용되고 문서가 다시 처리되므로 text 필드에 있는 키워드 언급이 문서의 JSON 표시에 포함됩니다.

    패싯에 사용하기 위해 선택한 필드 (enriched_text.keywords.mentions.text) 는 키워드 텍스트가 JSON에 저장되는 위치를 반영합니다.

    "enriched_{field_name}": [
      "keywords" : [
        "mentions" : [
          "text": "Cloud Pak"
        ]
      ]
    ]
    
  6. 새로운 패싯이 표시됩니다. 키워드를 클릭하여 키워드를 언급하는 결과만 포함하도록 문서를 필터링할 수 있습니다.

    키워드 패싯의 모양을 표시합니다.
    Keywords facet

샘플 콜렉션 문서에서 키워드를 인식하는 내장 NLU 보강을 성공적으로 추가했습니다. 그런 다음 키워드로 문서를 필터링할 수 있도록 키워드 보강을 사용하는 패싯을 추가했습니다.

샘플 프로젝트 공유하기

  1. 탐색 패널에서 통합 및 배치 를 클릭하십시오.

    여기에서 동료들과 프로젝트를 공유하고 배포할 수 있습니다.

  2. 화면의 지시에 따라 사용자를 추가한 다음, 로그인 자격 증명과 제공된 링크를 동료에게 보냅니다.

    통합 및 배치 페이지를 표시합니다.
    Integrate and deploy page

    자체 검색 응용프로그램을 빌드하고 전개할 준비가 된 후에는 사전 빌드된 사용자 인터페이스 구성요소를 사용하거나 사용자 정의 응용프로그램을 빌드할 수 있습니다.

    • API 정보를 클릭하십시오. 이 페이지에서 프로젝트의 프로젝트 ID를 얻을 수 있다. 검색 API를 사용하려면 프로젝트 ID가 필요하다. 또한 서비스 인스턴스 URL 와 API 키가 필요합니다. 자격 증명 세부 정보는 IBM Cloud 의 서비스 인스턴스 관리 페이지에서 확인할 수 있습니다.

    • UI 구성요소 를 클릭하여 전체 기능 검색 응용프로그램을 신속하게 작성하는 데 사용할 수 있는 사용할 수 있는 코드에 대한 링크를 찾으십시오.

자신의 콘텐트를 추가하기

이제 일부 제품 기능에 대해 자세히 알고 있으므로 검색할 데이터를 평가할 준비가 되었습니다.

그것은 모두 데이터에 관한 것입니다. 검색 솔루션이 활용할 수 있도록 소유한 컨텐츠 유형을 검토하십시오.

지원되는 데이터 소스

다음 표는 각 배치 유형에 대해 지원되는 데이터 소스를 표시합니다.

지원되는 데이터 소스
이 테이블에는 행 및 열 머리글이 있습니다. 행 헤더는 지원되는 데이터 소스를 식별합니다. 열 헤더는 다른 제품 배치 유형 옵션을 식별합니다. 배치 유형에 사용 가능한 데이터 소스를 이해하려면 데이터 소스를 설명하는 행으로 이동하여 원하는 배치 유형의 열을 찾으십시오.
데이터 소스 IBM Cloud IBM Cloud Pak for Data
박스 체크표시 아이콘 체크표시 아이콘
데이터베이스 (IBM Data Virtualization, IBM Db2, Microsoft SQL, Oracle, Postgres) 체크표시 아이콘
FileNet P8 체크표시 아이콘
HCL Notes 체크표시 아이콘
IBM Cloud Object Storage 체크표시 아이콘
로컬 파일 시스템 체크표시 아이콘
Salesforce 체크표시 아이콘 체크표시 아이콘
Microsoft SharePoint Online 체크표시 아이콘 체크표시 아이콘
Microsoft SharePoint 온프레미스 체크표시 아이콘 체크표시 아이콘
웹 사이트 체크표시 아이콘 체크표시 아이콘
Microsoft Windows 파일 시스템 체크표시 아이콘

무엇을 만들 수 있는지 모르겠어요?

빌드할 수 있는 검색 솔루션 유형에 대한 자세한 정보는 데이터에서 값 가져오기 시작 을 참조하십시오.

제품 사용자 인터페이스의 페이지 헤더에서 도움말 아이콘 도움말 아이콘 을 선택하면 언제든지 제품 문서에 액세스할 수 있습니다. 도움말 컨텐츠는 제품에서 수행 중인 작업과 관련된 정보를 제공하도록 사용자 정의됩니다.

어떤 빌드를 빌드해도 프로젝트를 작성하는 것이 중요합니다. 사용자 요구에 가장 적합한 프로젝트 유형을 결정하십시오.

기존 유형이 올바르지 않은 경우 위의 항목 없음 을 선택하여 사용자 정의 프로젝트를 대신 작성할 수 있습니다.

프로젝트 설명

프로젝트 유형 유스 케이스
필요한 것 목표 프로젝트 유형
반복적인 문서 처리 태스크의 자동화를 지원하기 위해 데이터를 추출하려고 합니다. 내 문서에서 추출되는 데이터를 빠르게 이해하고 인리치먼트를 적용하여 데이터를 개선하고 싶습니다. 지능형 문서 처리
내 질문에 대한 응답을 포함하는 문서는 무엇입니까? 구조화된 데이터와 구조화되지 않은 데이터가 혼합되어 있는 소스에서 의미 있는 정보를 찾아 독립형 엔터프라이즈 검색 애플리케이션 또는 비즈니스 애플리케이션의 검색 필드에 표시합니다. 문서 검색
내 작업에 필요한 계약의 파트는 어디입니까? 계약에서 중요한 정보를 빠르게 추출합니다. 계약에 대한 문서 검색
내가 빌드 중인 챗봇이 내가 소유한 지식을 사용하기를 원합니다. 고객 질문에 응답하기 위해 다양한 외부 데이터 소스 및 문서 형식으로 저장된 기술 정보에 대한 빠른 액세스를 가상 어시스턴트에 제공합니다. 대화식 검색
나는 내가 묻지 않았던 인사이트를 발견하고 싶습니다. 패턴 분석에서 인사이트를 얻거나 근본 원인 분석을 수행합니다. 컨텐츠 마이닝

자세한 정보는 프로젝트 작성을 참조하십시오.