Discovery 에 대한 릴리스 정보 IBM Cloud

제품 소프트웨어의 각 릴리스 및 업데이트에 포함된 기능 및 변경사항에 대해 학습합니다.

IBM Cloud

IBM Watson® Discovery 이 정보는 IBM Cloud 에서 호스팅되거나 IBM Cloud Pak for Data as a Service. 설치된 배포판의 릴리스 및 업데이트에 대한 정보는 IBM Watson® Discovery 카트리지용 IBM Cloud Pak® for Data 릴리스 노트에서 확인하실 수 있습니다.

동적 웹사이트 웹 크롤링 기능의 사용 중단 발표

크롤링 설정의 크롤링 전환 중 JavaScript 실행으로 제어되는 동적 웹사이트 웹 크롤링 기능은 더 이상 사용되지 않으며 2025년 9월에 제거될 예정입니다.

기존 인덱스를 보존하는 데 필요한 조치

기존 인덱스의 손실을 방지하려면 다음과 같이 해야 합니다:

  • 크롤링 전환 중에 JavaScript 실행을 비활성화합니다. 스위처를 비활성화하려면 컬렉션 관리 페이지로 이동하여 동적 웹사이트 웹 크롤링을 사용하는 컬렉션을 열고 처리 설정 탭을 클릭합니다. 크롤링할 위치 지정 에서 각 URL 에 대한 편집 아이콘을 클릭하고 크롤링 중 JavaScript 실행 전환기를 비활성화합니다.

  • 동적 웹사이트 웹 크롤링 기능을 사용하는 예약된 크롤링을 일시 중단합니다

크롤링 중 JavaScript 실행 스위처를 비활성화하면 다시 활성화할 수 없습니다.

스위처를 비활성화하지 않을 경우의 결과

스위처를 비활성화하지 않으면 2025년 9월까지 자동으로 비활성화되며 다음 예약된 웹 크롤링이 일시 중단됩니다. 이 작업은 크롤링된 사이트에서 JavaScript 이 어떻게 사용되는지에 따라 기존 인덱스가 축소된 인덱스로 대체되는 것을 방지합니다. 일시 중단된 크롤링은 UI에서 재구성할 때까지 재개되지 않습니다.

예약된 웹 크롤링에 미치는 영향

동적 웹사이트 웹 크롤링 기능을 사용하지 않는 예약된 웹 크롤링은 중단 없이 평소와 같이 계속 실행됩니다.

2024년 2월 29일

새 IDP (Intelligent Document Processing) 프로젝트 유형
IDP 프로젝트 유형은 Discovery의 새 기본 프로젝트 유형입니다. IDP 프로젝트 유형을 사용하여 리치 문서 미리보기의 문서에서 추출된 데이터를 신속하게 이해하고 인리치먼트를 적용하여 데이터를 개선할 수도 있습니다. 자세한 정보는 Intelligent Document Processing 을 참조하십시오.

2024년 1월 29 일

콜렉션을 작성할 때 정규화를 위해 표제어 정리 대신 스테밍 사용
이제 인덱스 및 쿼리에서 단어를 정규화하기 위해 표제어 정리 대신 어간 추출을 선택할 수 있습니다. 자세한 정보는 큐레이션되지 않은 데이터에 대해 스테밍 사용 을 참조하십시오.

2023년 11월 16일

콜렉션 세부사항 가져오기, 문서 나열 및 문서 세부사항 가져오기를 위한 API가 이제 IBM-크게 관리되는 인스턴스의 프리미엄 플랜에서 지원됩니다.
프리미엄 플랜에서 API는 2023년 11월 16일 이후에 작성된 콜렉션에 대해 지원됩니다. 이전에 만든 컬렉션에 대한 정보를 얻으려면 문서에서 수집 변환 단계를 실행하는 프로세스를 트리거하세요. 예를 들어, 필드 식별, 필드 관리, CSV 설정또는 처리 설정 (예: OCR 설정) 페이지에서 변경하거나 이전 콜렉션에 Smart Document Understanding 모델을 적용하여 API를 사용할 수 있습니다.

새 API에 대한 자세한 정보는 API 참조 문서를 참조하십시오.

2023년 11월 7 일

콜렉션에 대한 데이터 미리보기
콜렉션에서 문서를 미리 볼 수 있습니다. 고급 문서 보기에서 데이터를 미리 보려면 콜렉션 관리 페이지로 이동하여 콜렉션 타일에서 데이터 미리보기 를 클릭하십시오. 또는 미리보려는 콜렉션을 열고 데이터 미리보기를 클릭할 수 있습니다.

2023년 10월 4 일

이미지의 히브리어 텍스트에 대한 OCR (Optical Character Recognition) 기능은 Discovery 의 베타 기능입니다.

OCR을 사용하는 경우 텍스트 추출 및 OCR 식별 텍스트 추출에는 히브리어에 대한 제한사항이 있습니다. 이러한 제한사항에는 다음이 포함될 수 있습니다.

  • 일반 텍스트 추출에 대한 단어 순서가 정확하지 않습니다.
  • 텍스트 및 html 형식의 추출된 컨텐츠는 텍스트를 다른 단어 순서로 표시합니다.
  • 텍스트에 구두점 및 줄 바꾸기가 잘못 배치되었습니다.
  • 단어 내의 텍스트 순서는 콜렉션 설정에 따라 반전됩니다.
  • 페이지에 일반 텍스트 및 이미지 텍스트가 포함된 경우 누락된 텍스트, 잘못 정렬된 텍스트 또는 둘 다 발생할 수 있습니다.
엔티티 추출기에 대한 레이블 지정된 데이터 내보내기

훈련 또는 대형 언어 모델 (LLM) 을 빌드하기 위해 엔티티 추출기에 대해 레이블 지정된 데이터를 내보낼 수 있습니다. 자세한 정보는 엔티티 추출기의 레이블 지정된 데이터 익스포트 를 참조하십시오.

문서에서 엔티티 예제로 레이블을 지정할 용어를 찾으십시오.

이제 문서에서 엔티티 예제로 레이블을 지정할 용어를 검색할 수 있습니다. 또한 레이블이 지정된 엔티티 예제와 레이블이 지정되지 않은 엔티티 예제를 찾아 모든 레이블 지정 불일치를 정정할 수 있습니다. 자세한 정보는 키워드를 사용하여 예제 검색 을 참조하십시오.

선택한 모델로 문서에 어노테이션을 작성하는 외부 인리치먼트 기능입니다.

웹훅 인터페이스를 통해 사용자 정의 모델 또는 고급 기반 모델 및 기타 써드파티 모델을 사용하여 콜렉션에서 문서를 강화할 수 있습니다. 자세한 정보는 외부 인리치먼트 API 를 참조하십시오.

Part of Speech 인리치먼트는 더 이상 컨텐츠 마이닝 이외의 프로젝트 유형에 사용할 수 없습니다.

Part of Speech 인리치먼트는 사전 제안에 사용되었습니다. 그러나 사전 제안이 업데이트되었으며 이제 Part of Speech 인리치먼트를 적용하지 않고도 작동할 수 있습니다. Content Mining 프로젝트의 경우 Part of Speech 인리치먼트를 이전과 같이 사용할 수 있습니다.

2023년 9월 21 일

모든 언어에 대한 토크텐XX_ENCODE_CASE_CAPS_LOCK_ON 싱글정 (tokenizer) 업데이트

업데이트된 토큰화 프로그램은 특정 쿼리에 대한 결과의 순위 지정 순서에 영향을 줄 수 있습니다. 쿼리 결과에서 순위 차이가 관찰되면 콜렉션의 문서를 다시 인덱싱할 수 있습니다. 검색은 데이터를 수집하고 인덱스에 저장할 때와 사용자가 제출한 쿼리를 분석할 때 런타임 시 단어를 토큰화합니다. 콜렉션을 다시 인덱싱하여 일치하는 쿼리에 사용되는 동일한 토크나이저를 사용하여 문서가 인덱스화되었는지 확인합니다.

문서를 다시 색인화하려면 콜렉션 관리 페이지를 열고 콜렉션을 선택한 후 인리치먼트 탭으로 이동하십시오. 강화할 필드를 선택한 후 필드를 지우십시오. 그런 다음 변경사항 적용 및 다시 처리 를 클릭하고 콜렉션의 문서가 다시 처리될 때까지 기다리십시오.

2023년 8월 15 일

크롤링 스케줄을 적용하거나 제거하는 옵션
이 옵션은 크롤링 스케줄을 쉽게 적용하거나 제거하고 크롤링을 중지하는 데도 유용합니다. 자세한 정보는 스케줄 옵션 크롤링 을 참조하십시오.

2023년 8월 9 일

이제 UI에서 데이터를 조회할 때 컨텐츠를 추출할 필드를 지정할 수 있습니다.
필드를 지정하는 기능을 사용하면 컨텐츠가 기본 필드에서 색인화되지 않을 때 검색 결과를 개선할 수 있습니다. 구조화된 파일을 수집하거나 Smart Document Understanding 모델을 적용할 때 컨텐츠가 기본 필드에서 색인화되지 않을 수 있습니다. 자세한 정보는 사용 불가능한 Excerpt 를 참조하십시오.
PDF에 대한 고급 문서 보기의 인리치먼트가 구별되는 색상으로 강조표시됩니다.
PDF의 고급 문서 보기에서 여러 인리치먼트를 선택하면 각 인리치먼트 유형이 문서에서 고유한 색상으로 강조표시됩니다. 겹치는 인리치먼트도 고유한 색상으로 강조표시됩니다.

2023년 7월 26 일

이제 크롤링 스케줄에 대한 사용자 정의 날짜 및 시간을 지정할 수 있습니다.
이 옵션은 업무 시간 중에 대상 시스템에 과부하가 걸리지 않도록 하려는 경우에 유용합니다. 자세한 정보는 스케줄 옵션 크롤링 을 참조하십시오.

2023년 6월 10 일

모든 엔티티 인리치먼트는 엔티티 v2 유형 시스템을 사용합니다.
Natural Language Understanding 엔티티 v1 은 더 이상 지원되지 않습니다. IBM Cloud 인스턴스는 2021년 6월 2일이전에 작성되었으며 Discovery for IBM Cloud Pak for Data 2.x 배치에서는 영어 및 한국어 콜렉션에 대해 Natural Language Understanding 엔티티 유형 시스템의 버전 1을 사용했습니다. 이제 모든 콜렉션은 Natural Language Understanding 엔티티 유형 시스템의 버전 2만 사용합니다.
클래스류가 보다 명확하게 식별됨
강화 페이지에는 텍스트 분류자 또는 문서 분류자 인리치먼트로 분류자가 나열됩니다.

2023년 5월 16 일

SDU (Smart Document Understanding) 사용자 훈련 모델 작성을 위한 개선된 도구
사용자 훈련 SDU 모델을 작성할 때 문서에 어노테이션을 작성하는 데 사용하는 SDU 도구는 이제 React UI 프레임워크를 사용합니다. 이 업데이트는 도구의 동작을 변경하지는-적습니다는세요는 완료합, 이것가 적은 반응을 만듭니다.
이제 콜렉션 API를 사용하여 JSON 정규화를 정의할 수 있습니다.
콜렉션 작성콜렉션 업데이트 메소드는 이제 콜렉션의 문서에 정규화 조작을 적용하기 위해 지정할 수 있는 conversionsnormalizations 오브젝트의 추가를 지원합니다. 예를 들어, 문서의 JSON 표시에서 한 필드를 다른 필드로 복사하거나 병합하는 조작을 정의할 수 있습니다. conversions 오브젝트는 수집 중에 발생하는 정규화 조작을 정의하고 normalizations 오브젝트는 인리치먼트가 적용된 후에 발생하는 정규화 조작을 정의합니다. 자세한 정보는 콜렉션 API 참조를 참조하십시오.

2023년 3월 31일

API 버전으로 업데이트

현재 API 버전 (v2) 은 이제 2023-03-31입니다. 이 버전에서는 한 가지 변경 사항이 있습니다.

document_id 필드의 처리 방식 확인습니다.

document_id 라는 필드를 포함하는 JSON 파일을 콜렉션에 추가하는 경우 필드가 무시됩니다. 시스템은 문서가 인덱스에 추가될 때 문서에 새 고유 문서 ID를 지정합니다. 문서 ID를 파일 유형에 관계없이 문서에 지정하려면 API에서 문서 업데이트 메소드를 사용하십시오.

Previously, when you uploaded a JSON file with a field named document_id from the product user interface or by using the Add document API method, the document ID from the file was shown as the document_id value in query results. However, a different document ID was assigned to the document, and the assigned ID had to be used for certain other tasks, such as deleting the document. If your application relies on the previous behavior, specify a version number earlier than 2023-03-31, such as 2020-08-30, in your API calls.

2023년 3월 2 일

이제 콜렉션에 추가할 파일 유형을 지정할 수 있습니다.
외부 데이터 소스에 연결할 때 외부 데이터 소스에서 콜렉션에 추가할 파일 유형을 제한할 수 있습니다. 예를 들어, Box 데이터 소스에서 PDF 파일만 추가하도록 선택할 수 있습니다.

2023년 2월 21일

광학 문자 인식 v2 기술이 사용됩니다.

모든 IBM Cloud 서비스 플랜에서 영어, 독일어, 프랑스어, 스페인어, 네덜란드어, 브라질 포르투갈어 및 히브리어 콜렉션에 대해 OCR을 사용으로 설정하면 최신 버전 (OCR v2) 이 자동으로 사용됩니다.

새 광학 문자 인식 모델은 IBM Research에서 다음과 같은 제한사항이 있는 스캔된 문서 및 기타 이미지에서 텍스트를 추출하는 데 더 효과적으로 개발되었습니다.

  • 잘못된 스캐너 설정, 불충분한 해상도, 잘못된 조명 (예: 모바일 캡처), 초점 손실, 정렬되지 않은 페이지 및 잘못 인쇄된 문서로 인한 저품질 이미지
  • 불규칙한 글꼴 또는 다양한 색상, 글꼴 크기 및 배경을 갖는 문서
엔티티 추출기 한계가 변경되었습니다.

Plus 플랜의 훈련 데이터에서 허용되는 문서 수가 100에서 200으로 증가했습니다.

계획당 작성할 수 있는 엔티티 유형의 수가 감소되었습니다.

  • 프리미엄 플랜의 경우 한계가 75에서 18로 변경되었습니다.
  • 엔터프라이즈 플랜의 경우 한계가 50에서 18로 변경되었습니다.
  • Plus 플랜의 경우 한계가 20에서 12로 변경되었습니다.
문자열 변형 연산자가 이제 구문에 대해 작동합니다.

구문을 포함하는 조회 입력에 문자열 변형 연산자를 포함하면 구문의 각 단어에 변형이 적용됩니다. 예를 들어, "tom cat"~1tom cat 외에 top hat 와 일치합니다. Discovery Query Language 연산자에 대한 자세한 정보는 Query 연산자 를 참조하십시오.

10수수료 커리 2023년

엔티티 추출기가 일반적으로 사용 가능함

엔티티 추출 인리치먼트는 Discovery에 사용자 정의 유형 시스템을 빌드하는 강력한 기능을 제공합니다. 이 도구를 사용하여 산업 데이터 내의 엔티티 예제에 레이블을 지정하여 Discovery 가 비즈니스에 의미 있는 용어를 인식하는 데 사용할 수 있는 기계 학습 모델을 빌드하십시오. Knowledge Studio에서 이미 엔티티 유형 시스템을 빌드했습니까? Knowledge Studio 의 말뭉치를 Discovery 엔티티 추출기 훈련 데이터의 시작점으로 사용할 수 있습니다. 자세한 정보는 엔티티 추출기 를 참조하십시오.

기능이 베타 릴리스에 있을 때 테스트 목적으로 엔티티 추출기 인리치먼트를 작성한 경우 이제 일반적으로 사용 가능하므로 사용자 정의 모델 한계에 포함됩니다. 엔티티 추출기 인리치먼트는 콜렉션에 적용되는지 여부에 관계없이 비용을 발생시킵니다.

7 2월

시간별 크롤링에 대한 지원이 제거되었습니다.

더 이상 매시간 데이터 소스를 크롤링하도록 선택할 수 없습니다. 기존 콜렉션이 매시간 크롤링하도록 구성된 경우, 다음에 커넥터 설정을 편집할 때 스케줄된 크롤링을 변경하도록 프롬프트가 표시됩니다.

콜렉션에 대해 더 이상 FAQ 추출을 사용할 수 없습니다.

베타 FAQ 추출 기능을 사용 또는 사용 안함으로 설정하는 선택란이 제거되었습니다. FAQ 추출은 크롤링될 때 데이터 소스에서 질문과 응답 쌍을 캡처한 베타 기능입니다. FAQ 추출에서 각 쌍에 대해 새 하위 문서를 생성하고 title 필드에 질문을 저장하고 text 필드에 응답을 저장했습니다.

새 콜렉션에 FAQ 추출을 적용할 수 없습니다.

FAQ 추출이 사용 가능한 기존 콜렉션은 콜렉션이 재처리될 때까지 해당 인덱스에 FAQ 문서를 보유합니다. 이때 대부분의 질문과 응답 쌍 하위 문서가 삭제됩니다. 그러나 HTML 또는 TXT 소스 파일에서 생성된 FAQ 하위 문서는 그대로 남아 있습니다. 이 하위 문서를 제거하려면 데이터 관리 페이지로 이동하여 삭제하십시오. 하나의 상위 문서에서 생성된 하위 문서는 모두 동일한 metadata.parent_document_id 값을 갖습니다.

질문 및 응답에 대해 일관된 스타일 및 형식을 사용하는 소스 문서에서 질문 및 응답 쌍을 추출하는 방법이 필요한 경우, 대신 Smart Document Understanding 도구를 사용하여 쌍에 어노테이션을 작성할 수 있습니다. 자세한 정보는 Smart Document Understanding 사용 을 참조하십시오.

2023년 1월 25 일

읽기 권한이 있는 Microsoft SharePoint Online 데이터 저장소 커넥터 설정

Open Authentication v2를 사용하여 SharePoint 데이터 소스를 크롤링하기 위해 Microsoft SharePoint Online 커넥터를 작성하는 경우, 연결을 작성하기 위해 Discovery에서 작성되는 엔터프라이즈 애플리케이션에는 읽기 권한만 필요합니다. 이전에 사용자에 대해 구성된 엔터프라이즈 애플리케이션에는 쓰기 권한이 필요했습니다.

새 읽기 권한 구성을 사용할 수 있도록 기존 커넥터를 업데이트하려면 먼저 기존 엔터프라이즈 애플리케이션을 삭제해야 합니다.

자세한 정보는 Microsoft SharePoint Online 커넥터 를 참조하십시오.

FAQ 추출 더 이상 사용되지 않음 공지사항

문서에서 질문과 응답 쌍을 발견하고 추출하는 베타 FAQ 추출 기능이 제거되고 있습니다. 이 기능에 대한 지원은 1Q 2023에 종료됩니다.

2022년 12월 6일

이제 데이터 소스 크롤링을 중지할 수 있습니다.
진행 중이거나 나중에 발생하도록 스케줄된 크롤링을 중지할 수 있습니다. 자세한 정보는 크롤링 중지 를 참조하십시오.

다음 항목은 알려진 문제입니다.

Box 데이터 소스 스케줄된 크롤링이 문서를 업데이트하지 않음
Box 이벤트 API의 문제점으로 인해 Box에 저장된 문서의 크롤링 사이에 발생하는 변경사항은 스케줄된 재크롤링 중에 발견 콜렉션에서 발견되지 않고 선택되지 않습니다. 콜렉션이 최신 상태인지 확인하려면 크롤링을 중지한 후 다시 시작하십시오.

2022년 12월 1일

Plus 플랜은 더 적은 수의 엔티티 추출기를 지원합니다
Plus 플랜으로 작성할 수 있는 최대 엔티티 추출기 수가 6에서 3으로 감소했습니다.

2022년 11월 12일

11월 1일부터 11월 11일사이에 추가되거나 처리된 OCR이 사용 가능한 콜렉션의 문서에 대한 문제가 감지 사용자에게 발생할 수 있습니다.

2022년 11월 1일에서 11월 11일사이에 계약 프로젝트에 대한 문서 검색을 포함하여 OCR (Optical Character Recognition) 이 사용 가능한 일부 프로젝트에서 문제점이 발생했습니다. 문제점은 해당 시간 프레임 동안 영어, 독일어, 프랑스어, 스페인어, 네덜란드어, 포르투갈어 (브라질) 및 히브리어 콜렉션에 대해 자동으로 사용 가능하게 된 새 버전의 OCR v2기능과 관련되어 있습니다. 새 버전은 계약의 요소 식별 및 엔티티 추출기 도구의 문서 레이블 보기를 포함하여 다른 기능에 부정적인 영향을 줄 수 있는 방식으로 문장 경계를 변경합니다.

이 기간 동안 추가되거나 처리된 문서에서 이러한 문제가 발생하는 경우 문서에 적용되는 OCR 버전을 되돌리십시오. 2022년 11월 12일부터 OCR v1 이 OCR이 사용되는 모든 콜렉션에 적용됩니다. OCR v1사용으로 돌아가려면 영향을 받는 문서를 다시 처리하도록 변경하십시오. 예를 들어, 시간 프레임 동안 추가된 문서를 다시 추가하여 다시 처리할 수 있습니다. 또는 전체 콜렉션을 재처리할 수 있습니다.

콜렉션을 다시 처리하려면 콜렉션 관리 페이지에서 콜렉션을 연 다음 처리 설정 탭으로 이동하십시오. 추가 처리 설정 섹션을 펼치고 OCR 스위치를 Off 로 설정한 후 다시 On 으로 설정하십시오. 변경사항 적용 및 다시 처리 를 클릭하여 콜렉션을 다시 처리하십시오.

2022년 11월 2일

새롭고 향상된 광학 문자 인식 기술을 사용할 수 있습니다.

이제 광학 문자 인식 기술의 새 버전을 사용할 수 있습니다. 이 최신 버전 (OCR v2) 은 모든 IBM Cloud 서비스 플랜에서 영어, 독일어, 프랑스어, 스페인어, 네덜란드어, 브라질 포르투갈어 및 히브리어 콜렉션에 대해 OCR을 사용으로 설정할 때 자동으로 사용됩니다. 새 광학 문자 인식 모델은 IBM Research에서 다음과 같은 제한사항이 있는 스캔된 문서 및 기타 이미지에서 텍스트를 추출하는 데 더 효과적으로 개발되었습니다.

  • 잘못된 스캐너 설정, 불충분한 해상도, 잘못된 조명 (예: 모바일 캡처), 초점 손실, 정렬되지 않은 페이지 및 잘못 인쇄된 문서로 인한 저품질 이미지
  • 불규칙한 글꼴 또는 다양한 색상, 글꼴 크기 및 배경을 갖는 문서

2022년 11월 1일

엔티티 추출기가 훈련 데이터 문서에서 처음 40 ,000개의 문자를 로드합니다.
사용자 정의 엔티티 예제를 정의하는 데 사용하는 콜렉션의 추가 긴 문서도 도구의 문서 보기에 로드됩니다. 그러나 처음 40 ,000자 (약 15-20페이지) 만 표시됩니다. 파일 컨텐츠의 나머지 부분은 잘립니다. 문서 보기에 알림이 표시되어 문서가 잘리는지 알 수 있습니다. 자세한 정보는 엔티티 추출기 를 참조하십시오.
문서당 단락 수 설정을 1보다 높게 설정할 수 있습니다.
제품 사용자 인터페이스에서 검색 표시줄 설정을 사용하여 문서당 리턴할 최대 단락 수를 늘리지 못하도록 하는 버그가 수정되었습니다. 자세한 정보는 단락이 파생되는 방법 을 참조하십시오.
향상된 쿼리 집계 문서
쿼리 집계 매개변수에 지정할 수 있는 집계 유형을 설명하는 문서가 업데이트되었습니다. 자세한 정보는 쿼리 집계 를 참조하십시오.

2022년 9월 30일

런던 데이터 센터에서 라이트 플랜을 더 이상 사용할 수 없음
Lite 플랜은 더 이상 사용되지 않습니다. 런던을 포함한 모든 위치에서 라이트 플랜 유형을 사용하는 서비스 인스턴스를 작성할 수 없습니다. 새 Plus 플랜 및 연관된 30일무료 평가판을 사용하여 제품의 최신 버전에서 사용 가능한 새 기능 및 더 간단한 빌드 방법을 탐색하십시오.

2022년 9월 22일

Plus 플랜은 더 많은 엔티티 추출기를 지원합니다.
Plus 플랜으로 작성할 수 있는 최대 엔티티 추출기 수가 3에서 6으로 증가했습니다.
Smart Document Understanding 모델을 Microsoft Excel 파일에 적용할 수 없습니다.
Excel 파일에 대해 생성할 수 있는 구조적 분석의 품질이 충분하지 않습니다. 2022년 9월 22일부터 Excel 파일에 SDU 모델을 적용할 수 없습니다. 이 변경사항은 2022년 9월 22일이전에 SDU 모델이 적용된 콜렉션의 Excel 파일에 영향을 주지 않습니다.

2022년 9월 16일

컨텍스트 내 문서 미리보기가 이제 크롤링되는 PDF 파일에 사용 가능함
PDF 문서에서 추출된 검색 결과에서 단락을 보기 위해 누르면 원래 PDF 페이지의 컨텍스트에서 리턴된 단락을 표시하는 문서 미리보기 페이지가 표시됩니다. 컨텍스트 내 보기는 Smart Document Understanding 모델이 적용되는 PDF 파일에 사용할 수 있습니다.

2022년 8월 15일

최신 API 변경사항을 반영하도록 SDK가 업데이트되었습니다.

다음 Discovery v2 API 변경사항이 이제 SDK에 반영됩니다.

  • Use the new document classifier API to get, add, update, or delete a document classifier.

  • A new document status API is available. You can use it to get a list of the documents in a collection and to get details about a single document.

  • You can now get, add, and remove a stop words or expansion list for a collection.

  • A smart_document_understanding field is returned with the Get collection method. This new field specifies whether an SDU model is enabled for the collection and indicates the model type.

  • A similar parameter is available from the Query method. Use it to find documents that are similar to documents of interest to you.

  • The suggested_refinements parameter of the Query method is deprecated. The suggested_refinements parameter was used to identify dynamic facets from Premium plan data.

2022년 8월 8 일

더 큰 문서를 크롤링할 수 있음
크롤링된 문서에 허용되는 최대 파일 크기가 Premium 플랜에서 증가했습니다. 또한 Box, IBM Cloud Object Storage, Salesforce 커넥터의 사용량도 증가했습니다. 자세한 정보는 파일 크기 한계 를 참조하십시오.

2022년 8월 2입니다.

IBM Cloud Object Storage 커넥터에 IAM 인증 지원 추가
이제 IAM( IBM Cloud Identity and Access Management ) 서비스를 통해 인증할 수 있습니다. 자세한 내용은 IBM Cloud Object Storage.

2022년 7월 28일

API 업데이트

Discovery v2 API에 다음과 같은 변경사항이 작성되었습니다.

새 필드를 사용할 수 있습니다.

  • smart_document_understanding 필드는 Get collection 메소드와 함께 리턴됩니다. 이 새 필드는 SDU 모델이 콜렉션에 사용 가능한지 여부를 지정하고 모델 유형을 표시합니다.
  • similar 매개변수는 Query 메소드에서 사용 가능합니다. 이를 사용하여 관심있는 문서와 유사한 문서를 찾으십시오.

Query 메소드의 suggested_refinements 매개변수는 더 이상 사용되지 않습니다. suggested_refinements 매개변수는 프리미엄 플랜 데이터에서 동적 패싯을 식별하는 데 사용되었습니다.

감지 v1 더 이상 사용되지 않음 공지사항

Watson Discovery v1 은 더 이상 사용되지 않습니다. Watson Discovery v1 을 사용하는 기존 클라이언트는 지원 종료 날짜 7월 11일 2023 전에 Watson Discovery v2 로 마이그레이션하도록 요청됩니다. 지원 종료는 v1 인스턴스가 2023년 7월 11일 이후에 작동하지 않음을 의미합니다. 마이그레이션에 대한 자세한 정보는 감지에서 최대한 활용 을 참조하십시오.

2022년 7월 11일

고급 문서 보기는 더 많은 인리치먼트를 강조표시합니다.

Watson Natural Language Processing 모델에서 인식하는 내장 엔티티키워드 인리치먼트 외에, 이제 고급 문서 보기에서 다음 인리치먼트 유형을 강조표시합니다.

  • 사용자 정의 사전 용어
  • 사용자가 정의하는 정규식 패턴과 일치하는 용어 또는 숫자
  • Watson Knowledge Studio 기계 학습 및 규칙 기반 모델에 의해 정의되는 사용자 정의 엔티티 및 관계
  • 베타 기능으로 사용 가능한 엔티티 추출기 도구를 사용하여 정의된 사용자 정의 엔티티

문서에 추가할 수 있는 인리치먼트에 대한 자세한 정보는 도메인 특정 리소스 추가 를 참조하십시오.

2022년 6월 30일

Watson SDK 지원 변경

다음 SDK에 대한 지원은 IBM대신 개발자의 Watson 커뮤니티에서 제공됩니다.

  • 검색
  • Ruby
  • Swift
  • 유니티

자세한 정보는 Watson SDK 를 참조하십시오.

2022년 6월 1일

이제 엔티티 추출기 도구를 사용하기가 더 쉽습니다.
엔티티 유형 추가 및 해당 예제 레이블 지정 워크플로우를 더 잘 지원하도록 사용자 인터페이스가 다시 디자인되었습니다. 새 디자인의 일부로, 이제 대량 레이블 지정 기능이 기본적으로 사용으로 설정되고, 문서 보기를 찾고 사용하기가 더 쉽고, 제안 분할창이 더 반응적이며, 여러 훈련 실행에서 메트릭 점수를 추적할 수 있습니다. 엔티티 추출기에 대한 자세한 정보는 Discovery에서 인식할 수 있는 용어 사용자 정의 를 참조하십시오.
이제 엔티티 추출기를 추가 계획 및 언어로 사용할 수 있습니다.
이제 프리미엄 플랜 외에도 Plus및 Enterprise 플랜의 사용자가 엔티티 추출기 베타 기능을 사용할 수 있습니다. 추출기 인리치먼트는 영어 이외의 언어로 된 콜렉션에 대해 지원됩니다.
웹 크롤링 커넥터에서 시작 URL 를 제거하면, 관련된 문서들이 삭제됩니다
웹 크롤링 커넥터가 업데이트되었습니다. 2022년 4월 이후에 생성하는 컬렉션부터 시작해, 웹 크롤링 구성에서 시작 URL 를 제거하면, 해당 URL 의 웹 페이지 콘텐츠에서 파생된 색인된 문서가 다음 크롤링에서 삭제됩니다. 자세한 정보는 웹 크롤링 을 참조하십시오.

2022년 5월 16일

검색 엔진에서 제외되는 단어 및 확장 목록에 대한 작업을 수행하기 위한 API 메소드 추가
이제 콜렉션에 대한 검색 엔진에서 제외되는 단어 또는 확장 목록을 프로그래밍 방식으로 가져오고, 추가하고, 제거할 수 있습니다. 자세한 정보는 조회 수정 메소드를 참조하십시오.

2022년 5월 13일

개선된 JSON 보기를 사용할 수 있습니다.
이제 키보드 키를 사용하여 보기의 요소를 탭할 수 있습니다. 새 JSON 보기는 각 JSON 오브젝트에서 요소의 발생 횟수를 계산하므로 정보를 쉽게 추적하고 총계를 한 눈에 읽을 수 있습니다.

2022년 4월 20일

엔터프라이즈 플랜 배치에서는 분석 API가 지원됩니다.

분석 API를 사용하여 콜렉션의 구성 설정에 따라 JSON 파일을 처리한 후 콜렉션에 저장하지 않고 실시간으로 사용할 수 있도록 파일을 리턴하십시오. Analyze API는 이전에 설치된 배치에서만 지원되었습니다. 자세한 정보는 분석 API를 참조하십시오.

새 문서 상태 API를 사용할 수 있습니다.

새 문서 상태 API를 사용하여 콜렉션에 있는 문서 목록을 프로그래밍 방식으로 가져오고 단일 문서에 대한 세부사항을 얻을 수 있습니다. 이 릴리스에는 다음 참고 사항이 적용됩니다:

  • API는 2022년 3월 23일 이후에 작성되는 콜렉션에 대해 지원됩니다.

    이전에 만든 컬렉션에 대한 상태 정보를 얻으려면 문서에서 수집 변환 단계를 실행하는 프로세스를 트리거하세요. 예를 들어, 필드 식별, 필드 관리, CSV 설정또는 처리 설정 (예: OCR 또는 FAQ 추출 설정) 페이지에서 변경하거나 이전 콜렉션에 Smart Document Understanding 모델을 적용하여 API를 사용할 수 있습니다.

  • API는 Plus및 Enterprise 플랜 인스턴스에서만 사용 가능합니다.

새 API에 대한 자세한 정보는 API 참조 문서를 참조하십시오.

문서 처리 상태에 대한 정보를 계속해서 제공하기 위해 추가 메시지가 표시됩니다.

수집 프로세스 중에 문서 변환 및 인덱싱 상태에 대한 정보 메시지가 이전에 표시되지 않도록 하는 문제가 수정되었습니다. 이제 문제가 수정되었으므로 문서를 추가하거나 재처리할 때 평소보다 더 많은 메시지가 표시될 수 있습니다. 이 증가는 예상되는 것입니다. 메시지 증가의 원인이 되는 것은 없습니다.

2022년 4월 6일

프로젝트 타일에 보다 직관적인 메뉴가 있음
프로젝트 타일이 프로젝트 삭제 또는 이름 바꾸기와 같은 조치를 수행하는 데 사용할 수 있는 오버플로우 메뉴를 포함하도록 업데이트되었습니다.

2022년 3월 30일

새 문서 분류자 API 사용 가능

새 문서 분류자를 사용하여 문서 분류자를 프로그래밍 방식으로 가져오거나 추가하거나 업데이트하거나 삭제하십시오. 문서 분류 방법은 설치된 인스턴스( IBM Cloud Pak for Data ) 또는 IBM Cloud 에서 관리하는 프리미엄 또는 엔터프라이즈 플랜 인스턴스에서 지원됩니다.

새 API에 대한 자세한 정보는 API 참조 문서를 참조하십시오. 제품 사용자 인터페이스를 사용하여 문서 분류자를 추가하는 방법에 대한 자세한 정보는 문서 분류 를 참조하십시오.

2022년 3월 21일

문서에서 찾은 인리치먼트 시각화

검색 결과에서 단락을 보기 위해 누르면 검색 결과가 발견된 원래 문서의 표시를 보여주는 문서 미리보기 페이지가 표시됩니다. 대부분의 문서 유형의 경우 문서의 새 고급 보기 를 열어 문서에서 발견된 인리치먼트의 발생 수와 같은 유용한 요약 정보를 볼 수 있습니다. 또한 인리치먼트 중 하나를 선택하여 문서 텍스트 내에서 요소의 모든 발생을 강조표시할 수 있습니다.

현재 엔티티키워드 인리치먼트만 나열됩니다.

PDF 문서의 검색 결과 형식 개선

PDF 문서에서 추출된 검색 결과에서 단락을 보기 위해 누르면 원래 PDF 페이지의 컨텍스트에서 리턴된 단락을 표시하는 문서 미리보기 페이지가 표시됩니다.

컨텍스트 내 보기는 Smart Document Understanding 모델이 적용되는 PDF 파일에 사용할 수 있습니다. 리치 미리보기는 이미지에서 작동하지 않습니다. 즉, 스캔된 PDF 문서에서 작동하지 않습니다. 컨텍스트 내 보기는 모든 언어의 PDF에 사용할 수 있지만 일부 언어에서는 인리치먼트 강조표시가 잘못 정렬될 수 있습니다.

사용자 의견

제품 사용자 인터페이스의 페이지 헤더에서 피드백 공유 단추를 클릭하여 언제든지 의견 및 아이디어를 공유할 수 있습니다.

2022년 3월 10일

데이터 관리 페이지에서 콜렉션의 데이터 관리
이제 콜렉션 관리 탐색 분할창에서 콜렉션의 데이터 관리 페이지에 액세스할 수 있습니다. 콜렉션에 있는 문서 목록을 보고 문서에 대한 정보를 빠르게 보려면 여기로 이동하십시오. 몇 번의 클릭만으로 콜렉션에서 문서를 삭제할 수도 있습니다. 자세한 정보는 조회 결과에서 컨텐츠 제외 를 참조하십시오.

2022년 2월 15 일

Microsoft Sharepoint Online 커넥터에 대해 대체 인증 메커니즘을 사용할 수 있습니다.
이제 새 IBM Cloud 커넥터를 구성할 때 Open Authentication을 사용하여 Microsoft SharePoint 에 직접 로그인할 수 있습니다. 외부 데이터 소스를 인증하기 위해 Open Authentication을 사용하는 Microsoft를 사용하여 로그인 옵션은 베타 기능입니다. 자세한 정보는 Microsoft SharePoint Online 을 참조하십시오.

2022년 1월 7일

지원 없이 Plus에서 Enterprise로 업그레이드
Plus 플랜에서 엔터프라이즈 플랜으로 인플레이스 업그레이드를 수행할 수 있습니다. 자세한 정보는 업그레이드 를 참조하십시오.

2021년 12월 6일

동적 컨텐츠를 사용하여 웹 페이지 크롤링이 이제 일반적으로 사용 가능함
크롤링 중 JavaScript 실행 기능은 베타 기능으로 도입되었지만 이제 일반적으로 사용 가능합니다. 자세한 정보는 웹 크롤링 을 참조하십시오.
크롤링된 문서에서 SharePoint ACL 정보 캡처
이제 ACL 정보를 SharePoint 온라인 콜렉션에 추가된 문서에 메타데이터로 저장하도록 데이터 소스 크롤링을 구성할 수 있습니다. 자세한 정보는 Microsoft SharePoint Online 을 참조하십시오.
베타 엔티티 추출기 모델의 훈련 데이터에 더 많은 문서를 추가할 수 있습니다.
모델을 훈련하기 위해 20개의 문서를 추가하고 레이블을 지정했으며 이제 모델의 성능을 계속 개선하려는 경우 문서를 더 추가할 수 있습니다. 모델을 훈련하는 데 사용 중인 콜렉션에 추가 문서를 추가하십시오. 처음 20개문서에 레이블을 지정하고 모델이 변경사항으로 최신 상태가 된 후에 문서 레이블 지정을 계속하도록 선택할 수 있습니다. 콜렉션에 추가한 새 문서가 로드됩니다. 이를 레이블하여 훈련 데이터를 보강한 후 모델을 재훈련할 수 있습니다. 자세한 정보는 Discovery 에서 인식할 수 있는 용어 사용자 정의 를 참조하십시오.
로그아웃 Discovery
제품 사용자 인터페이스의 페이지 헤더에서 사용 가능한 사용자 프로파일 메뉴에서 로그아웃 을 클릭하여 언제든지 Discovery 서비스 인스턴스에서 로그아웃할 수 있습니다.

2021년 11월 18일

이제 엔터프라이즈 플랜을 어디서든 사용할 수 있습니다.
엔터프라이즈 플랜은 모든 데이터 센터 위치에서 사용 가능합니다. 엔터프라이즈급 지원과 성능으로 Discovery 애플리케이션을 확장하고 보호하며, 계약 분석 및 콘텐츠 마이닝을 비롯한 더 많은 사용 사례를 해결하여 문서 전반에서 인사이트를 탐색하세요. 자세한 정보는 Discovery 가격 플랜을 참고하십시오.

2021년 11월 11일

엔터프라이즈 플랜의 새 위치를 사용할 수 있습니다.
엔터프라이즈 플랜은 댈러스 위치 외에 프랑크푸르트, 런던, 시드니 및 도쿄 위치에서 사용할 수 있습니다.

2021년 11월 3일

새 엔터프라이즈 플랜
엔터프라이즈급 지원과 성능으로 Discovery 애플리케이션을 확장하고 보호하며 계약서 분석 및 콘텐츠 마이닝을 통해 문서 전반에서 인사이트를 탐색하는 등 더 많은 사용 사례를 해결하세요. 현재 엔터프라이즈 플랜은 댈러스 위치에서만 사용 가능합니다. 자세한 정보는 Discovery 가격 플랜을 참고하십시오.
새 베타 엔티티 추출기 인리치먼트
엔티티 추출 인리치먼트는 Discovery에 사용자 정의 유형 시스템을 빌드하는 강력한 기능을 제공합니다. 이 도구를 사용하여 산업 데이터 내의 엔티티 예제에 레이블을 지정하여 Discovery 가 비즈니스에 의미 있는 용어를 인식하는 데 사용할 수 있는 기계 학습 모델을 빌드하십시오. 현재 이 베타 기능은 프리미엄 플랜 서비스 인스턴스에서 작성된 영어 프로젝트에만 사용할 수 있습니다. 자세한 정보는 Discovery 에서 인식할 수 있는 용어 사용자 정의 를 참조하십시오.
유용한 링크
홈 페이지에는 문서, 커뮤니티 사이트 및 기타 자원에 대한 빠른 링크가 있는 유용한 링크 탭이 있습니다.
향상된 필드 선택 선택사항
필드에 인리치먼트를 적용하거나 패싯의 소스로 사용할 필드를 선택하는 경우, 이제 선택할 수 있도록 표시되는 필드에는 올바른 선택사항인 필드만 포함됩니다. 이전에는 목록에 유효하지 않은 선택사항인 필드가 포함되었습니다.

2021년 10월 14일

새 Discovery 홈 페이지
Discovery 를 시작하면 새 홈 페이지가 표시되며 제품 개요 비디오 및 둘러보기에 대한 빠른 액세스를 제공합니다. 홈 페이지 시작 배너를 접어 더 많은 프로젝트를 볼 수 있습니다.
새 플랜 사용 섹션
플랜 사용에 대한 정보를 계속 얻고 플랜 한계 및 사용 페이지에서 플랜 유형의 한계에 대한 사용을 확인하십시오. 제품 페이지 헤더에서 사용자 아이콘 사용자 아이콘 을 클릭하십시오. 사용법 섹션에는 간단한 요약이 표시됩니다. 모든 계획 한계 카테고리에 대한 사용 정보를 보려면 모두 보기 를 클릭하십시오.
검색에서 맞춤법 설정 변경
맞춤법 정정 설정이 새 프로젝트에서 자동으로 사용으로 설치 -합습니다에 새 프로젝트에서 기본적으로 사용 안함으로 설정됩니다. 사용자가 쿼리에서 용어의 철자를 잘못 입력했을 때 사용자에게 경보를 보내려면 맞춤법 제안을 켜십시오. 자세한 정보는 검색 표시줄 사용자 정의 를 참조하십시오.
둘러보기 안내 가용성 개선는가니다 있습니다.
이제 둘러보기 안내 단추를 제품 페이지 머리글에서 사용할 수 있으며, 이를 통해 어디서든 액세스할 수 있습니다. 이전에는 내 프로젝트 페이지에서만 사용 가능했습니다.

2021년 10월 1일

모든 위치에서 라이트 및 고급 플랜으로 변경
Lite및 고급 플랜은 더 이상 사용되지 않습니다. 댈러스, 프랑크푸르트, 런던, 시드니, 도쿄 및 워싱턴 DC 위치에서 라이트 또는 고급 플랜 유형을 사용하는 서비스 인스턴스를 작성할 수 없습니다. 기존 Lite및 고급 플랜은 계속해서 올바르게 작동하며 계속 지원됩니다. 라이트 요금제에서 고급 요금제로 업그레이드할 수 있습니다. 새 Plus 플랜 및 연관된 30일무료 평가판을 사용하여 제품의 최신 버전에서 사용 가능한 새 기능 및 더 간단한 빌드 방법을 탐색하십시오.

2021년 9월 24일

NLU 인리치먼트에 대한 새 스코어링
검색에서 리턴되는 NLU 인리치먼트에 대한 관련성 및 신뢰도 점수가 표시됩니다. 예를 들어, 조회 결과에서 문서 미리보기의 JSON 보기를 열면 엔티티 멘션에 대한 신뢰도 점수 및 키워드 멘션에 대한 관련성 점수를 볼 수 있습니다.

2021년 9월 9일

Plus 플랜의 새 위치
이제 Plus 플랜을 시드니 위치에서 사용할 수 있습니다. 새 Plus 플랜 및 연관된 30일무료 평가판을 사용하여 제품의 최신 버전에서 사용 가능한 새 기능 및 더 간단한 빌드 방법을 탐색하십시오. 자세한 정보는 Discovery 를 참조하십시오.
대부분의 위치에서 Lite및 고급 플랜으로 변경
Lite및 고급 플랜은 더 이상 사용되지 않습니다. 댈러스, 프랑크푸르트, 런던, 시드니, 도쿄 또는 워싱턴 DC 위치에서 라이트 또는 고급 플랜 유형을 사용하는 서비스 인스턴스를 작성할 수 없습니다. 기존 Lite및 고급 플랜은 계속해서 올바르게 작동하며 계속 지원됩니다. 라이트 요금제에서 고급 요금제로 업그레이드할 수 있습니다.

2021년 8월 26일

Plus 플랜의 새 위치
이제 Plus 플랜은 댈러스, 프랑크푸르트 및 도쿄 외에 런던 및 워싱턴 DC 위치에서 사용 가능합니다.
일부 위치에서 Lite및 고급 플랜으로 변경
댈러스, 프랑크푸르트, 런던, 도쿄 또는 워싱턴 DC 위치에서 라이트 또는 고급 플랜 유형을 사용하는 서비스 인스턴스를 작성할 수 없습니다. 기존 Lite및 고급 플랜은 계속해서 올바르게 작동하며 계속 지원됩니다. 라이트 요금제에서 고급 요금제로 업그레이드할 수 있습니다.
새 응답 찾기 기능
이제 일반적으로 관리 배치에 응답 결과를 사용할 수 있습니다. 질문에 대한 간결한 응답을 리턴하려면 응답 찾기를 사용하십시오. 자세한 정보는 응답 찾기 를 참조하십시오.

2021년 8월 16일

Plus 플랜의 새 위치
이제 댈러스 외에 프랑크푸르트 및 도쿄 지역에서 Plus 플랜을 사용할 수 있습니다.
일부 위치에서 Lite및 고급 플랜으로 변경
Lite및 고급 플랜은 더 이상 제공되지 않습니다. 댈러스, 프랑크푸르트 또는 도쿄 위치에서 라이트 또는 고급 플랜 유형을 사용하는 서비스 인스턴스를 작성할 수 없습니다. 기존 Lite및 고급 플랜은 계속해서 올바르게 작동하며 계속 지원됩니다. 라이트 요금제에서 고급 요금제로 업그레이드할 수 있습니다.

2021년 7월 27일

향상된 문서 크기 한계
문서 크기 한계가 증가되었습니다. 프리미엄 플랜 콜렉션의 경우 이제 32MB대신 최대 50MB크기의 파일을 업로드할 수 있습니다. 자세한 정보는 문서 한계 를 참조하십시오.

2021년 7월 23일

향상된 SharePoint 온라인 커넥터
Microsoft SharePoint Online 데이터 소스 커넥터는 이제 유효한 Azure Active Directory 사용자 ID 구문을 허용합니다. 사용자 ID의 형식은 <admin_user>@.onmicrosoft.com 구문과 일치할 필요가 없습니다. 자세한 정보는 Microsoft SharePoint Online 을 참조하십시오.

2021년 7월 16일

새 베타 동적 웹 사이트 웹 크롤링
이제 웹 크롤러는 JavaScript 을 사용하여 콘텐츠를 렌더링하는 동적 웹사이트를 크롤링할 수 있습니다. 이 베타 기능을 사용하면 사이트를 크롤링하는 데 걸리는 시간이 늘어납니다. 자세한 정보는 웹 크롤링 을 참조하십시오.

2021년 6월 23일

새 Plus 플랜
새 Plus 플랜 및 연관된 30일무료 평가판을 사용하여 제품의 최신 버전에서 사용 가능한 새 기능 및 더 간단한 빌드 방법을 탐색하십시오. 현재 Plus 플랜은 댈러스 위치에서 사용 가능합니다. 자세한 정보는 Discovery 를 참조하십시오.
Lite및 고급 플랜으로 변경
Lite및 고급 플랜은 더 이상 제공되지 않습니다. 댈러스 위치에서 라이트 또는 고급 플랜 유형을 사용하는 서비스 인스턴스를 작성할 수 없습니다. 기존 Lite및 고급 플랜은 계속해서 올바르게 작동하며 계속 지원됩니다. 라이트 요금제에서 고급 요금제로 업그레이드할 수 있습니다.

엔드포인트 더 이상 사용되지 않음 리마인더

Discovery API 엔드포인트로 변경

Identity and Access Management (IAM) 인증을 완전히 지원하기 위해 수행되는 작업의 일부로 Discovery 서비스에 액세스하는 데 사용하는 엔드포인트가 프로그래밍 방식으로 변경됩니다. 이전 엔드포인트 URL은 더 이상 사용되지 않으며 2021년 5월 26일에 폐기될 예정입니다. 새 URL을 사용하도록 API 호출을 업데이트하십시오.

종료점의 패턴이 URL 에서 gateway-{location}.watsonplatform.net/discovery/api/ 에서 api.{location}.discovery.watson.cloud.ibm.com/ 로 변경되었습니다. 새 엔드포인트에서 도메인, 위치 및 오퍼링 ID는 다릅니다. 더 자세한 정보는 watsonplatform.net 에서 엔드포인트 URL 업데이트하기를 참고하세요.

서비스 인스턴스 API 자격 증명이 이전 엔드포인트를 사용하는 경우 새 자격 증명을 만들어 지금 바로 사용하세요. 새 신임 정보를 사용하도록 사용자 정의 애플리케이션을 업데이트한 후 이전 버전을 삭제할 수 있습니다.

2021년 3월 19일

개선된 웹 크롤링 커넥터
웹 크롤링 콜렉션 유형을 사용하여 내부 회사 웹 사이트에 저장된 컨텐츠에 연결할 수 있습니다. 자세한 정보는 웹 크롤링 을 참조하십시오.

2021년 3월 4일

업로드 시 새 끌어서 놓기 기능
이제 업로드 콜렉션은 문서 업로드 전과 문서 업로드 중에 문서 끌어서 놓기를 지원합니다. 자세한 정보는 데이터 업로드 를 참조하십시오.

2020년 12월 17일

활동 탭의 개선된 날짜 및 시간 표시
이제 각 콜렉션은 콜렉션 관리 페이지의 활동 탭에 다음 동기화 스케줄 날짜 및 시간을 표시합니다.
새로운 베타 FAQ 추출
베타 기능 FAQ 추출이 릴리스되었습니다. FAQ 추출은 FAQ(자주 묻는 질문) 문서 및 웹 페이지에서 질문과 답변 쌍을 자동으로 추출하여 애플리케이션에서 보다 정확한 답변을 리턴하도록 합니다. 자세한 정보는 FAQ 추출을 참조하십시오. 베타 기능에 대한 설명은 베타 기능을 참조하십시오.

2020년 12월 3일

새 Content Intelligence
이제 문서 검색 프로젝트를 만들 때 계약 강화 기능을 적용할 수 있습니다. 계약 강화는 문서 내에서 계약 기간, 당사자, 유효 날짜 등을 분류하는 데 사용할 수 있습니다. 자세한 정보는 계약에 대한 문서 검색 을 참조하십시오.

2020년 11월 10일

새 Box 커넥터
Box 시스템을 크롤링합니다. 자세한 정보는 Box를 참조하십시오.
새 SharePoint 2016온프레미스 커넥터
SharePoint 2016온프레미스 시스템을 크롤링합니다. 자세한 내용은 SharePoint 2016 온프레미스를 참조하세요.
Box 커넥터는 Safari에서 실행되지 않습니다
자세한 정보는 Box 커넥터 를 참조하십시오.
메타데이터 변환
metadata 속성이 인덱스에서 배열로 변환된 경우 레이블이 지정된 데이터 삭제 API 메서드를 사용하여 문서를 삭제할 수 없습니다. 자세한 정보는 API 참조를 확인하십시오.

2020년 10월 30일

보스니아어, 크로아티아어, 힌디어, 세르비아어에 대한 새로운 언어 지원
보스니아어, 크로아티아어, 힌디어 및 세르비아어에 대한 기본 언어 지원이 제공됩니다. 자세한 정보는 언어 지원을 참조하십시오.
새 베타 패턴 강화
패턴 강화 베타 릴리스는 패턴 유도를 사용하여 Discovery 데이터의 패턴을 인식하도록 가르치는 데 도움이 됩니다. 패턴 유도는 지정한 예제에서 추출 패턴을 생성합니다. 적은 수의 예제를 지정한 후 Discovery는 패턴을 완료하기 위해 확인하는 추가 규칙을 제안합니다. 패턴 유도를 강화로 사용하거나 패싯을 작성할 수 있습니다. 자세한 정보는 패턴패턴을 식별하여 패싯 작성 을 참조하십시오. 베타 기능에 대한 설명은 베타 기능을 참조하십시오.
문서 검색 프로젝트로 변경
문서 검색 프로젝트에서 suggested refinements 조회 설정은 이제 기본적으로 false로 설정됩니다. 이전에는 true로 설정되었습니다.

2020년 9월 14일

SDU에 대한 사전 훈련된 새 모델
문서 검색 프로젝트의 Smart Document Understanding에서 사전 훈련된 새로운 모델을 사용할 수 있습니다. 이 모델은 많은 수의 테이블이 포함된 문서에서 데이터를 추출해야 하는 경우 이상적입니다. 자세한 정보는 필드 식별을 참조하십시오.

2020년 8월 30일

API 버전으로 업데이트
현재 API 버전 (v2) 은 이제 30입니다. 이 버전에서는 다음 변경이 이뤄졌습니다.
'options' 오브젝트로 변경
List 인리치먼트 메소드는 더 이상 인리치먼트당 options 오브젝트를 리턴하지 않습니다. 단일 인리치먼트에 대해 options 오브젝트를 리턴하려면 인리치먼트 가져오기 메소드를 사용하십시오.

2020년 7월 16일

프리미엄 인스턴스의 새 릴리스
이 릴리스는 2020년 7월 16일 이후에 작성된 Discovery에서 IBM Cloud의 Premium 인스턴스에 사용할 수 있습니다. 해당 날짜 이전에 생성된 프리미엄 인스턴스와 모든 Lite 및 Advanced 플랜의 경우 Discovery 시작하기를 참조하세요.
IBM Cloud Premium 으로 변경하십시오.
이제 프리미엄 플랜을 일반적으로 사용할 수 있습니다.
새 프로젝트 기반 인터페이스
프로젝트 기반 UI에는 세 가지 일반적인 사용 사례에 최적화된 구성이 포함되어 있습니다: 문서 검색, 대화형 검색, 콘텐츠 마이닝입니다. 자세한 정보는 프로젝트 작성을 참조하십시오.
새 컨텐츠 마이닝 앱
Watson Discovery 의 완전히 새로운 기능을 사용하면 어떤 질문을 해야 할지 모를 때 데이터에서 인사이트를 찾을 수 있습니다. 강력한 상관 도구를 사용하면 대규모 비정형 데이터 세트에서 가치를 발휘할 수 있습니다. 자세한 내용은 컨텐츠 마이닝 애플리케이션을 사용하여 데이터 분석 을 참조하십시오.
새 테이블을 응답으로
텍스트 스니펫은 표에 있는 경우 도움이 되지 않으므로 Discovery 대신 표로 답변하는 것이 가장 좋은 질문인 경우 형식이 지정된 표를 답변으로 반환합니다. 자세한 정보는 테이블 검색을 참조하십시오.
새 동적 패싯된 검색 기능
지정되지 않은 조회는 일반적입니다. 동적 상세 검색에서는 검색 결과가 문장에서 사용되는 방식을 파악하여 훈련하지 않고도 검색 결과를 인텔리전스 패싯으로 자동 분류합니다. 문서 검색 프로젝트의 패싯을 참조하십시오.
재사용 가능한 새 컴포넌트
더 이상 스크래치에서 Discovery 애플리케이션을 빌드할 필요가 없습니다. 이제 재사용 가능한 개방형 소스의 React 컴포넌트를 바로 사용할 수 있게 제공합니다. Discovery 애플리케이션을 구성할 때 실제 구성 요소를 사용하게 됩니다. 여기에서 사용자 정의 Discovery 애플리케이션을 가져오기 위해 배치하기만 하면 됩니다. 컴포넌트 빌드 및 배치를 참조하십시오.
새 도메인 어휘 기능
사전 없이도 사용자를 위한 패싯을 구축할 수 있습니다. 도메인 어휘를 사용하여 데이터가 어떻게 사용되는지에 대한 이해를 바탕으로 5분 만에 강력한 패싯을 구축하세요. 패싯을 참조하십시오.
새로운 관련성 교육
프로젝트 레벨에서 훈련할 수 있습니다. Discovery 는 데이터 소스/콜렉션에 관계없이 최상의 응답을 순위 지정합니다. 훈련으로 결과 관련성 개선을 참조하십시오.
새 내장 맞춤법 교정기
Discovery 에는 맞춤법 제안이 내장되어 있습니다. 매개변수 설명 을 참조하십시오.
개선 않:운 자동 완성
Discovery 에는 검색을 위한 자동 완성(입력 미리 보기)과 최종 사용자에게 이 기능을 제공하기 위한 재사용 가능한 구성 요소가 포함되어 있습니다.
12개언어에 대한 새 지원
Discovery 에 대한 언어 지원은 이제 12개의 추가 언어로 사용 가능합니다. 전체 목록은 언어 지원을 참조하십시오.
Cloud Object Storage 커넥터 제한사항
IBM Cloud® Object Storage 데이터 소스에 연결할 때 지정된 신임 정보에 대한 처음 75개의 버킷만 표시됩니다.
현재 API 버전
API 버전 (v2) 은 2019-11-29 입니다.
이 릴리스의 기능 변경
이 릴리스에서는 중복 제거를 사용할 수 없습니다.
이상 항목 발견은 제공되지 않습니다.
IBM Watson® Discovery 뉴스가 더 이상 포함되지 않습니다.
현재 여러 Watson 자연어 이해 강화는 사용할 수 없습니다(엔티티 추출, 관계 추출, 키워드 추출, 카테고리 분류, 개념 태그 지정, 시맨틱 역할 추출, 감성 분석, 감정 분석).
SharePoint 2016 온프레미스 및 Box 데이터 원본은 현재 사용할 수 없습니다.