조회 결과에서 컨텐츠 제외

고객이 보기를 원하지 않는 컨텐츠가 조회 결과에 포함되지 않도록 하십시오.

다음과 같은 방법으로 컨텐츠가 조회 결과에 포함되지 않도록 할 수 있습니다.

  • 전체 콜렉션을 삭제합니다.

    자세한 정보는 콜렉션 삭제 를 참조하십시오.

  • 고객과 공유하지 않을 데이터를 포함하는 색인에서 필드를 제거합니다.

    색인화되는 필드를 제어할 수 있습니다. 필드가 인덱싱되지 않도록 하려면 필드를 제외하도록 설정할 수 있습니다. 예를 들어, PDF 파일에 유용한 정보가 없는 실행 중인 머리글 또는 바닥글이 포함되어 있는 경우 색인에서 headerfooter 필드를 제외할 수 있습니다.

    색인화할 필드를 관리하려면 다음 단계를 완료하십시오.

    1. 탐색 분할창에서 콜렉션 관리 페이지를 열고 콜렉션을 클릭하여 여십시오.

    2. 필드 관리 탭을 클릭하십시오.

      식별된 필드 목록이 표시됩니다. 색인에 포함된 필드와 포함되지 않은 필드를 볼 수 있습니다.

    3. 색인에서 필드를 제거하려면 포함 스위치를 꺼짐으로 설정하십시오.

  • 단일 문서를 삭제합니다.

    Smart Document Understanding 도구를 사용하여 문서에 어노테이션을 작성한 후 문서 및 연관된 SDU 어노테이션을 삭제하려는 경우 문서를 삭제하기 전에 어노테이션을 제거해야 합니다. 어노테이션을 제거하려면 문서에 다시 어노테이션을 작성하십시오. 이번에는 모든 컨텐츠의 레이블을 text 로 지정하십시오.

    문서를 삭제하려면 다음 단계를 완료하십시오

    1. 탐색 분할창에서 콜렉션 관리 페이지를 열고 콜렉션을 클릭하여 여십시오.

    2. 데이터 관리 탭을 클릭합니다.

      콜렉션에 있는 각 문서의 정보 목록이 표시됩니다. 표시되는 정보가 삭제하려는 문서를 식별하는 데 도움이 되지 않으면 표시되는 내용을 변경할 수 있습니다.

      • 표 머리글의 설정 아이콘을 클릭합니다.
      • 첫 번째 및 두 번째 열에 표시할 데이터를 페치할 필드를 선택하십시오. 예를 들어, extracted_metadata.filename 와 같은 필드를 선택하여 문서 파일 이름을 표시하거나 document_id 을 선택할 수 있습니다.

      테이블 바닥글에 있는 제어를 사용하여 콜렉션의 문서를 페이지 이동할 수 있습니다.

    3. 삭제할 문서를 식별한 후 문서와 연관된 선택란을 선택하고 삭제를 클릭하십시오. 삭제를 확인하십시오.

      외부 데이터 소스에서 콜렉션에 추가된 문서는 데이터 소스의 다음 스케줄된 크롤링과 함께 콜렉션에 다시 추가됩니다. 삭제 기능은 외부 데이터 소스가 아닌 콜렉션의 인덱스에서 문서를 제거합니다.

      일부 파일 유형 (예: CSV 또는 JSON 파일) 은 콜렉션에 추가될 때 하위 문서를 생성합니다. 문서를 분할하면 하나의 문서가 여러 문서 세그먼트로 바뀝니다. 이러한 생성된 문서 중 하나를 삭제한 후 이를 작성한 조치를 반복하면 삭제된 문서가 콜렉션에 다시 추가됩니다. 원래 문서를 완전히 삭제하려면 문서 삭제 API를 사용하여 상위 문서를 삭제하고 크롤링된 데이터 소스에서 원래 문서를 제거해야 합니다.

    IBM Cloud Pak for Data IBM Cloud Pak for Data 출시 전 4.6.5

    4.6.5 릴리스 이전의 설치된 배치에서는 데이터 관리 페이지를 사용할 수 없습니다. 문서를 삭제하려면 발견 API 를 사용해야 합니다. 그리고 삭제하려는 문서의 문서 ID를 알아야 합니다. 문서 ID를 가져오려면 문서 나열 API 메소드를 사용하십시오.

    문서가 다른 문서의 하위 문서이고 해당 문서, 상위 문서 및 상위 문서와 연관된 다른 하위 문서를 제거하려면 상위 문서를 삭제하십시오. 상위 문서의 문서 ID를 가져오려면 문서의 metadata.parent_document_id 필드를 찾으십시오. 이는 제품 사용자 인터페이스의 개선 및 사용자 정의 페이지에서 응답으로 리턴될 때 문서의 JSON 표시에 지정됩니다.