Excluindo conteúdo dos resultados da consulta
Evite conteúdos que você não deseja que os clientes vejam de serem incluídos nos resultados da consulta.
Você pode evitar que o conteúdo seja incluído na consulta resulta das seguintes formas:
-
Excluir uma coleção inteira.
Para obter mais informações, consulte Deleting collections.
-
Remova um campo do índice que contém dados que você não deseja compartilhar com os clientes.
É possível controlar quais campos estão indexados. Se você quiser evitar que um campo seja indexado, você pode configurá-lo para ser excluído. Por exemplo, se seus arquivos PDF contêm um cabeçalho de execução ou rodapé que não contém informações úteis, você pode excluir os campos
headerefooterdo índice.Para gerenciar os campos para indexar, complete as seguintes etapas:
-
A partir da pane de navegação, abra a página Gerenciar coleções e, em seguida, clique em uma coleção para abri-la.
-
Clique na guia Gerenciar campos.
É exibida uma lista dos campos identificados. Você pode ver quais campos estão incluídos no índice e quais não são.
-
Para remover um campo do índice, configure o switch Include para desligado.
-
-
Excluir um único documento.
Se você usar a ferramenta Smart Document Understanding para anotar um documento e, em seguida, decidir que deseja excluir o documento e suas anotações SDU associadas, deve-se remover as anotações antes de excluir o documento. Para remover as anotações, anotar o documento novamente. Desta vez, rotule todo o conteúdo como
text.Para excluir um documento, conclua as etapas a seguir:
-
A partir da pane de navegação, abra a página Gerenciar coleções e, em seguida, clique em uma coleção para abri-la.
-
Clique na guia Gerenciar dados.
É exibida uma lista de informações de cada documento da coleção. Se as informações exibidas não ajudá-lo a identificar o documento que você deseja excluir, você pode alterar o que é exibido.
- Clique no ícone Configurações no cabeçalho da tabela.
- Escolha campos a partir dos quais você deseja buscar dados para exibição na primeira e segunda colunas. Você pode escolher campos como
extracted_metadata.filenamepara mostrar o nome do arquivo do documento, oudocument_id, por exemplo.
Você pode página através dos documentos na coleta usando os controles no rodapé da tabela.
-
Depois de identificar o documento que deseja excluir, selecione a caixa de opção que está associada ao documento e, em seguida, clique em Excluir. Confirme a exclusão.
Os documentos que são adicionados a uma coleção a partir de uma fonte de dados externa serão adicionados de volta à coleta com o próximo crawl agendado da fonte de dados. A função delete remove o documento do índice da coleção, não da fonte de dados externa.
Alguns tipos de arquivos, como os arquivos CSV ou JSON, geram subdocumentos quando são adicionados a uma coleção. A divisão de um documento transforma um documento em diversos segmentos de documentos. Se você excluir um desses documentos gerados e, em seguida, repetir a ação que o criou, o documento excluído é adicionado de volta em sua coleção. Para excluir completamente o documento original, deve-se excluir o documento pai usando a API Excluir documento e remover o documento original da origem de dados submetida a crawl.
IBM Cloud Pak for Data IBM Cloud Pak for Data libera antes 4.6.5
A página Gerenciar dados não está disponível nas implementações instaladas antes da liberação 4.6.5.. Você deve usar a API Discovery para excluir um documento. E você deve saber o ID do documento do documento que deseja excluir. Para obter o ID do documento, use o método da API Lista de documentos.
Se o documento for um subdocumento de outro documento e você quiser remoti-lo, seu pai, e quaisquer outros subdocumentos que estejam associados ao pai, exclua o documento pai. Para obter o documento ID do documento pai, procure o campo
metadata.parent_document_idpara o documento. Ele é especificado na representação JSON do documento quando ele é retornado como resposta na página Improvar e customizar da interface do usuário do produto. -