Exclusion de contenu des résultats de requête
Empêchez le contenu que vous ne souhaitez pas que les clients voient d'être inclus dans les résultats de la requête.
Vous pouvez empêcher l'inclusion de contenu dans les résultats de requête des manières suivantes:
-
Supprimer une collection entière.
Pour plus d'informations, voir Suppression de collections.
-
Supprimez de l'index une zone qui contient des données que vous ne souhaitez pas partager avec les clients.
Vous pouvez contrôler les zones qui sont indexées. Si vous souhaitez empêcher l'indexation d'une zone, vous pouvez la définir pour qu'elle soit exclue. Par exemple, si vos fichiers PDF contiennent un en-tête ou un pied de page en cours d'exécution qui ne contient pas d'informations utiles, vous pouvez exclure les zones
headeretfooterde l'index.Pour gérer les zones à indexer, procédez comme suit:
-
Dans le panneau de navigation, ouvrez la page Gestion des collections, puis cliquez sur une collection pour l'ouvrir.
-
Cliquez sur l'onglet Manage fields.
Une liste des champs identifiés s'affiche. Vous pouvez voir les zones qui sont incluses dans l'index et celles qui ne le sont pas.
-
Pour supprimer une zone de l'index, désactivez l'option Inclure.
-
-
Supprimer un seul document.
Si vous utilisez l'outil Smart Document Understanding pour annoter un document, puis que vous décidez de supprimer le document et ses annotations SDU associées, vous devez supprimer les annotations avant de supprimer le document. Pour supprimer les annotations, annotez à nouveau le document. Cette fois, libellez tout le contenu en tant que
text.Pour supprimer un document, procédez comme suit :
-
Dans le panneau de navigation, ouvrez la page Gestion des collections, puis cliquez sur une collection pour l'ouvrir.
-
Cliquez sur l'onglet Gérer les données.
Une liste des informations de chaque document de la collection s'affiche. Si les informations affichées ne vous permettent pas d'identifier le document à supprimer, vous pouvez modifier ce qui s'affiche.
- Cliquez sur l'icône Paramètres dans l'en-tête du tableau.
- Choisissez les zones à partir desquelles vous souhaitez extraire les données à afficher dans les première et deuxième colonnes. Vous pouvez choisir des zones telles que
extracted_metadata.filenamepour afficher le nom du fichier de document, oudocument_id, par exemple.
Vous pouvez parcourir les documents de la collection à l'aide des commandes du pied de page de la table.
-
Après avoir identifié le document à supprimer, cochez la case associée au document, puis cliquez sur Supprimer. Confirmez la suppression.
Les documents qui sont ajoutés à une collection à partir d'une source de données externe seront ajoutés à nouveau à la collection lors de la prochaine exploration planifiée de la source de données. La fonction de suppression supprime le document de l'index de la collection, et non de la source de données externe.
Certains types de fichier, tels que les fichiers CSV ou JSON, génèrent des sous-documents lorsqu'ils sont ajoutés à une collection. Le fractionnement d'un document transforme un document en plusieurs segments de document. Si vous supprimez l'un de ces documents générés, puis répétez l'action qui l'a créé, le document supprimé est ajouté à votre collection. Pour supprimer complètement le document d'origine, vous devez supprimer le document parent à l'aide de l'API Supprimer le document et supprimer le document d'origine de la source de données explorée.
IBM Cloud Pak for Data IBM Cloud Pak for Data libère avant 4.6.5
La page Manage data n'est pas disponible dans les déploiements installés avant l'édition 4.6.5. Vous devez utiliser l'API de reconnaissance pour supprimer un document. Vous devez également connaître l'ID du document que vous souhaitez supprimer. Pour obtenir l'ID document, utilisez la méthode d'API List documents.
Si le document est un sous-document d'un autre document et que vous souhaitez le supprimer, son parent et tout autre sous-document associé au parent, supprimez le document parent. Pour obtenir l'ID document du document parent, recherchez la zone
metadata.parent_document_iddu document. Il est spécifié dans la représentation JSON du document lorsqu'il est renvoyé en tant que réponse dans la page Improve and customize de l'interface utilisateur du produit. -