Utiliser des modèles pour rechercher des termes
Reconnaissez les termes qui sont mentionnés dans les phrases qui correspondent à un modèle syntaxique que vous apprenez à reconnaître à Discovery.
IBM Cloud Patterns est une fonction bêta disponible uniquement dans les déploiements gérés. Cette fonction est disponible uniquement pour les documents en anglais.
Ajoutez une ressource Patterns pour apprendre à Discovery à reconnaître des patterns dans vos données. La fonction Motifs utilise l'induction de motif, qui génère des motifs d'extraction à partir d'exemples que vous fournissez en tant que données d'apprentissage. Après avoir spécifié quelques exemples, Discovery suggère d'autres règles que vous pouvez examiner et accepter pour compléter le modèle.
Les modèles produisent un modèle à l'aide d'un processus humain en boucle. Vous n'êtes pas invité à générer un grand ensemble de données d'entraînement à l'avance. Au lieu de cela, vous fournissez quelques exemples, puis vous participez à un processus interactif pour définir les données d'entraînement. Vous acceptez ou rejetez passivement les suggestions intelligentes proposées par le système.
La reconnaissance de modèle fonctionne de manière optimale sur du texte ayant une structure cohérente en termes de casse, de longueur, de texte ou de valeurs numériques. Exemples de modèles que vous pouvez apprendre à Discovery à identifier dans vos documents :
- Numéros standard, tels que
ISO 45001,ISO 22000. - Références de devise, telles que
$50.5 million,$29 million. - Références de date, telles que
8 September 2019,12 June 2020.
Si vous devez identifier des termes ou du texte spécifiques, tels que des noms de produit, ajoutez un dictionnaire.
Pour plus d'informations, lisez les articles de blog suivants :
- Extraction de motifs de texte avec les points forts de l'utilisateur avec l'induction de motifs
- induction de modèle: meilleures pratiques pour l'extraction de modèles de texte
Pour définir un modèle, procédez comme suit :
-
Dans la section Teach domain concepts du panneau Improvement tools, sélectionnez Patterns.
-
Cliquez sur Nouveau.
-
Choisissez le mode de sélection des documents.
-
Autorisez Discovery à choisir 10 documents aléatoires pour vous.
-
Choisissez les documents vous-même (jusqu'à 20 peuvent être sélectionnés).
Chaque document doit comporter moins de 5 000 caractères. Les documents qui dépassent la limite sont tronqués à 5 000 caractères.
-
-
Cliquez sur Suivant.
-
Commencez à sélectionner des exemples de mots ou de phrases qui correspondent au modèle que vous souhaitez définir.
Par exemple, si vous avez une collection d'articles qui traitent des normes
ISO, vous pouvez commencer à mettre en évidence les numéros des normes dans chaque document.Si vous annotez quelque chose, puis changez d'avis, survolez la sélection, puis cliquez sur
xpour la supprimer. -
Poursuivez en sélectionnant des exemples.
Une fois que vous avez identifié suffisamment d'exemples, Discovery affiche une liste d'exemples suggérés que vous pouvez consulter et déterminer comme étant des exemples valides ou non valides. Les exemples suggérés sont extraits de la zone configurée pour être utilisée dans les résultats de la recherche. Si la source du contenu de résultat est configurée pour être des passages, la zone
textest utilisée. Pour plus d'informations, voir Modification du contenu des résultats. -
Choisissez Oui ou Non pour chaque suggestion.
Cliquez sur l'icône Aperçu du document si vous souhaitez afficher l'exemple en contexte avant de faire un choix.
-
Continuez à mettre en évidence les exemples et à valider les suggestions jusqu'à ce qu'un message s'affiche pour vous informer que vous avez identifié suffisamment d'exemples.
-
Cliquez sur l'onglet Revoir les exemples pour revoir les listes d'exemples que vous avez identifiées et Discovery.
-
Si les exemples sont corrects, cliquez sur Save pattern.
Si Discovery ne parvient pas à discerner un modèle cohérent et valide en fonction des informations que vous avez fournies, le bouton Sauvegarder le modèle n'est jamais activé. Il se peut qu'un modèle ne soit pas créé si vous fournissez des exemples contradictoires, par exemple. Pour recommencer, cliquez sur le bouton Reset. Les documents sont renvoyés à leur état d'origine et tous les exemples que vous avez identifiés précédemment sont supprimés.
-
Pour appliquer le canevas immédiatement, choisissez la collection et la zone dans lesquelles vous souhaitez appliquer les enrichissements à partir du modèle, puis cliquez sur Appliquer.
Lorsque Discovery trouve du texte dans un document qui correspond à un modèle que vous avez défini, il est annoté dans la zone enriched_{fieldname}.entities. Vous pouvez le trouver en vérifiant le nom de votre modèle dans la zone
enriched_{fieldname}.entities.model_name.
Téléchargement d'un canevas
Pour télécharger un modèle, suivez les étapes suivantes :
-
Dans la vue Patterns, cliquez sur l'icône de téléchargement.
Un modèle est téléchargé sous forme de fichier ZIP.
Vous pouvez importer le fichier ZIP téléchargé comme source d'une ressource de modèle de règles avancé. Pour plus d'informations, voir Modèles de règles avancés.
Limites du modèle
Le nombre de modèles que vous pouvez définir par instance de service dépend de votre type de plan Discovery.
| Planifier | Canevas par instance de service |
|---|---|
| Premium | 100 |
| Entreprise | 100 |
| Plus (inclut la version d'essai) | 20 |