Utilisez NeuralSeek pour renvoyer des réponses affinées à partir d'un contenu d'aide existant
Utilisez NeuralSeek pour renvoyer des réponses affinées à partir d'un contenu d'aide existant
Utilisez NeuralSeek pour renvoyer des réponses affinées à partir d'un contenu d'aide existant
Dans ce tutoriel, vous allez utiliser les services Watson Discovery, watsonx Assistantet NeuralSeek disponibles dans le catalogue IBM Cloud pour créer un assistant virtuel pouvant répondre aux questions relatives à Watson Discovery. L'assistant
génère des réponses en utilisant la documentation du produit Watson Discovery existante comme base de connaissances.
Ce tutoriel présente les étapes de création d'un déploiement géré de Discovery. Toutefois, vous pouvez créer une instance de service Discovery hébergée par IBM Cloud ou installée dans IBM Cloud Pak for Data et la connecter à une instance de service
NeuralSeek.
Objectifs
A la fin du tutoriel, vous saurez comment effectuer les opérations suivantes :
Créez un projet d'extraction de document dans Discovery.
Téléchargez des documents PDF dans votre projet et appliquez un modèle Smart Document Understanding entraîné par l'utilisateur à vos PDF.
Connectez votre projet Discovery à une instance de service NeuralSeek. NeuralSeek est un moteur de génération de réponses basé sur l'intelligence artificielle.
Créez un assistant dans watsonx Assistant et appliquez-lui une intégration NeuralSeek.
Ajoutez une action à votre watsonx Assistant qui se connecte à NeuralSeek pour obtenir des réponses.
Utilisez votre assistant pour répondre aux questions relatives à Discovery.
NeuralSeek est un produit tiers fourni par un fournisseur extérieur à IBM et fait l'objet d'un accord distinct entre vous et ce tiers, si vous en acceptez les conditions. IBM n'est pas responsable du produit et décline toute responsabilité en
matière de confidentialité, de sécurité, de performance, de support ou d'autres engagements concernant le produit.
Durée
Il faut compter environ 4 à 5 heures pour réaliser ce tutoriel.
Prérequis
Avant de commencer, vous devez configurer un compte payant avec IBM Cloud.
Vous pouvez suivre ce tutoriel gratuitement en utilisant un plan Plus, qui offre un essai gratuit de 30 jours. Cependant, pour créer une instance du plan Plus du service, vous devez avoir un compte payant (où vous fournissez les détails
de votre carte de crédit). Pour plus d'informations sur la création d'un compte payant, voir Mise à niveau de votre compte.
Créez une instance de service Discovery plan Plus.
Allez sur la page de ressources Discovery du catalogue IBM Cloud et créez une instance de service Plus plan.
Indiquez Dallas comme emplacement.
Dans le cadre de ce tutoriel, vous allez également mettre à disposition d'autres services. Les services doivent être hébergés dans le même emplacement de données afin qu'ils puissent se connecter les uns aux autres. Etant donné que le
service NeuralSeek est disponible uniquement à partir de Dallas, vous allez créer toutes les instances de service à Dallas.
Si vous décidez de ne plus utiliser le plan Plus et de ne plus payer, supprimez l'instance de service du plan Plus avant la fin de la période d'essai de 30 jours.
Obtenir la documentation du produit
Pour utiliser la documentation du produit Discovery comme base de connaissances, nous téléchargerons la documentation du produit sous forme de fichier PDF.
A partir d'un navigateur Web, accédez au site de la documentation du produit.
https://cloud.ibm.com/docs/discovery-data
Dans le panneau de la table des matières, cliquez sur l'icône de menu déroulant dynamique dans la section Product guide, puis choisissez View as PDF.
Sauvegardez le fichier PDF sur votre système en cliquant sur l'icône Sauvegarder dans l'en-tête de page.
Utilisez un éditeur de fichier PDF pour fractionner le document PDF en deux fichiers PDF distincts de taille similaire.
Le fractionnement du PDF crée deux fichiers plus petits qui peuvent être enrichis plus rapidement dans Discovery.
Créer un projet d'extraction de document
Maintenant que vous disposez de la dernière copie de la documentation du produit, ajoutez-la à un projet Discovery en tant que source de données.
Dans Discovery, vous allez créer un type de projet Document Retrieval. Les documents que vous ajoutez à un projet de ce type sont automatiquement enrichis de la manière suivante:
Les entités, telles que les noms propres, sont identifiées et étiquetées.
Les parties du discours sont identifiées et étiquetées.
Ces informations étiquetées sont utilisées ultérieurement lorsqu'une phrase en langage naturel est soumise en tant que requête de recherche pour renvoyer une réponse précise.
Ouvrez une nouvelle page de navigateur Web.
Sur la page du service de plan Discovery Plus dans IBM Cloud, cliquez sur Lancez Discovery.
Dans la page Mes projets, cliquez sur Nouveau projet.
Nommez votre projet Discovery documentation, puis cliquez sur la vignette Document Retrieval.
du type de du type de projet*
Cliquez sur Suivant.
Vous allez configurer la source de données pour le projet à l'étape suivante.
Télécharger des données dans le projet
Ajoutez les fichiers PDF de la documentation à votre projet Discovery.
Dans la page Sélectionner une source de données, cliquez sur la vignette Télécharger des données, puis sur Suivant.
d'une collection à partir de données
Nommez la collection Discovery docs part 1, puis cliquez sur Next.
Cliquez sur Faire glisser et déposer des fichiers ici ou télécharger, puis accédez au premier fichier PDF que vous avez créé précédemment.
Cliquez sur Terminer.
Votre fichier est traité lorsqu'il est ajouté à la collection.
Dans le panneau de navigation, cliquez sur Manage collections, puis sur New collection.
Adding a second collection
Répétez les étapes précédentes pour ajouter le deuxième fichier PDF en tant que collection nommée Discovery docs part 2.
Une fois les données téléchargées, elles sont traitées et indexées par Discovery. Pendant le traitement des données, créons notre assistant virtuel.
Création d'un assistant
Pour ce tutoriel, vous allez créer un assistant avec une seule action. Vous devez d'abord créer une instance de service watsonx Assistant.
Les instances de service watsonx Assistant du plan Lite et du plan d'essai sont disponibles gratuitement. Vous allez créer un plan d'essai.
A partir d'un nouvel onglet de navigateur Web, revenez au catalogue IBM Cloud.
Gardez la page Discovery ouverte dans un onglet distinct, afin de pouvoir basculer entre les deux applications.
A partir de la page de ressources watsonx Assistant du catalogue IBM Cloud, créez une instance de service de plan d'essai watsonx Assistant à l'emplacement
de Dallas.
Depuis la page de service de plan watsonx Assistant dans IBM Cloud, cliquez sur Lancer watsonx Assistant.
L'interface utilisateur du produit watsonx Assistant s'affiche pour vous permettre de créer votre premier assistant.
Ajoutez Discovery expert comme nom d'assistant, puis cliquez sur Suivant.
Si vous êtes invité à partager des informations sur vous et votre assistant, renseignez les zones requises, puis cliquez sur Suivant.
Lorsque vous créez un assistant, une application de discussion Web est créée automatiquement pour vous.
Cliquez sur Créer pour créer l'assistant et l'application de discussion Web correspondante.
Après un message de félicitations, la page d'accueil de votre nouvel assistant s'affiche.
Assistant home page
Avant d'ajouter quoi que ce soit à notre nouvel assistant, vérifions l'état de nos données.
Préparez vos données pour l'extraction
Pour améliorer l'extrabilité des informations de vos fichiers PDF, vous fractionnez les fichiers PDF en plusieurs documents plus petits. Pour ce faire, vous allez d'abord enseigner à Discovery la structure de vos fichiers PDF afin qu'il comprenne
comment les sous-sections sont formatées et qu'il puisse fractionner le document par sous-section.
Revenez à l'onglet du navigateur Web dans lequel votre projet Discovery est affiché.
La page Improve and customize du dernier fichier PDF que vous avez téléchargé s'affiche.
Dans le panneau Outils d'amélioration, développez Définir la structure, puis cliquez sur Nouveaux champs.
de l'outil de définition des
Choisissez la collection Discovery docs part 1.
L'onglet Identifier les champs s'affiche, dans lequel vous pouvez choisir le type de modèle Smart Document Understanding que vous souhaitez utiliser.
Cliquez sur Modèles entraînés par l'utilisateur, puis sur Soumettre.
d'un modèle entraîné par l'
Cliquez sur Apply changes and reprocess.
Après un certain traitement, une représentation du document s'affiche dans l'outil Smart Document Understanding. L'outil affiche une vue du document d'origine ainsi qu'une représentation du document, où le texte est remplacé par des blocs.
Les blocs représentent les types de zone.
Initialement, les blocs sont libellés en tant que text car tout le contenu du document est considéré comme du texte standard par défaut et est indexé dans la zone text.
Nous voulons étiqueter tous les en-têtes de premier et de deuxième niveau en tant que sous-titres au lieu de texte.
Dans la vue des miniatures, cliquez sur la miniature de la première page en texte intégral du document pour ouvrir la première page avec du contenu réel.
' Smart Document Understanding*
Pour annoter le document, cliquez sur le libellé subtitle dans la liste Etiquettes de champ. Cliquez ensuite sur chaque bloc dans la représentation de la page PDF qui représente un en-tête pour modifier son libellé
de text en subtitle.
de l'étiquette sous-titre*
Une fois que chaque sous-titre de la page en cours est libellé, cliquez sur Soumettre la page.
La page suivante du fichier PDF s'affiche.
SDU*La page suivante est affichée pour l'
Répétez ce processus jusqu'à ce que l'outil puisse correctement étiqueter les en-têtes pour vous de manière cohérente lorsque de nouvelles pages sont chargées dans l'outil. A ce stade, cliquez sur Appliquer les modifications et retraiter.
Félicitations ! Vous avez entraîné avec succès un modèle SDU (Smart Document Understanding) qui peut reconnaître des sous-titres dans vos documents. Appliquons le même modèle à l'autre fichier PDF que vous avez ajouté au projet.
Dans la barre d'outils de l'éditeur SDU, cliquez sur l'icône du menu déroulant dynamique dans l'en-tête de page, puis sélectionnez Exporter le modèle.
Sauvegardez le fichier .sdumodel sur votre système dans un emplacement où vous pourrez y accéder à nouveau rapidement.
Dans le panneau de navigation, cliquez sur Manage collections, puis ouvrez la collection Discovery docs part 2.
Ouvrez l'onglet Identifier les champs.
Cliquez sur Modèles entraînés par l'utilisateur, puis sur Soumettre.
Cliquez sur Apply changes and reprocess.
Dans la barre d'outils de l'éditeur SDU, cliquez sur l'icône de menu déroulant dynamique , puis choisissez Importer le modèle,
puis cliquez sur Sélectionner le modèle.
Recherchez le fichier .sdumodel que vous avez téléchargé précédemment, puis cliquez sur Ouvrir.
Cliquez sur Appliquer les modifications et retraiter pour appliquer le même modèle SDU à la première collection.
Discovery retraite les données dans son index pour identifier les sous-titres dans les documents. Pendant que les données sont en cours de retraitement, créons notre générateur de réponses.
Créer une instance de service NeuralSeek
Vous pouvez utiliser une extension de recherche dans watsonx Assistant pour connecter votre assistant directement à Discovery et renvoyer des passages directement à partir de la source de données. Toutefois, nous allons ajouter le service NeuralSeek
entre watsonx Assistant et Discovery dans ce tutoriel. NeuralSeek extrait les passages de Discovery, puis les convertit en réponses qui semblent plus conversationnelles.
A partir d'un nouvel onglet de navigateur Web, revenez au catalogue IBM Cloud.
Conservez les pages des autres services ouvertes dans des onglets distincts afin de pouvoir basculer entre les différentes instances de service.
Dans la page de ressources NeuralSeek du catalogue IBM Cloud, créez une instance de service de plan Lite.
Sur la page Configurer, ajoutez des détails sur votre instance de service Discovery et personnalisez la connexion.
Vous pouvez obtenir l' URL service et la clé API à partir de la page de détails de l'instance de service Discovery dans IBM Cloud
L'ID de projet est disponible à partir de l'interface utilisateur IBM Cloud. Pour l'obtenir, cliquez sur Intégrer et déployer dans le panneau de navigation. Ouvrez la page Informations sur l'API, puis copiez l'ID
de projet.
Définissez la plage de scores du document à 50%.
Remplacez la taille du caractère de fragment par 400.
Indiquez votre société comme nom d'affichage de la société.
Remplacez le pourcentage de confiance minimum par 50.
Cliquez sur Sauvegarder.
Fractionner vos documents PDF
Maintenant que les sous-titres sont correctement indexés dans Discovery, utilisez-les comme base pour fractionner les fichiers PDF en plusieurs documents plus petits.
Revenez à l'onglet du navigateur Web dans lequel votre projet Discovery est affiché.
Ouvrez l'onglet Manage fields pour la collection en cours.
Dans Fractionner le document sur chaque occurrence de la zone, choisissez sous-titre, puis cliquez sur Appliquer les modifications et retraiter.
un
Dans le panneau de navigation, cliquez sur Manage collections, puis ouvrez l'autre collection.
Accédez à la page Gérer les champs, puis sélectionnez sous-titre dans le champ Fractionner le document sur chaque occurrence du champ.
Cliquez sur Apply changes and reprocess.
Les collections commencent à être traitées à nouveau. Une fois la réindexation terminée, au lieu de contenir un document chacun, les collections contiennent plusieurs centaines de documents chacun.
collections avec plus de
Pendant que l'index est en cours de reconstruction, préparons notre assistant.
Ajouter une extension à votre assistant
Connectez votre assistant à votre instance de service NeuralSeek.
Rouvrez le service NeuralSeek à partir de IBM Cloud. L'instance se trouve dans la section AI and Machine Learning de votre liste de ressources.
Cliquez sur l'onglet Intégrer et suivez les instructions pour configurer l'extension personnalisée NeuralSeek pour votre assistant. Revenez à cette procédure lorsque vous êtes prêt à créer l'action.
NeuralSeek l'intégration l'instance NeuralSeek
Dans le panneau de navigation watsonx Assistant, cliquez sur Actions, puis sur Nouvelle action.
Choisissez Démarrage rapide à partir de modèles, puis faites défiler la page pour rechercher et cliquer sur le kit de démarrageNeuralSeek.
de démarrage à partir d'un modèle*Choisir Démarrage rapide à partir d'un
Cliquez sur Sélectionner ce kit de démarrage, puis sur Ajouter des modèles.
Cliquez pour ouvrir l'action NeuralSeek search que vous venez d'ajouter à l'assistant.
Ajoutez les exemples de requête utilisateur suivants à la première étape de l'action:
What Watson Discovery project types are available and what do they do?
What external data sources are supported by Watson Discovery?
Can I add a custom dictionary to Watson Discovery?
How do I use the Content Mining application?
When should I add query expansions to my project?
Which file types support Smart Document Understanding models?
Can I enable optical character recognition for all file types?
Does my data have to be written in English?
watsonx Assistant utilise les exemples de questions pour reconnaître les types de questions utilisateur qu'il doit acheminer vers cette action.
Cliquez pour ouvrir l'étape 3 pour l'éditer.
Dans la section Et puis, cliquez sur Editer l'extension.
Choisissez NeuralSeek, puis cliquez sur Appliquer.
configuration du poste*Configurer le NeuralSeek
Cliquez pour ouvrir l'étape 6 pour l'éditer.
Cette étape affiche un lien sur lequel les utilisateurs peuvent cliquer pour obtenir plus d'informations. Nous voulons que ce lien soit directement accessible à la documentation du produit sur le site IBM Cloud Docs.
Modifiez la référence hypertexte dans l'élément HTML anchor pour qu'elle contienne l' URL suivante :
: caption="Change the URL for the More information link" caption-side="bottom"}
Sauvegardez vos modifications, puis cliquez sur le X pour fermer l'étape.
Félicitations ! Vous avez créé une action qui reconnaît les questions relatives à Discoveryet obtient ses réponses de l'extension NeuralSeek connectée.
Configurez la discussion Web pour votre assistant
Pour prévisualiser votre assistant, vous utiliserez la discussion Web intégrée comme interface utilisateur de discussion pour interagir avec l'assistant.
Dans le panneau de navigation de watsonx Assistant, cliquez sur Environnements.
L'environnement brouillon s'affiche. Il indique qu'une discussion Web est connectée à votre assistant. Vous pouvez également voir que la discussion Web est connectée à l'extension NeuralSeek.
Environment diagram
Cliquez sur la vignette Discussion Web pour éditer la discussion Web.
Nous ne voulons pas ajouter plusieurs questions de démarrage, nous allons donc désactiver l'écran d'accueil pour la discussion Web. Cliquez sur l'onglet Écran d'accueil. Définissez le commutateur sur Off,
puis cliquez sur Save and exit.
Web chat home screen disabled
Vous êtes prêt à prévisualiser votre assistant !
Aperçu de l'assistant
Pour prévisualiser un assistant qui se connecte aux données stockées dans Discovery, vous devez prévisualiser l'assistant à partir de la page Environnements. Lorsque vous prévisualisez la discussion Web indépendamment, l'assistant ne
peut pas extraire les données de Discovery; il a besoin des ressources d'environnement pour pouvoir se connecter à Discovery.
Dans la page Environnements, cliquez sur Aperçu de cet environnement.
Un exemple de page Web s'affiche avec une icône de discussion .
Cliquez sur l'icône de chat pour ouvrir la fenêtre de chat en ligne.
Web chat welcome message
Entrez la question texte suivante:
What project types are available?
La réponse correcte est renvoyée et inclut un lien vers la documentation du produit.
{: caption="la question du testLe chat en ligne renvoie la " caption-side="bottom"} de la recherche
Soumettez une question qui n'a pas été utilisée comme exemple de requête lorsque vous avez créé l'action.
How do you define synonyms in Watson Discovery?
Une réponse détaillée est renvoyée.
la question du test*Le chat en ligne renvoie une réponse
Posez éventuellement d'autres questions à l'assistant.
Si l'assistant ne connaît pas la réponse, redéfinissez la question pour inclure " dans Watson Discoveryafin de préciser que vous demandez comment quelque chose fonctionne dans Discovery spécifiquement.
Félicitations ! Vous avez créé un assistant qui peut répondre aux questions sur Discovery en extrayant des informations de la documentation du produit via le service NeuralSeek.
Summary
Dans ce tutoriel, vous avez créé un projet Watson Discovery Document Retrieval avec des fichiers PDF téléchargés qui contiennent la documentation du produit Discovery. Séparément, vous avez créé un assistant virtuel watsonx Assistant avec
une action unique qui peut reconnaître les questions des utilisateurs sur Discovery. Vous avez ajouté une extension personnalisée à votre assistant qui se connecte à un service tiers appelé NeuralSeek qui obtient la réponse correcte de Discovery
et reformule la réponse. Enfin, vous avez testé votre assistant virtuel en posant une question et en obtenant une réponse précise et bien écrite.
Etapes suivantes
L'assistant que vous avez créé est disponible à partir de l'environnement de brouillon. Ensuite, vous pouvez publier votre assistant dans un environnement de production et le déployer. Vous pouvez déployer l'assistant de différentes manières.
Pour plus d'informations, voir Présentation: Prévisualisation et publication.