Utilizza Watson NLP integrato per trovare termini comuni
Approfitta delle pluripremiate funzionalità Watson Natural Language Processing (NLP) aggiungendo arricchimenti preintegrati ai documenti.
Con Watson NLP, puoi identificare e contrassegnare con tag le informazioni significative nelle tue raccolte in modo da poter capire cosa significa tutto e prendere decisioni più informate.
Sono disponibili i seguenti arricchimenti Watson NLP:
- Entità: riconosce i nomi appropriati come persone, città e organizzazioni menzionati nel contenuto.
- Parole chiave: riconosce termini significativi nel contenuto.
- Parte del discorso: identifica le parti del discorso (nomi e verbi, ad esempio) nel contenuto.
- Opinione: comprende l'opinione generale del contenuto.
I seguenti altri arricchimenti preaddestrati sono disponibili con Discovery:
Arricchimenti Watson NLP
Ad esempio, la seguente immagine mostra una trascrizione della dichiarazione di indipendenza degli Stati Uniti che è stata aggiunta a una raccolta Discovery in cui sono abilitati gli arricchimenti Entità e Parole chiave. Le citazioni che sono riconosciute dagli arricchimenti sono evidenziati nel testo del documento.
Alcuni degli arricchimenti PNL vengono applicati automaticamente ai progetti. Non è necessario applicarli da soli se si utilizza uno di questi tipi di progetto.
Arricchimenti predefiniti per tipo di progetto
Alcuni arricchimenti precostruiti vengono applicati automaticamente alle raccolte in un progetto in base al tipo di progetto. La seguente tabella mostra gli arricchimenti predefiniti applicati a ciascun tipo di progetto.
| Arricchimento | Document Retrieval | Richiamo documenti per contratti | Conversational Search | Content Mining |
|---|---|---|---|---|
| Contratti | ||||
| Entità | ||||
| Parole chiave | ||||
| Parte del discorso | ||||
| Opinione del documento | ||||
| Table Understanding |
Per ulteriori informazioni sui seguenti arricchimenti precostituiti, vedere i seguenti argomenti:
Per ulteriori informazioni su come creare arricchimenti personalizzati, vedi Aggiunta di risorse specifiche del dominio.
Per ulteriori informazioni su come ottenere il massimo dagli arricchimenti, leggi il post del blog Enriching your documents can rendere la ricerca più efficace.
Per ulteriori informazioni su come applicare gli arricchimenti utilizzando l'API, vedi Applicazione degli arricchimenti utilizzando l'API.
Aggiungi arricchimenti
Per aggiungere un arricchimento NLP, completa la seguente procedura:
-
Aprire il progetto e andare alla pagina Gestisci raccolte.
-
Fare clic per aprire la raccolta che si desidera arricchire.
-
Aprire la scheda Arricchimenti.
-
Scorri per trovare l'arricchimento NLP che vuoi applicare ai tuoi documenti.
Vengono elencati sia gli arricchimenti integrati che quelli personalizzati. Gli arricchimenti integrati hanno un tipo di valore
System. -
Scegliere uno o più campi a cui applicare l'arricchimento.
Puoi applicare gli arricchimenti ai campi
textehtmle ai campi personalizzati che sono stati aggiunti dai file JSON o CSV caricati o dallo strumento SDU (Smart Document Understanding). -
Fai clic su Apply changes and reprocess.
Gli arricchimenti che abiliti vengono applicati ai documenti in ordine casuale. Per informazioni su come rimuovere un arricchimento, vedi Gestione degli arricchimenti.
Entità
Identifica entità. Le entità sono termini che in genere rappresentano nomi appropriati come persone, città e organizzazioni menzionati nella raccolta dati. Discovery può riconoscere le entità che fanno parte di un sistema di tipo entità definito dal servizio Watson Natural Language Processing (NLP).
Se vuoi essere in grado di identificare termini non comuni che sono significativi per il tuo business, puoi addestrare il tuo proprio modello a riconoscere entità personalizzate. Per ulteriori informazioni, consultare Estrattore entità.
Il servizio dell'estrattore di entità NLP Watson utilizzato da Discovery è denominato sistema tipo NLU. Il nome ha origine dal fatto che il sistema tipo è utilizzato dal servizio NLU ( Watson Natural Language Understanding ) in aggiunta al servizio Watson Discovery. Tuttavia, è l'implementazione Watson NLP del sistema tipo utilizzato direttamente da Discovery, non l'implementazione Watson NLU. Come risultato, le due implementazione possono produrre risultati differenti. Per avere un'idea generale dei tipi di entità riconosciute dal servizio, vedi Entità.
La seguente immagine mostra che l'arricchimento Entità riconosce i termini Systems of Government e King of Great Britain (tra gli altri) e li contrassegna come citazioni di entità.
Dalla vista JSON del documento, puoi vedere la struttura JSON sottostante delle citazioni di entità.
Se si desidera ricercare il tipo di entità Organizzazione, ad esempio, è possibile copiare tutto il contenuto JSON in un editor di testo e ricercare Organization. Fai clic sull'icona Copia dalla root della vista della struttura
ad albero JSON.
Esempio
Input
"IBM is an American multinational technology company headquartered in Armonk."
Risposta
Nell'output JSON:
text= stringa. Il testo dell'entità.type= stringa. Il tipo di entità, comeOrganization,Location,Person,Number.mentions= array. Le citazioni e ubicazioni dell'entitàmodel_name= stringa. Per i modelli personalizzati, questo campo contiene il nome del modello fornito dall'utente. Altrimenti, questo campo contiene il nome predefinito del modello, comewatson_knowledge_studio,dictionary,character_pattern, onatural_language_understanding
{
"entities": [
{
"model_name": "natural_language_understanding",
"mentions": [
{
"confidence": 0.8317045,
"location": {
"end": 3,
"begin": 0
},
"text": "IBM"
}
],
"text": "IBM",
"type": "Organization"
},
{
"model_name": "natural_language_understanding",
"mentions": [
{
"confidence": 0.6114863,
"location": {
"end": 75,
"begin": 69
},
"text": "Armonk"
}
],
"text": "Armonk",
"type": "Location"
}
]
}
Parole chiave
Restituisce parole chiave importanti presenti nel contenuto.
Ad esempio, la seguente schermata mostra i termini evidenziati dalla dichiarazione di indipendenza degli Stati Uniti che sono riconosciuti dall'arricchimento Keywords.
Dalla vista JSON del documento, puoi vedere la struttura JSON sottostante della citazione della parola chiave Declaration.
Esempio
Input
"Watson Discovery is an award-winning AI search technology."
Risposta
Nell'output JSON:
text= il testo della parola chiavementions= le citazioni e ubicazioni dell'entità
{
"keywords": [
{
"mentions": [
{
"location": {
"end": 157,
"begin": 141
},
"text": "Watson Discovery"
}
],
"text": "Watson Discovery",
"relevance": 0.503613
},
{
"mentions": [
{
"location": {
"end": 177,
"begin": 164
},
"text": "award-winning"
}
],
"text": "award-winning",
"relevance": 0.728722
},
{
"mentions": [
{
"location": {
"end": 198,
"begin": 181
},
"text": "search technology"
}
],
"text": "search technology",
"relevance": 0.779356
}
]
}
Limiti parole chiave
L'arricchimento delle parole chiave può identificare fino a 50 parole chiave, ognuna con una o più citazioni, per documento.
Parte del discorso
Riconosce e contrassegna parti del discorso, inclusi nomi, verbi, aggettivi, avverbi, congiunzioni, interiezioni e numeri.