Utilizza Watson NLP integrato per trovare termini comuni

Approfitta delle pluripremiate funzionalità Watson Natural Language Processing (NLP) aggiungendo arricchimenti preintegrati ai documenti.

Con Watson NLP, puoi identificare e contrassegnare con tag le informazioni significative nelle tue raccolte in modo da poter capire cosa significa tutto e prendere decisioni più informate.

Sono disponibili i seguenti arricchimenti Watson NLP:

  • Entità: riconosce i nomi appropriati come persone, città e organizzazioni menzionati nel contenuto.
  • Parole chiave: riconosce termini significativi nel contenuto.
  • Parte del discorso: identifica le parti del discorso (nomi e verbi, ad esempio) nel contenuto.
  • Opinione: comprende l'opinione generale del contenuto.

I seguenti altri arricchimenti preaddestrati sono disponibili con Discovery:

Arricchimenti Watson NLP

Ad esempio, la seguente immagine mostra una trascrizione della dichiarazione di indipendenza degli Stati Uniti che è stata aggiunta a una raccolta Discovery in cui sono abilitati gli arricchimenti Entità e Parole chiave. Le citazioni che sono riconosciute dagli arricchimenti sono evidenziati nel testo del documento.

Mostra un estratto della dichiarazione di indipendenza degli Stati Uniti con diversi termini evidenziati.
Excerpt of the US Declaration of Independence with highlighted terms

Alcuni degli arricchimenti PNL vengono applicati automaticamente ai progetti. Non è necessario applicarli da soli se si utilizza uno di questi tipi di progetto.

Arricchimenti predefiniti per tipo di progetto

Alcuni arricchimenti precostruiti vengono applicati automaticamente alle raccolte in un progetto in base al tipo di progetto. La seguente tabella mostra gli arricchimenti predefiniti applicati a ciascun tipo di progetto.

Arricchimenti predefiniti per tipo di progetto
Questa tabella ha intestazioni di righe e colonne. Le intestazioni di riga identificano i tipi di progetto. Le intestazioni di colonna identificano diversi arricchimenti. Per comprendere quali arricchimenti vengono applicati a un tipo di progetto per impostazione predefinita, vai alla riga che descrive gli arricchimenti e trova le colonne per il tipo di progetto a cui sei interessato.
Arricchimento Document Retrieval Richiamo documenti per contratti Conversational Search Content Mining
Contratti Icona segno di spunta
Entità Icona segno di spunta Icona segno di spunta
Parole chiave
Parte del discorso Icona segno di spunta
Opinione del documento
Table Understanding Icona segno di spunta

Per ulteriori informazioni sui seguenti arricchimenti precostituiti, vedere i seguenti argomenti:

Per ulteriori informazioni su come creare arricchimenti personalizzati, vedi Aggiunta di risorse specifiche del dominio.

Per ulteriori informazioni su come ottenere il massimo dagli arricchimenti, leggi il post del blog Enriching your documents can rendere la ricerca più efficace.

Per ulteriori informazioni su come applicare gli arricchimenti utilizzando l'API, vedi Applicazione degli arricchimenti utilizzando l'API.

Aggiungi arricchimenti

Per aggiungere un arricchimento NLP, completa la seguente procedura:

  1. Aprire il progetto e andare alla pagina Gestisci raccolte.

  2. Fare clic per aprire la raccolta che si desidera arricchire.

  3. Aprire la scheda Arricchimenti.

  4. Scorri per trovare l'arricchimento NLP che vuoi applicare ai tuoi documenti.

    Vengono elencati sia gli arricchimenti integrati che quelli personalizzati. Gli arricchimenti integrati hanno un tipo di valore System.

  5. Scegliere uno o più campi a cui applicare l'arricchimento.

    Puoi applicare gli arricchimenti ai campi text e html e ai campi personalizzati che sono stati aggiunti dai file JSON o CSV caricati o dallo strumento SDU (Smart Document Understanding).

  6. Fai clic su Apply changes and reprocess.

Gli arricchimenti che abiliti vengono applicati ai documenti in ordine casuale. Per informazioni su come rimuovere un arricchimento, vedi Gestione degli arricchimenti.

Entità

Identifica entità. Le entità sono termini che in genere rappresentano nomi appropriati come persone, città e organizzazioni menzionati nella raccolta dati. Discovery può riconoscere le entità che fanno parte di un sistema di tipo entità definito dal servizio Watson Natural Language Processing (NLP).

Se vuoi essere in grado di identificare termini non comuni che sono significativi per il tuo business, puoi addestrare il tuo proprio modello a riconoscere entità personalizzate. Per ulteriori informazioni, consultare Estrattore entità.

Il servizio dell'estrattore di entità NLP Watson utilizzato da Discovery è denominato sistema tipo NLU. Il nome ha origine dal fatto che il sistema tipo è utilizzato dal servizio NLU ( Watson Natural Language Understanding ) in aggiunta al servizio Watson Discovery. Tuttavia, è l'implementazione Watson NLP del sistema tipo utilizzato direttamente da Discovery, non l'implementazione Watson NLU. Come risultato, le due implementazione possono produrre risultati differenti. Per avere un'idea generale dei tipi di entità riconosciute dal servizio, vedi Entità.

La seguente immagine mostra che l'arricchimento Entità riconosce i termini Systems of Government e King of Great Britain (tra gli altri) e li contrassegna come citazioni di entità.

Mostra la dichiarazione con i termini in evidenza Governi e Re di Gran Bretagna.
The recognized entities, Governments and King of Great Britain, are highlighted

Dalla vista JSON del documento, puoi vedere la struttura JSON sottostante delle citazioni di entità.

Mostra la vista JSON delle entità Systems of Government e King of Great Britain identificate nel documento*Rappresentazione
delle
di entità riconosciute*

Se si desidera ricercare il tipo di entità Organizzazione, ad esempio, è possibile copiare tutto il contenuto JSON in un editor di testo e ricercare Organization. Fai clic sull'icona Copia dalla root della vista della struttura ad albero JSON.

Esempio

Input

"IBM is an American multinational technology company headquartered in Armonk."

Risposta

Nell'output JSON:

  • text = stringa. Il testo dell'entità.
  • type = stringa. Il tipo di entità, come Organization, Location, Person, Number.
  • mentions = array. Le citazioni e ubicazioni dell'entità
  • model_name = stringa. Per i modelli personalizzati, questo campo contiene il nome del modello fornito dall'utente. Altrimenti, questo campo contiene il nome predefinito del modello, come watson_knowledge_studio, dictionary, character_pattern, o natural_language_understanding
{
  "entities": [
    {
      "model_name": "natural_language_understanding",
      "mentions": [
        {
          "confidence": 0.8317045,
          "location": {
            "end": 3,
            "begin": 0
          },
          "text": "IBM"
        }
      ],
      "text": "IBM",
      "type": "Organization"
    },
    {
      "model_name": "natural_language_understanding",
      "mentions": [
        {
          "confidence": 0.6114863,
          "location": {
            "end": 75,
            "begin": 69
          },
        "text": "Armonk"
        }
      ],
      "text": "Armonk",
      "type": "Location"
    }
  ]
}

Parole chiave

Restituisce parole chiave importanti presenti nel contenuto.

Ad esempio, la seguente schermata mostra i termini evidenziati dalla dichiarazione di indipendenza degli Stati Uniti che sono riconosciuti dall'arricchimento Keywords.

Mostra le parole chiave riconosciute nel testo del
riconosciuti dall'
delle parole chiave*

Dalla vista JSON del documento, puoi vedere la struttura JSON sottostante della citazione della parola chiave Declaration.

Mostra la vista JSON delle parole chiave identificate nel documento*Rappresentazione
delle
di arricchimento delle parole chiave*

Esempio

Input

"Watson Discovery is an award-winning AI search technology."

Risposta

Nell'output JSON:

  • text = il testo della parola chiave
  • mentions = le citazioni e ubicazioni dell'entità
{
  "keywords": [
    {
      "mentions": [
        {
          "location": {
            "end": 157,
            "begin": 141
          },
          "text": "Watson Discovery"
        }
      ],
      "text": "Watson Discovery",
      "relevance": 0.503613
    },
    {
      "mentions": [
        {
          "location": {
           "end": 177,
            "begin": 164
          },
          "text": "award-winning"
        }
      ],
      "text": "award-winning",
      "relevance": 0.728722
    },
    {
      "mentions": [
        {
          "location": {
            "end": 198,
            "begin": 181
          },
          "text": "search technology"
        }
      ],
      "text": "search technology",
      "relevance": 0.779356
    }
  ]
}

Limiti parole chiave

L'arricchimento delle parole chiave può identificare fino a 50 parole chiave, ognuna con una o più citazioni, per documento.

Parte del discorso

Riconosce e contrassegna parti del discorso, inclusi nomi, verbi, aggettivi, avverbi, congiunzioni, interiezioni e numeri.