Migliorare i risultati delle query

Scoprite le azioni che potete intraprendere per migliorare la qualità dei risultati delle vostre query.

È possibile utilizzare gli strumenti integrati in Discovery per apportare miglioramenti.

I risultati includono più di una corrispondenza esatta

A differenza di altre applicazioni di ricerca, l'aggiunta di virgolette a una frase inviata non restituisce solo le corrispondenze esatte. Le query inviate dall'interfaccia utente del prodotto sono query in linguaggio naturale. Quando un testo citato viene inserito in una query in linguaggio naturale, la frase viene utilizzata per aumentare i punteggi dei risultati. Tuttavia, i risultati non sono limitati ai documenti che contengono l'intera frase.

Se si desidera un maggiore controllo sulla gestione delle query, è necessario utilizzare l'API delle query. Per ulteriori informazioni sull'operatore phrase dell'API di query, vedere Operatori di query.

Una query breve restituisce risultati irrilevanti

È possibile che la vostra query contenga troppe stop words e non abbastanza termini distinti per attivare una ricerca significativa. Quando si invia una query, il testo della query viene analizzato e ottimizzato prima di essere inviato al progetto. Uno dei cambiamenti che si verificano è la rimozione di tutte le stop words dal testo. Una parola d'arresto è una parola considerata non utile per distinguere il significato semantico del contenuto. Esempi di stop words sono termini come and, the e about. Discovery definisce un elenco di stop words che ignora automaticamente sia durante l'indicizzazione dei dati che durante la ricerca. Quando si invia una query che contiene per lo più o solo stop words, come About us, equivale a inviare una query vuota.

Sebbene us non sia inclusa nell'elenco delle stop word, viene lemmatizzata in we, che viene elencata come stop word.

È possibile modificare le stop word utilizzate dalla raccolta. Tuttavia, è possibile solo incrementare l'elenco delle stop words; non è possibile rimuovere le stop words. E le stop words definite dall'utente vengono utilizzate solo al momento dell'interrogazione. Non influiscono sull'elenco di stop word usato da Discovery quando i dati vengono aggiunti a una raccolta e l'indice viene creato.

Per ulteriori informazioni, vedere Identificazione delle parole da ignorare.

I risultati hanno troppo testo

Se il documento di partenza è di grandi dimensioni, si consiglia di suddividerlo in parti più piccole.

A tal fine, è possibile creare un modello Smart Document Understanding addestrato dall'utente. Individuare nel documento i contenuti che possono essere utilizzati per suddividere coerentemente il documento in sottosezioni. Ad esempio, è possibile che il documento abbia dei capitoli o dei sottotitoli. È possibile etichettare i capitoli con un'etichetta personalizzata denominata chapter. Dopo aver insegnato al modello a riconoscere il tipo di contenuto chapter, applicare il modello all'intera collezione. Per ulteriori informazioni, vedere Utilizzo della comprensione intelligente dei documenti.

È quindi possibile dividere il documento in base al campo chapter per creare molti sottodocumenti segmentati per capitolo. Per ulteriori informazioni, vedere Suddividere i documenti per rendere più sintetici i risultati delle query.

Le informazioni contenute nelle tabelle non sono state trovate

L'arricchimento della comprensione delle tabelle deve essere applicato alla collezione affinché le informazioni delle tabelle siano ricercabili. L'arricchimento della comprensione delle tabelle viene applicato automaticamente alle collezioni in alcune situazioni. Se non lo è e la vostra collezione ha un campo HTML nel suo indice, potete applicare voi stessi l'arricchimento comprensione della tabella.

Per ulteriori informazioni, vedere Comprendere le tabelle.

Le informazioni contenute nei diagrammi non sono rappresentate

Il testo di diagrammi e altre immagini non viene acquisito se non si attiva l'impostazione di riconoscimento ottico dei caratteri (OCR) per la raccolta. È possibile applicare l'impostazione a una raccolta dopo la sua creazione iniziale. Per ulteriori informazioni, vedere Gestione delle raccolte di dati.

La ricerca non riconosce i termini significativi

Se i risultati suggeriscono che le parole chiave, i sostantivi comuni o i termini specifici del dominio nella query non vengono riconosciuti come significativi, arricchite la vostra raccolta.

Utilizzate Watson Natural Language Understanding per trovare ed etichettare i termini che sono generalmente intesi con un significato speciale, come ad esempio i nomi di località o di aziende. Per ulteriori informazioni, vedere Applicazione di arricchimenti precostituiti.

Insegnare a Discovery i termini e i modelli che hanno un significato speciale per il vostro caso d'uso. Per ulteriori informazioni, vedere Aggiungi risorse specifiche del dominio.

Le sfaccettature predefinite non sono utili

È possibile aggiungere sfaccettature che categorizzano i documenti in base ai dati degli arricchimenti applicati a una raccolta. Ad esempio, si potrebbero mostrare sfaccettature basate su parole chiave o categorie del dizionario. Per ulteriori informazioni, vedi Facet.

Esplora altre funzioni di ricerca

Quando si testa il progetto dall'interfaccia utente Discovery, si invia una query in linguaggio naturale. Sono disponibili funzioni di ricerca che possono essere attivate per influenzare il modo in cui viene effettuata la ricerca in linguaggio naturale. La ricerca in Discovery Query Language è un altro tipo di ricerca che si può sfruttare utilizzando l'API. Se i risultati iniziali non soddisfano le vostre esigenze, sperimentate un altro metodo di ricerca.

  • Ricerca con Discovery Query Language (DQL): Un meccanismo di ricerca che accetta query più complesse. È necessario utilizzare l'API delle query per inviare le query DQL.

    Ad esempio, è possibile cercare valori specifici nei campi generati dagli arricchimenti applicati a una raccolta.

  • La query in linguaggio naturale è il tipo di ricerca che si attiva dalla pagina Migliora e personalizza.

Per ulteriori informazioni sull'API Query, vedere Panoramica dell'API Query.