改善您的查詢結果
瞭解您可以採取哪些行動來改善查詢結果的品質。
您可以使用 Discovery 內建的工具來進行改善。
結果包括精確匹配以上
與某些其他搜尋應用程式不同,在您提交的短語中加入引號後,不是 只會返回完全匹配的內容。 從產品使用者介面提交的查詢為自然語言查詢。 當在自然語言查詢中提交引述文字時,短語會被用來提高結果得分。 不過,結果並不限於包含整個詞組的文件。
如果您想要對處理查詢的方式有更多控制,您必須使用查詢 API。 For more information about the phrase operator of the query API, see 查詢操作員.
簡短的查詢會返回不相關的結果
這可能是因為您的查詢包含太多停止詞,而沒有足夠的不同詞彙來啟動有意義的搜尋。 當您提交查詢時,查詢文字會先經過分析和最佳化,然後才提交給專案。 其中一項改變是移除文字中的停滯字。 停止詞是被認為對於區分內容的語意無用的詞。 Examples of stop words include terms such as and, the, and about. Discovery defines
a list of stop words that it ignores automatically both when the data is indexed and when it is searched. 當您提交的查詢大多數或只包含停止字,例如 About us,就等於提交一個空的查詢。
Although 我們 is not included in the stop words list, it is lemmatized to 我們, which is listed as a stop word.
您可以編輯集合使用的停止詞。 但是,您只能增加停用詞清單,而不能移除停用詞。 而您定義的停止詞僅在查詢時使用。 它們不會影響 Discovery 在資料加入集合和建立索引時所使用的停止字清單。
如需詳細資訊,請參閱 識別要忽略的字詞。
結果有太多文字
如果原始文件較大,可考慮將該文件分割成較小的區塊。
為此,您可以建立 Smart Document Understanding 使用者訓練模型。 在文件中尋找可用於一致地將您的文件分成小節的內容。 例如,您的文件可能有章節或字幕。 您可以使用命名為 chapter 的自訂標籤標示章節。 在您教導模型識別 chapter 內容類型後,請將模型套用到整個集合。 如需詳細資訊,請參閱 使用智慧型文件理解。
然後,您可以透過 chapter 欄位分割文件,建立許多以章節分割的子文件。 如需詳細資訊,請參閱 分割文件使查詢結果更簡潔。
找不到表格中的資訊
要搜尋表格中的資訊,必須在您的資料集中套用表格瞭解豐富化功能。 在某些情況下,會自動將表格理解豐富化套用至集合。 如果不是,而且您的收藏集的索引中有 HTML 欄位,您可以自行套用 table understanding 豐富功能。
如需詳細資訊,請參閱 瞭解表格。
圖表中的資訊不具代表性
除非您啟用集合的光學字元識別 (OCR) 設定,否則無法擷取圖表和其他影像中的文字。 您可以在初次建立集合後,將設定套用至集合。 如需詳細資訊,請參閱 管理資料集合。
搜尋無法辨識重要的詞彙
如果結果顯示查詢中的關鍵字、常用名詞或特定領域詞彙未被認定為重要,請豐富您的資料庫。
使用 Watson Natural Language Understanding 來尋找並標示一般理解為具有特殊意義的詞彙,例如地點或公司名稱。 如需詳細資訊,請參閱 套用預先建立的增益。
教導 Discovery 對您的使用個案有特殊意義的詞彙和模式。 如需詳細資訊,請參閱 新增網域特定資源。
預設的面沒有用
您可以根據應用於集合的豐富資料中的資料,新增可分類文件的面。 例如,您可能想要顯示基於關鍵字或字典類別的面。 如需相關資訊,請參閱資料類型。
探索其他搜尋功能
當您從 Discovery 使用者介面測試專案時,您會提交一個自然語言查詢。 您可以啟用搜尋功能,以影響自然語言查詢搜尋的方式。 而 Discovery Query Language 搜尋是另一種搜尋方式,您可以利用 API 來進行搜尋。 如果最初的結果無法滿足您的需求,請嘗試使用其他搜尋方法。
-
發現查詢語言 (DQL) 搜尋:可接受更複雜查詢的搜尋機制。 您必須使用查詢 API 來提交 DQL 查詢。
例如,您可以在應用於集合的豐富內容所產生的欄位中搜尋特定值。
-
自然語言查詢是由 改善和自訂頁面觸發的搜尋類型。
如需查詢 API 的詳細資訊,請參閱 Query API 概觀。