語言支援
建立集合時,您可以指定集合的語言。 您新增至集合的所有文件都必須以相同的語言撰寫。
探索未針對多語言搜尋最佳化。 雖然您可以將數個集合 (每一個集合都有不同語言的文件) 新增至一個專案,但專案的查詢結果將無法預期。 結果可能包括來自文件的不相關段落,其語言不同於使用者查詢的語言。
下表說明每種語言支援的產品特性。
| 語言 | 支援的功能 |
|---|---|
阿拉伯文 (ar) |
進階規則模型、內建實體、分類器 (文件和文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
波斯語 ( bs ) |
分類器 (文件和文字)、自訂實體、字典、詞性、正規表示式 |
簡體中文 (zh-CN) |
進階規則模型、內建實體、分類器 (文件及文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v1、詞性、片語觀感、正規表示式、智慧型文件理解、表格理解 |
繁體中文 (zh-TW) |
進階規則模型、分類器 (文件和文字)、自訂實體、字典、正規表示式、Machine Learning、光學字元辨識 v1、詞性、片語觀感、智慧型文件理解、表格理解 |
克羅地亞語 ( hr ) |
分類器 (文件及文字)、自訂實體、字典、正規表示式、詞性 |
捷克文 (cs) |
分類器 (文件及文字)、自訂實體、字典、光學字元辨識 v1、詞性、詞組觀感、正規表示式、智慧型文件理解、Stemmer、表格理解 |
丹麥文 (da) |
分類器 (文件和文字)、自訂實體、字典、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
荷蘭文 (nl) |
進階規則模型、內建實體、分類器 (文件和文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v2、詞性、詞組觀感、正規表示式、智慧型文件理解、Stemmer、表格理解 |
英文 (en) |
進階規則模型、內建實體、分類器 (文件及文字)、合約、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v2、詞性、片語觀感、正規表示式、智慧型文件理解、Stemmer、表格理解 |
芬蘭文 (fi) |
分類器 (文件和文字),自訂實體,字典,詞性,正規表示式,智慧型文件理解,Stemmer,表格理解 |
法文 (fr) |
進階規則模型、內建實體、分類器 (文件及文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v2、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
德文 (de) |
進階規則模型、內建實體、分類器 (文件及文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v2、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
希伯來文 (he) |
分類器 (文件及文字)、自訂實體、字典、光學字元辨識 v2、詞性、正規表示式、智慧型文件理解、表格理解。 影像中希伯來文文字的光學字元辨識 (OCR) 特性是 Discovery中的測試版特性。 如需相關資訊,請參閱 Discovery for IBM Cloud的版本注意事項。 |
印地語 ( hi ) |
分類器 (文件和文字),自訂實體,字典,詞性,正規表示式,Stemmer |
義大利文 (it) |
進階規則模型、內建實體、分類器 (文件和文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
日文 (ja) |
進階規則模型、內建實體、分類器 (文件及文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v1、詞性、片語觀感、正規表示式、智慧型文件理解、表格理解 |
韓文 (ko) |
進階規則模型、內建實體、分類器 (文件和文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、表格理解 |
挪威文 (Bokmål) (nb) |
分類器 (文件和文字)、自訂實體、字典、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
挪威文 (Nynorsk) (nn) |
分類器 (文件和文字)、自訂實體、字典、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
波蘭文 (pl) |
分類器 (文件及文字)、自訂實體、字典、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、表格理解 |
巴西葡萄牙文 (pt-br) |
進階規則模型、內建實體、分類器 (文件及文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v2、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
羅馬尼亞文 (ro) |
分類器 (文件及文字)、自訂實體、字典、光學字元辨識 v1、詞性、詞組觀感、正規表示式、智慧型文件理解、Stemmer、表格理解 |
俄文 (ru) |
分類器 (文件及文字)、自訂實體、字典、光學字元辨識 v1、詞性、詞組觀感、正規表示式、智慧型文件理解、Stemmer、表格理解 |
塞爾維亞文 (sr)[1] |
分類器 (文件和文字)、自訂實體、字典、詞性、正規表示式 |
斯洛伐克文 (sk) |
分類器 (文件及文字)、自訂實體、字典、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、表格理解 |
西班牙文 (es) |
進階規則模型、內建實體、分類器 (文件和文字)、自訂實體、字典、文件觀感、關鍵字、Machine Learning、光學字元辨識 v2、詞性、詞組觀感、正規表示式、智慧型文件理解、Stemmer、表格理解 |
瑞典文 (sv) |
分類器 (文件和文字)、自訂實體、字典、光學字元辨識 v1、詞性、正規表示式、智慧型文件理解、Stemmer、表格理解 |
在 2022 年 11 月 2 日的雲端管理服務實例中引進了光學字元辨識 (OCR) v2。 OCR v2 已在 IBM Cloud Pak for Data 實例中引進 4.7.1版。
僅支援英文
目前僅支援英文版的下列特性:
- 合約專案類型的文件擷取
- IBM Cloud型樣(測試版)
-
塞爾維亞文僅支援拉丁文 Script。 ↩︎