Supporto dei linguaggi
Quando si crea una raccolta, si specifica la lingua della raccolta. Tutti i documenti aggiunti a una raccolta devono essere scritti nella stessa lingua.
Il rilevamento non è ottimizzato per la ricerca multilingue. Anche se è possibile aggiungere diverse raccolte, ognuna con documenti in una lingua separata, in un progetto, i risultati della query dal progetto saranno imprevedibili. I risultati potrebbero includere passaggi irrilevanti da un documento in una lingua diversa dalla lingua della query dell'utente.
La seguente tabella descrive le funzioni del prodotto supportate in ogni lingua.
| Lingua | Funzioni supportate |
|---|---|
Arabo (ar) |
Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v1, Parti del discorso, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Bosniaco (bs) |
Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari |
Cinese, semplificato (zh-CN) |
Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Table Understanding |
Cinese, tradizionale (zh-TW) |
Modelli di regole avanzate, classificatore (documento e testo), entit ... personalizzate, dizionario, espressioni regolari, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, frase, Smart Document Understanding, Table Understanding |
Croato (hr) |
Classificatore (documento e testo), entità personalizzate, dizionario, espressioni regolari, parti del discorso |
Ceco (cs) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Danese (da) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Olandese (nl) |
Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v2, Parti del discorso, Frase sentiment, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Inglese (en) |
Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Contratti, Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v2, Parti del discorso, Frase sentiment, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Finlandese (fi) |
Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Francese (fr) |
Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v2, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Tedesco (de) |
Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v2, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Ebraico (he) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v2, Parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding. La funzione OCR (optical character recognition) per il testo in lingua ebraica nelle immagini è una funzionalità beta in Discovery. Per ulteriori informazioni, vedi Note sulla release per Discovery per IBM Cloud IBM Cloud. |
Hindi ( hi ) |
Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari, Stemmer |
Italiano (it) |
Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v1, Parti del discorso, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Giapponese (ja) |
Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Table Understanding |
Coreano (ko) |
Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding |
Norvegese (Bokmål) (nb) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Norvegese (Nynorsk) (nn) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Polacco (pl) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding |
Portoghese, brasiliano (pt-br) |
Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v2, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Rumeno (ro) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Russo (ru) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Serbo (sr)[1] |
Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari |
Slovacco (sk) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding |
Spagnolo (es) |
Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v2, Parti del discorso, Frase sentiment, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Svedese (sv) |
Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding |
Il riconoscimento ottico dei caratteri (OCR) v2 è stato introdotto nelle istanze del servizio gestito dal cloud il 2 novembre 2022. OCR v2 è stato introdotto nelle istanze IBM Cloud Pak for Data con versione 4.7.1.
Supporto solo in inglese
Le seguenti funzioni al momento sono supportate solo per l'inglese:
-
Il serbo supporta solo la scrittura latina. ↩︎