Supporto dei linguaggi

Quando si crea una raccolta, si specifica la lingua della raccolta. Tutti i documenti aggiunti a una raccolta devono essere scritti nella stessa lingua.

Il rilevamento non è ottimizzato per la ricerca multilingue. Anche se è possibile aggiungere diverse raccolte, ognuna con documenti in una lingua separata, in un progetto, i risultati della query dal progetto saranno imprevedibili. I risultati potrebbero includere passaggi irrilevanti da un documento in una lingua diversa dalla lingua della query dell'utente.

La seguente tabella descrive le funzioni del prodotto supportate in ogni lingua.

Supporto funzione per lingua
Lingua Funzioni supportate
Arabo (ar) Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v1, Parti del discorso, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Bosniaco (bs) Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari
Cinese, semplificato (zh-CN) Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Table Understanding
Cinese, tradizionale (zh-TW) Modelli di regole avanzate, classificatore (documento e testo), entit ... personalizzate, dizionario, espressioni regolari, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, frase, Smart Document Understanding, Table Understanding
Croato (hr) Classificatore (documento e testo), entità personalizzate, dizionario, espressioni regolari, parti del discorso
Ceco (cs) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Danese (da) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Olandese (nl) Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v2, Parti del discorso, Frase sentiment, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Inglese (en) Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Contratti, Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v2, Parti del discorso, Frase sentiment, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Finlandese (fi) Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Francese (fr) Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v2, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Tedesco (de) Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v2, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Ebraico (he) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v2, Parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding. La funzione OCR (optical character recognition) per il testo in lingua ebraica nelle immagini è una funzionalità beta in Discovery. Per ulteriori informazioni, vedi Note sulla release per Discovery per IBM Cloud IBM Cloud.
Hindi ( hi ) Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari, Stemmer
Italiano (it) Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v1, Parti del discorso, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Giapponese (ja) Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Table Understanding
Coreano (ko) Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding
Norvegese (Bokmål) (nb) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Norvegese (Nynorsk) (nn) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Polacco (pl) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding
Portoghese, brasiliano (pt-br) Modelli di regole avanzate, entità integrate, classificatore (documento e testo), entità personalizzate, dizionario, opinione del documento, parole chiave, Machine Learning, riconoscimento dei caratteri ottici v2, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Rumeno (ro) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Russo (ru) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, frase, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Serbo (sr)[1] Classificatore (documento e testo), entità personalizzate, dizionario, parti del discorso, espressioni regolari
Slovacco (sk) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Table Understanding
Spagnolo (es) Modelli di regole avanzate, Entità integrate, Classificatore (Documento e Testo), Entità personalizzate, Dizionario, sentiment del documento, Parole chiave, Machine Learning, Riconoscimento dei caratteri ottici v2, Parti del discorso, Frase sentiment, Espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding
Svedese (sv) Classificatore (documento e testo), entità personalizzate, dizionario, riconoscimento dei caratteri ottici v1, parti del discorso, espressioni regolari, Smart Document Understanding, Stemmer, Table Understanding

Il riconoscimento ottico dei caratteri (OCR) v2 è stato introdotto nelle istanze del servizio gestito dal cloud il 2 novembre 2022. OCR v2 è stato introdotto nelle istanze IBM Cloud Pak for Data con versione 4.7.1.

Supporto solo in inglese

Le seguenti funzioni al momento sono supportate solo per l'inglese:


  1. Il serbo supporta solo la scrittura latina. ↩︎