Support linguistique
Lorsque vous créez une collection, vous spécifiez la langue de la collection. Tous les documents que vous ajoutez à une collection doivent être écrits dans la même langue.
La reconnaissance n'est pas optimisée pour la recherche multilingue. Bien que vous puissiez ajouter plusieurs collections, chacune avec des documents dans une langue distincte, dans un seul projet, les résultats de la requête du projet seront imprévisibles. Les résultats peuvent inclure des passages non pertinents d'un document dans une langue différente de la langue de la requête de l'utilisateur.
Le tableau suivant décrit les fonctions du produit prises en charge dans chaque langue.
| Langue | Fonctions prises en charge |
|---|---|
Arabe (ar) |
modèles de règles avancées, entités intégrées, classificateur (document et texte), entités personnalisées, dictionnaire, sentiment de document, mots clés, Machine Learning, reconnaissance optique des caractères v1, parties du discours, expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Bosniaque (bs) |
Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Parties de discours, Expressions régulières |
Chinois simplifié (zh-CN) |
Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v1, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Table Understanding |
Chinois traditionnel (zh-TW) |
Modèles de règles avancées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, Expressions régulières, Machine Learning, Reconnaissance optique des caractères v1, Parties de parole, Sentiment de phrase, Smart Document Understanding, Table Understanding |
Croate (hr) |
Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Expressions régulières, Parties de discours |
Tchèque (cs) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Danois (da) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Néerlandais (nl) |
Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Anglais (en) |
Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Contrats, Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Finnois (fi) |
Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Français (fr) |
Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Allemand (de) |
Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Hébreu (he) |
Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v2, Parties de la parole, Expressions régulières, Smart Document Understanding, Table Understanding. La fonction de reconnaissance optique des caractères (OCR) pour le texte en hébreu dans les images est une fonction bêta de Discovery. Pour plus d'informations, voir Release notes for Discovery for IBM Cloud. |
Hindi (hi) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Parties de discours, Expressions régulières, Stemmer |
Italien (it) |
modèles de règles avancées, entités intégrées, classificateur (document et texte), entités personnalisées, dictionnaire, sentiment de document, mots clés, Machine Learning, reconnaissance optique des caractères v1, parties du discours, expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Japonais (ja) |
Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v1, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Table Understanding |
Coréen (ko) |
Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v1, Parties de discours, Expressions régulières, Smart Document Understanding, Table Understanding |
Norvégien (Bokmål) (nb) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Norvégien (Nynorsk) (nn) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Polonais (pl) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Table Understanding |
Portugais brésilien (pt-br) |
Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Roumain (ro) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Russe (ru) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Serbe (sr)[1] |
Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Parties de discours, Expressions régulières |
Slovaque (sk) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Table Understanding |
Espagnol (es) |
Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
Suédois (sv) |
Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding |
La reconnaissance optique des caractères (OCR) v2 a été introduite dans les instances de service gérées par le cloud le 2 novembre 2022. OCR v2 a été introduit dans les instances IBM Cloud Pak for Data avec la version 4.7.1.
Prise en charge de l'anglais uniquement
Actuellement les fonctions suivantes sont prises en charge en anglais uniquement :
-
Le serbe ne prend en charge que le script Latin. ↩︎