Support linguistique

Lorsque vous créez une collection, vous spécifiez la langue de la collection. Tous les documents que vous ajoutez à une collection doivent être écrits dans la même langue.

La reconnaissance n'est pas optimisée pour la recherche multilingue. Bien que vous puissiez ajouter plusieurs collections, chacune avec des documents dans une langue distincte, dans un seul projet, les résultats de la requête du projet seront imprévisibles. Les résultats peuvent inclure des passages non pertinents d'un document dans une langue différente de la langue de la requête de l'utilisateur.

Le tableau suivant décrit les fonctions du produit prises en charge dans chaque langue.

Prise en charge des fonctions par langue
Langue Fonctions prises en charge
Arabe (ar) modèles de règles avancées, entités intégrées, classificateur (document et texte), entités personnalisées, dictionnaire, sentiment de document, mots clés, Machine Learning, reconnaissance optique des caractères v1, parties du discours, expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Bosniaque (bs) Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Parties de discours, Expressions régulières
Chinois simplifié (zh-CN) Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v1, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Table Understanding
Chinois traditionnel (zh-TW) Modèles de règles avancées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, Expressions régulières, Machine Learning, Reconnaissance optique des caractères v1, Parties de parole, Sentiment de phrase, Smart Document Understanding, Table Understanding
Croate (hr) Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Expressions régulières, Parties de discours
Tchèque (cs) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Danois (da) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Néerlandais (nl) Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Anglais (en) Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Contrats, Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Finnois (fi) Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Français (fr) Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Allemand (de) Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Hébreu (he) Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v2, Parties de la parole, Expressions régulières, Smart Document Understanding, Table Understanding. La fonction de reconnaissance optique des caractères (OCR) pour le texte en hébreu dans les images est une fonction bêta de Discovery. Pour plus d'informations, voir Release notes for Discovery for IBM Cloud.
Hindi (hi) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Parties de discours, Expressions régulières, Stemmer
Italien (it) modèles de règles avancées, entités intégrées, classificateur (document et texte), entités personnalisées, dictionnaire, sentiment de document, mots clés, Machine Learning, reconnaissance optique des caractères v1, parties du discours, expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Japonais (ja) Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v1, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Table Understanding
Coréen (ko) Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v1, Parties de discours, Expressions régulières, Smart Document Understanding, Table Understanding
Norvégien (Bokmål) (nb) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Norvégien (Nynorsk) (nn) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Polonais (pl) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Table Understanding
Portugais brésilien (pt-br) Modèles de règles avancées, Entités intégrées, Classificateur (document et texte), Entités personnalisées, Dictionnaire, sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Roumain (ro) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Russe (ru) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Serbe (sr)[1] Discriminant (Document et texte), Entités personnalisées, Dictionnaire, Parties de discours, Expressions régulières
Slovaque (sk) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Table Understanding
Espagnol (es) Modèles de règles avancées, Entités intégrées, Classificateur (Document et Texte), Entités personnalisées, Dictionnaire, Sentiment de document, Mots clés, Machine Learning, Reconnaissance optique des caractères v2, Parties de discours, Sentiment de phrase, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding
Suédois (sv) Discriminant (Document et Texte), Entités personnalisées, Dictionnaire, Reconnaissance optique des caractères v1, Parties de la parole, Expressions régulières, Smart Document Understanding, Stemmer, Table Understanding

La reconnaissance optique des caractères (OCR) v2 a été introduite dans les instances de service gérées par le cloud le 2 novembre 2022. OCR v2 a été introduit dans les instances IBM Cloud Pak for Data avec la version 4.7.1.

Prise en charge de l'anglais uniquement

Actuellement les fonctions suivantes sont prises en charge en anglais uniquement :


  1. Le serbe ne prend en charge que le script Latin. ↩︎