Suporte ao idioma

Ao criar uma coleção, especifique o idioma da coleção. Todos os documentos que você incluir em uma coleção devem ser gravados no mesmo idioma

A descoberta não é otimizada para pesquisa multilíngue. Embora seja possível incluir várias coleções, cada uma com documentos em um idioma separado, em um projeto, os resultados de consulta do projeto serão imprevisíveis Os resultados podem incluir passagens irrelevantes de um documento em um idioma diferente do idioma da consulta do usuário.

A tabela a seguir descreve os recursos do produto que são suportados em cada idioma.

Suporte de recurso por idioma
Idioma Recursos Suportados
Árabe (ar) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes de discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela
Bósnio (bs) Classificador (Documento e Texto), entidades personalizadas, Dicionário, Partes do discurso, expressões regulares
Chinês, simplificado (zh-CN) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes do discurso, Sentimento de frase, Expressões regulares, Smart Document Understanding, Table Understanding
Chinês, tradicional (zh-TW) Modelos de regras avançadas, Classificador (Documento e Texto), entidades Customizadas, Dicionário, Expressões Regulares, Machine Learning, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Impressão de Frase, Smart Document Understanding, Table Understanding
Croata (hr) Classificador (Documento e Texto), entidades personalizadas, Dicionário, Expressões regulares, Partes do discurso
Tcheco (cs) Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Sentimento de Frase, Expressões Regulares, Smart Document Understanding, Stemmer, Entendimento de Tabela
Dinamarquês (da) Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela
Holandês (nl) Modelos de regras avançadas, Entidades integradas, Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Partes do discurso, Sentimento de frase, Expressões regulares, Entendendo o documento inteligente, Stemmer, Entendendo a tabela
Inglês (en) Modelos de regras avançadas, Entidades integradas, Classificador (Documento e Texto), Contratos, Entidades customizadas, Dicionário, Sentimento do documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Partes do discurso, Sentimento da frase, Expressões regulares, Entendendo o documento inteligente, Stemmer, Entendimento de tabela
Finlandês (fi) Classificador (Documento e Texto), entidades personalizadas, Dicionário, Partes do discurso, expressões regulares, Smart Document Understanding, Stemmer, Table Understanding
Francês (fr) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Peças de fala, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela
Alemão (de) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Peças de fala, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela
Hebraico (he) Classificador (Documento e Texto), Entidades customizadas, Dicionário, Reconhecimento de caractere ótico v2, Partes do discurso, Expressões regulares, Smart Document Understanding, Table Understanding. O recurso de reconhecimento de caractere ótico (OCR) para texto de idioma hebraico em imagem é um recurso beta no Discovery. Para obter mais informações, consulte Notas sobre a liberação do Discovery para IBM Cloud.
Hindi (hi) Classificador (Documento e Texto), Entidades personalizadas, Dicionário, Partes do discurso, Expressões regulares, Stemmer
Italiano (it) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes de discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela
Japonês (ja) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes do discurso, Sentimento de frase, Expressões regulares, Smart Document Understanding, Table Understanding
Coreano (ko) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes de fala, Expressões regulares, Smart Document Understanding, Table Understanding
Norueguês (Bokmål) (nb) Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela
Norueguês (Nynorsk) (nn) Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela
Polonês (pl) Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Table Understanding
Português do Brasil (pt-br) Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Peças de fala, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela
Romeno (ro) Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Sentimento de Frase, Expressões Regulares, Smart Document Understanding, Stemmer, Entendimento de Tabela
Russo (ru) Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Sentimento de Frase, Expressões Regulares, Smart Document Understanding, Stemmer, Entendimento de Tabela
Sérvio (sr)[1] Classificador (Documento e Texto), entidades personalizadas, Dicionário, Partes do discurso, expressões regulares
Eslovaco (sk) Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Table Understanding
Espanhol (es) Modelos de regras avançadas, Entidades integradas, Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Partes do discurso, Sentimento de frase, Expressões regulares, Entendendo o documento inteligente, Stemmer, Entendendo a tabela
Sueco (sv) Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela

O reconhecimento de caracteres ópticos (OCR) v2 foi introduzido em instâncias de serviço gerenciadas em Cloud em 2 de novembro de 2022. O OCR v2 foi introduzido em instâncias do IBM Cloud Pak for Data com a versão 4.7.1.

Suporte somente em inglês

Os recursos a seguir são suportados atualmente apenas em inglês:


  1. O sérvio suporta apenas o script latino. ↩︎