Suporte ao idioma
Ao criar uma coleção, especifique o idioma da coleção. Todos os documentos que você incluir em uma coleção devem ser gravados no mesmo idioma
A descoberta não é otimizada para pesquisa multilíngue. Embora seja possível incluir várias coleções, cada uma com documentos em um idioma separado, em um projeto, os resultados de consulta do projeto serão imprevisíveis Os resultados podem incluir passagens irrelevantes de um documento em um idioma diferente do idioma da consulta do usuário.
A tabela a seguir descreve os recursos do produto que são suportados em cada idioma.
| Idioma | Recursos Suportados |
|---|---|
Árabe (ar) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes de discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela |
Bósnio (bs) |
Classificador (Documento e Texto), entidades personalizadas, Dicionário, Partes do discurso, expressões regulares |
Chinês, simplificado (zh-CN) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes do discurso, Sentimento de frase, Expressões regulares, Smart Document Understanding, Table Understanding |
Chinês, tradicional (zh-TW) |
Modelos de regras avançadas, Classificador (Documento e Texto), entidades Customizadas, Dicionário, Expressões Regulares, Machine Learning, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Impressão de Frase, Smart Document Understanding, Table Understanding |
Croata (hr) |
Classificador (Documento e Texto), entidades personalizadas, Dicionário, Expressões regulares, Partes do discurso |
Tcheco (cs) |
Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Sentimento de Frase, Expressões Regulares, Smart Document Understanding, Stemmer, Entendimento de Tabela |
Dinamarquês (da) |
Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela |
Holandês (nl) |
Modelos de regras avançadas, Entidades integradas, Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Partes do discurso, Sentimento de frase, Expressões regulares, Entendendo o documento inteligente, Stemmer, Entendendo a tabela |
Inglês (en) |
Modelos de regras avançadas, Entidades integradas, Classificador (Documento e Texto), Contratos, Entidades customizadas, Dicionário, Sentimento do documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Partes do discurso, Sentimento da frase, Expressões regulares, Entendendo o documento inteligente, Stemmer, Entendimento de tabela |
Finlandês (fi) |
Classificador (Documento e Texto), entidades personalizadas, Dicionário, Partes do discurso, expressões regulares, Smart Document Understanding, Stemmer, Table Understanding |
Francês (fr) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Peças de fala, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela |
Alemão (de) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Peças de fala, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela |
Hebraico (he) |
Classificador (Documento e Texto), Entidades customizadas, Dicionário, Reconhecimento de caractere ótico v2, Partes do discurso, Expressões regulares, Smart Document Understanding, Table Understanding. O recurso de reconhecimento de caractere ótico (OCR) para texto de idioma hebraico em imagem é um recurso beta no Discovery. Para obter mais informações, consulte Notas sobre a liberação do Discovery para IBM Cloud. |
Hindi (hi) |
Classificador (Documento e Texto), Entidades personalizadas, Dicionário, Partes do discurso, Expressões regulares, Stemmer |
Italiano (it) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes de discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela |
Japonês (ja) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes do discurso, Sentimento de frase, Expressões regulares, Smart Document Understanding, Table Understanding |
Coreano (ko) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v1, Partes de fala, Expressões regulares, Smart Document Understanding, Table Understanding |
Norueguês (Bokmål) (nb) |
Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela |
Norueguês (Nynorsk) (nn) |
Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela |
Polonês (pl) |
Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Table Understanding |
Português do Brasil (pt-br) |
Modelos de regras avançadas, entidades integradas, Classificador (Documento e Texto), entidades customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Peças de fala, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento de tabela |
Romeno (ro) |
Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Sentimento de Frase, Expressões Regulares, Smart Document Understanding, Stemmer, Entendimento de Tabela |
Russo (ru) |
Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do Discurso, Sentimento de Frase, Expressões Regulares, Smart Document Understanding, Stemmer, Entendimento de Tabela |
Sérvio (sr)[1] |
Classificador (Documento e Texto), entidades personalizadas, Dicionário, Partes do discurso, expressões regulares |
Eslovaco (sk) |
Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Table Understanding |
Espanhol (es) |
Modelos de regras avançadas, Entidades integradas, Classificador (Documento e Texto), Entidades Customizadas, Dicionário, Impressão de documento, Palavras-chave, Machine Learning, Reconhecimento de caractere ótico v2, Partes do discurso, Sentimento de frase, Expressões regulares, Entendendo o documento inteligente, Stemmer, Entendendo a tabela |
Sueco (sv) |
Classificador (Documento e Texto), entidades Customizadas, Dicionário, Reconhecimento de Caractere Ótico v1, Partes do discurso, Expressões regulares, Smart Document Understanding, Stemmer, Entendimento da tabela |
O reconhecimento de caracteres ópticos (OCR) v2 foi introduzido em instâncias de serviço gerenciadas em Cloud em 2 de novembro de 2022. O OCR v2 foi introduzido em instâncias do IBM Cloud Pak for Data com a versão 4.7.1.
Suporte somente em inglês
Os recursos a seguir são suportados atualmente apenas em inglês:
-
O sérvio suporta apenas o script latino. ↩︎