Salesforce

Crawl documentos que são armazenados em uma fonte de dados Salesforce.

IBM Cloud IBM Cloud somente

Essas informações se aplicam apenas a implementações gerenciadas. Para obter mais informações sobre conexão com a Salesforce a partir de uma implementação instalada, consulte Salesforce.

Quais documentos estão engatinados

Durante o crawl inicial do conteúdo, os documentos de todos os objetos que podem ser acessados a partir da URL especificada são submetidos a crawl e incluídos em sua coleta. Os artigos de conhecimento são rastreados somente se sua versão for published e seus idiomas forem en-us.

Durante os recritos programados subsequentes, apenas documentos novos e modificados são engatinados e quaisquer alterações são refletidas em sua coleção. Os documentos que são excluídos da fonte de dados externos não são excluídos da coleção.

Todos os conectores de origem de dados Discovery são de leitura. Independentemente das permissões que são concedidas à conta de crawl, Discovery nunca grava, atualiza ou exclui qualquer conteúdo na origem de dados original.

Discovery pode engatinhar os seguintes objetos:

  • Qualquer objeto padrão e personalizado que você tem acesso a
  • Contas
  • Contatos
  • Casos
  • Contratos
  • Artigos de conhecimento
  • Anexos

Requisitos da origem de dados

Além dos requisitos de origem de dados para todas as implementações gerenciadas, a sua fonte de dados Salesforce deve atender aos seguintes requisitos:

  • A instância que você planeja se conectar deve fazer parte de um plano de Empresa ou superior.
  • Você deve obter quaisquer licenças de serviço necessárias para a fonte de dados com a qual você deseja se conectar. Para obter mais informações sobre licenças, entre em contato com o administrador do sistema da fonte de dados.

O que você precisa antes de começar

Você deve ter as seguintes informações prontas. Se você não conhece, peça ao seu administrador Salesforce para fornecer as informações ou consultar a documentação do desenvolvedor Salesforce.

Nome do usuário
O username de uma conta que tem acesso ao site Salesforce. Por exemplo, jdoe@example.com
Senha
A senha associada ao nome de usuário. Por exemplo, myP@ssw0rd.
Token de serviço
Um token de segurança Salesforce válido. Por exemplo, mnaO8jsRET5CiJww9JnURlNN.
URL
A URL do site Salesforce que você deseja efetuar crawl. Por exemplo,https://my.salesforce.com

Conectando-se à fonte de dados

Para configurar a fonte de dados Salesforce, complete as seguintes etapas em Discovery:

  1. A partir da pane de navegação, escolha Gerenciar coleções.

  2. Clique em New collection (Nova coleção ).

  3. Clique no link próximo a Necessidade de se conectar a uma origem de dados? clique em Salesforce e, em seguida, clique em Avançar.

  4. Inclua valores nos seguintes campos:

    • Nome do usuário

    • Senha mais token de serviço

      Para formar a senha, concatene os valores de token de Senha e de Serviço que você observou anteriormente. Por exemplo, myP@ssw0rdmnaO8jsRET5CiJww9JnURlNN. Os valores de senha e token nunca são retornados e são usados apenas quando as credenciais são criadas ou modificadas.

    • URL

    Clique em Próximo.

  5. Nomeia a coleção.

  6. Se a linguagem dos documentos no site não for o inglês, selecione a linguagem apropriada.

    Para obter uma lista de idiomas suportados, consulte Suporte ao idioma.

  7. Opcional: Alterar o cronograma de sincronização.

    Para obter mais informações, consulte Opções de planejamento de Crawl.

  8. Selecione os objetos que você deseja rastrear.

    Quanto mais objetos selecionam, mais tempo o processamento dos documentos leva.

  9. Se você deseja limitar os tipos de arquivos a serem incluídos na coleção, é possível listar as extensões de arquivo para os tipos de arquivo a serem incluídos ou excluídos

    Ao escolher listar extensões para tipos de arquivo a serem excluídos, deve-se incluir pelo menos uma extensão de arquivo.

    Para obter uma lista de tipos de arquivos suportados, consulte Tipos de Arquivos Suportados

  10. Se você deseja que o crawler extraia texto a partir de imagens no site, expanda Mais configurações de processamentoe configure Aplicar reconhecimento de caracteres ópticos (OCR) a On.

    Quando o OCR é ativado e seus documentos contêm imagens, o processamento demora mais. Para obter mais informações, consulte Reconhecimento de caracteres Ópticos.

  11. Clique em Finish.

A coleção é criada rapidamente. É preciso mais tempo para que os dados sejam processados conforme ele é adicionado à coleção.

Se você quiser verificar o progresso, acesse a página Atividade. A partir da pane de navegação, clique em Gerenciar coleções e, em seguida, clique para abrir a coleção.