Em uma próxima versão, o JVM incluído para o plug-in do rastreador e os recursos do conector do cliente serão transferidos para o IBM Semeru Runtimes, versão 21. Se o plug-in do rastreador ou os conectores personalizados utilizarem algum recurso incompatível entre IBM SDK, Java Technology Edition, Versão 8 e IBM Semeru Runtimes, Versão 21, será necessário revisar o código para garantir a compatibilidade com versões futuras, como o Discovery 5.2.x e posteriores.

Para a migração da JVM, consulte as páginas a seguir:

Criação de um plug-in de rastreamento personalizado

Discovery apresenta a opção de criar seu próprio plug-in de rastreador com um SDK Java. Ao usar plug-ins do crawler, agora é possível desenvolver rapidamente soluções relevantes para seus casos de uso. É possível fazer download do SDK de seu cluster instalado do Discovery. Para obter mais informações, consulte Obtendo o pacote SDK do plug-in do crawler.

IBM Cloud Pak for Data IBM Software Hub

Essas informações se aplicam apenas a implementações instaladas.

Qualquer código customizado usado com o IBM Watson® Discovery é de responsabilidade do desenvolvedor. O Suporte IBM não cobre nenhum código customizado criado pelo desenvolvedor.

Os plug-ins do crawler suportam as funções a seguir:

  • Atualizar a lista de metadados de um documento submetido a crawl
  • Atualizar o conteúdo de um documento submetido a crawl
  • Excluir um documento submetido a crawl
  • Configurações de referência do rastreador, mascarando valores de senha
  • Mostrar mensagens de aviso na interface do usuário Discovery
  • Mensagens de registro de saída para o console do pod crawler

No entanto, os plug-ins crawler não são compatíveis com as seguintes funções:

  • Dividir um documento submetido a crawl em diversos documentos
  • Combinar o conteúdo de diversos documentos em um único documento
  • Modificar listas de controle de acesso

Requisitos de plug-in do crawler

Certise-se de que os itens a seguir estão instalados no servidor de desenvolvimento que você planeja usar para desenvolver um plug-in crawler usando este SDK:

  • Kit de Desenvolvimento de Java SE (JDK) 1.8 ou superior
  • Gradle
  • cURL
  • sed (editor de fluxo)

Obtendo o pacote SDK do plug-in do crawler

  1. Efetue login em seu cluster do Discovery.

  2. Digite o seguinte comando para obter o nome do pod crawler :

    oc get pods | grep crawler
    

    O exemplo a seguir mostra um exemplo de saída.

    wd-discovery-crawler-57985fc5cf-rxk89     1/1     Running     0          85m
    
  3. Digite o seguinte comando para obter o nome do pacote SDK, substituindo {crawler-pod-name} pelo nome do pod crawler que você obteve na etapa 2:

    oc exec {crawler-pod-name} -- ls -l /opt/ibm/wex/zing/resources/ | grep wd-crawler-plugin-sdk
    

    O exemplo a seguir mostra um exemplo de saída.

    -rw-r--r--. 1 dadmin dadmin 35575 Oct  1 16:51 wd-crawler-plugin-sdk-${build-version}.zip
    
  4. Insira o comando a seguir para copiar o pacote SDK para o servidor host, substituindo {build-version} pelo número da versão de compilação da etapa anterior:

    oc cp {crawler-pod-name}:/opt/ibm/wex/zing/resources/wd-crawler-plugin-sdk-${build-version}.zip wd-crawler-plugin-sdk.zip
    
  5. Se necessário, copie o pacote SDK para o servidor de desenvolvimento.

Construindo um pacote de plug-in do crawler

  1. Extraia o arquivo compactado do SDK.
  2. Implemente a lógica de plug-in em src/. Certifique-se de que a dependência esteja escrita em build.gradle.
  3. Insira gradle packageCrawlerPlugin para criar o pacote de plug-in. O pacote é gerado como build/distributed/wd-crawler-plugin-sample.zip.