In una prossima release, la JVM in bundle per il plug-in crawler e le funzionalità del connettore cliente passerà a IBM Semeru Runtimes, Versione 21. Se il plug-in del crawler o i connettori personalizzati utilizzano funzioni incompatibili tra IBM SDK, Java Technology Edition, versione 8 e IBM Semeru Runtimes, versione 21, è necessario rivedere il codice per garantire la compatibilità con le versioni future, come Discovery 5.2.x e successive.

Per la migrazione della JVM, vedere le pagine seguenti:

Costruzione di un cingolato personalizzato

Discovery offre l'opzione per creare il tuo plug-in del crawler con un SDK Java. Utilizzando i plug-in del crawler, è ora possibile sviluppare rapidamente soluzioni pertinenti per i propri casi di utilizzo. Puoi scaricare l'SDK dal tuo cluster Discovery installato. Per ulteriori informazioni, vedi Ottenimento del pacchetto SDK del plug-in del crawler.

IBM Cloud Pak for Data IBM Software Hub

Queste informazioni si applicano solo alle distribuzioni installate.

Qualsiasi codice personalizzato che utilizzi con IBM Watson® Discovery è responsabilità dello sviluppatore; il Supporto IBM non copre alcun codice personalizzato creato dallo sviluppatore.

I plug-in del crawler supportano le seguenti funzioni:

  • Aggiorna l'elenco di metadati di un documento sottoposto a ricerca per indicizzazione
  • Aggiorna il contenuto di un documento sottoposto a ricerca per indicizzazione
  • Escludi un documento sottoposto a ricerca per indicizzazione
  • Configurazioni crawler di riferimento, valori password di mascheramento
  • Mostra i messaggi di avviso nell'interfaccia utente Discovery
  • Output dei messaggi di log nella console del pod crawler

Tuttavia, i plug-in crawler non possono supportare le seguenti funzioni:

  • Suddividere un documento sottoposto a ricerca per indicizzazione in più documenti
  • Combina il contenuto di più documenti in un unico documento
  • Modifica ACL (Access Control List)

Requisiti del plug-in del crawler

Assicurarsi che i seguenti elementi siano installati sul server di sviluppo che si prevede di utilizzare per sviluppare un plug-in crawler utilizzando questo SDK.

  • Java SE Development Kit (JDK) 1.8 o superiore
  • Gradle
  • cURL
  • sed (editor del flusso)

Acquisizione del pacchetto SDK del plug-in del crawler

  1. Accedi al tuo cluster Discovery.

  2. Immetti il seguente comando per ottenere il tuo nome pod crawler :

    oc get pods | grep crawler
    

    L'esempio seguente mostra un esempio di output.

    wd-discovery-crawler-57985fc5cf-rxk89     1/1     Running     0          85m
    
  3. Immetti il seguente comando per ottenere il nome del pacchetto SDK, sostituendo {crawler-pod-name} con il nome pod crawler che hai ottenuto nel passo 2:

    oc exec {crawler-pod-name} -- ls -l /opt/ibm/wex/zing/resources/ | grep wd-crawler-plugin-sdk
    

    L'esempio seguente mostra un esempio di output.

    -rw-r--r--. 1 dadmin dadmin 35575 Oct  1 16:51 wd-crawler-plugin-sdk-${build-version}.zip
    
  4. Immettere il seguente comando per copiare il pacchetto SDK sul server host, sostituendo {build-version} con il numero di versione di build del passo precedente:

    oc cp {crawler-pod-name}:/opt/ibm/wex/zing/resources/wd-crawler-plugin-sdk-${build-version}.zip wd-crawler-plugin-sdk.zip
    
  5. Se necessario, copiare il package SDK sul server di sviluppo.

Creazione di un pacchetto di plug-in del crawler

  1. Estrarre il file compresso SDK.
  2. Implementare la logica del plug-in in src/. Assicurarsi che la dipendenza sia scritta in build.gradle.
  3. Immettere gradle packageCrawlerPlugin per creare il pacchetto di plug - in. Il pacchetto viene generato come build/distributed/wd-crawler-plugin-sample.zip.