In una prossima release, la JVM in bundle per il plug-in crawler e le funzionalità del connettore cliente passerà a IBM Semeru Runtimes, Versione 21. Se il plug-in del crawler o i connettori personalizzati utilizzano funzioni incompatibili tra IBM SDK, Java Technology Edition, versione 8 e IBM Semeru Runtimes, versione 21, è necessario rivedere il codice per garantire la compatibilità con le versioni future, come Discovery 5.2.x e successive.
Per la migrazione della JVM, vedere le pagine seguenti:
- https://www.ibm.com/support/pages/semeru-runtimes-migration-guide
- https://www.ibm.com/support/pages/semeru-runtimes-security-migration-guide
Costruzione di un cingolato personalizzato
Discovery offre l'opzione per creare il tuo plug-in del crawler con un SDK Java. Utilizzando i plug-in del crawler, è ora possibile sviluppare rapidamente soluzioni pertinenti per i propri casi di utilizzo. Puoi scaricare l'SDK dal tuo cluster Discovery installato. Per ulteriori informazioni, vedi Ottenimento del pacchetto SDK del plug-in del crawler.
IBM Cloud Pak for Data IBM Software Hub
Queste informazioni si applicano solo alle distribuzioni installate.
Qualsiasi codice personalizzato che utilizzi con IBM Watson® Discovery è responsabilità dello sviluppatore; il Supporto IBM non copre alcun codice personalizzato creato dallo sviluppatore.
I plug-in del crawler supportano le seguenti funzioni:
- Aggiorna l'elenco di metadati di un documento sottoposto a ricerca per indicizzazione
- Aggiorna il contenuto di un documento sottoposto a ricerca per indicizzazione
- Escludi un documento sottoposto a ricerca per indicizzazione
- Configurazioni crawler di riferimento, valori password di mascheramento
- Mostra i messaggi di avviso nell'interfaccia utente Discovery
- Output dei messaggi di log nella console del pod
crawler
Tuttavia, i plug-in crawler non possono supportare le seguenti funzioni:
- Suddividere un documento sottoposto a ricerca per indicizzazione in più documenti
- Combina il contenuto di più documenti in un unico documento
- Modifica ACL (Access Control List)
Requisiti del plug-in del crawler
Assicurarsi che i seguenti elementi siano installati sul server di sviluppo che si prevede di utilizzare per sviluppare un plug-in crawler utilizzando questo SDK.
- Java SE Development Kit (JDK) 1.8 o superiore
- Gradle
- cURL
- sed (editor del flusso)
Acquisizione del pacchetto SDK del plug-in del crawler
-
Accedi al tuo cluster Discovery.
-
Immetti il seguente comando per ottenere il tuo nome pod
crawler:oc get pods | grep crawlerL'esempio seguente mostra un esempio di output.
wd-discovery-crawler-57985fc5cf-rxk89 1/1 Running 0 85m -
Immetti il seguente comando per ottenere il nome del pacchetto SDK, sostituendo
{crawler-pod-name}con il nome podcrawlerche hai ottenuto nel passo 2:oc exec {crawler-pod-name} -- ls -l /opt/ibm/wex/zing/resources/ | grep wd-crawler-plugin-sdkL'esempio seguente mostra un esempio di output.
-rw-r--r--. 1 dadmin dadmin 35575 Oct 1 16:51 wd-crawler-plugin-sdk-${build-version}.zip -
Immettere il seguente comando per copiare il pacchetto SDK sul server host, sostituendo
{build-version}con il numero di versione di build del passo precedente:oc cp {crawler-pod-name}:/opt/ibm/wex/zing/resources/wd-crawler-plugin-sdk-${build-version}.zip wd-crawler-plugin-sdk.zip -
Se necessario, copiare il package SDK sul server di sviluppo.
Creazione di un pacchetto di plug-in del crawler
- Estrarre il file compresso SDK.
- Implementare la logica del plug-in in
src/. Assicurarsi che la dipendenza sia scritta inbuild.gradle. - Immettere
gradle packageCrawlerPluginper creare il pacchetto di plug - in. Il pacchetto viene generato comebuild/distributed/wd-crawler-plugin-sample.zip.