HCL Notes
Eseguire il crawling di un database HCL Notes (precedentemente Lotus Notes).
IBM Cloud Pak for Data IBM Software Hub
Queste informazioni si applicano solo alle distribuzioni installate.
Quali documenti vengono carrellati
- Ciascun documento del database HCL Notes viene strisciato e aggiunto alla raccolta come documento.
- Se un documento HCL Notes ha un allegato file e si sceglie di elaborare gli allegati file, solo i documenti supportati da Discovery vengono strisciati; tutti gli altri vengono ignorati. Per ulteriori informazioni, vedere Tipi di file supportati.
- Se si sceglie di elaborare gli allegati, il crawler tenta di scansionare e indicizzare i file allegati ai documenti HCL Notes. I tipi di file supportati da Discovery sono indicizzati. Per ulteriori informazioni, vedere Tipi di file supportati.
- È supportata la sicurezza a livello di documento. Quando questa opzione è attivata, gli utenti possono eseguire il crawling e la query dello stesso contenuto a cui possono accedere quando sono connessi a HCL Notes. Per ulteriori informazioni, vedere Supporto della sicurezza a livello di documento.
- Quando una fonte viene ricaricata, i nuovi documenti vengono aggiunti, i documenti aggiornati vengono modificati nella versione corrente e i documenti eliminati vengono eliminati dall'indice della raccolta.
- Tutti i connettori dell'origine dati Discovery sono di sola lettura. Indipendentemente dalle autorizzazioni concesse all'account di crawl, Discovery non scrive, aggiorna o cancella mai alcun contenuto nell'origine dati originale.
Requisiti dell'origine dati
Oltre ai requisiti dell'origine dati per tutte le distribuzioni installate, l'origine dati HCL Notes deve soddisfare i seguenti requisiti:
- L'origine dei dati può strisciare HCL Notes 9.0.1 database.
- L'origine dati HCL Notes supporta solo il protocollo Domino Internet Inter-ORB Protocol (DIIOP).
- Per eseguire il crawling dei documenti, comprese le ACL, è necessario disporre di un accesso di livello almeno
Readeral server, al database e all'accesso ai documenti sul server Domino. - Per le estrazioni di gruppi dalla directory LDAP interna di Domino, è necessario avere
Readeraccesso al database della directorynames.nsf. - Per l'estrazione dei gruppi dalla directory LDAP esterna, è necessario disporre delle credenziali del server LDAP esterno.
procedura
prerequisita
-
Se si desidera attivare la sicurezza a livello di documento, è necessario eseguire alcune operazioni per impostarla. Per ulteriori informazioni, vedere Supporto della sicurezza a livello di documento.
È possibile utilizzare il server LDAP utilizzato da HCL Notes (la directory LDAP interna di Domino o una directory LDAP esterna) come directory LDAP remota per gestire la sicurezza a livello di documento. Gli utenti che effettuano ricerche nella raccolta possono essere elencati in una directory LDAP esterna. Tuttavia, le credenziali utente utilizzate per impostare il crawl devono appartenere a un utente presente nella directory LDAP interna di Domino.
Per configurare la sicurezza a livello di documento, è necessario raccogliere le seguenti informazioni:
- URL server LDAP
- Il server LDAP URL a cui connettersi. Ad esempio,
ldap://<ldap_server>:<port>. - Nome utente vincolato LDAP
- Il nome utente da usare per collegarsi al servizio di directory. Questo utente deve avere accesso amministrativo ed essere elencato nella directory LDAP interna di Domino.
- Password utente vincolante LDAP
- La password associata all'utente.
- DN base LDAP
- Il punto di partenza per la ricerca delle voci degli utenti in LDAP. Ad esempio,
CN=Users,DC=example,DC=com. - Filtro utente LDAP
- Il filtro da applicare alle ricerche di voci di utenti in LDAP. Se non specificato, il valore predefinito è
(userPrincipalName=\{0\}). - Filtro gruppo LDAP
- Il filtro da applicare alle ricerche di voci di gruppo in LDAP.
-
Prima di poter strisciare i server utilizzando il protocollo Domino Internet Inter-ORB Protocol (DIIOP), è necessario configurare il server HCL Notes per utilizzare il protocollo. Sul server che si desidera eseguire il crawling devono essere in esecuzione i task DIIOP e HTTP.
Per configurare il server HCL Notes in modo che utilizzi DIIOP, completare le seguenti operazioni:
-
Configurare il documento del server HCL Notes.
-
In HCL Notes, aprire il documento
serversul server HCL Notes che si vuole crawlare. Questo documento è memorizzato nella directory Domino. -
Nella pagina Configurazione, espandere la sezione server.
-
Nella pagina Sicurezza, nella sezione Limitazioni di programmabilità, specificare le restrizioni di sicurezza appropriate per l'ambiente nei tre campi seguenti:
- Eseguire gli agenti ristretti Lotus Script/Java
- Esecuzione limitata Java/Javascript/COM
- Eseguire senza restrizioni Java/Javascript/COM
Ad esempio, si può specificare un asterisco (
*) per consentire l'accesso illimitato agli agenti LotusScript/Java e specificare i nomi utente registrati nella directory Domino per le restrizioni Java/JavaScript/COM.Per eseguire il crawling di un server che utilizza il protocollo DIIOP, il crawler configurato deve poter accedere ai nomi utente specificati in questi campi.
-
Aprire la pagina Internet Protocol, quindi aprire la pagina HTTP. Impostare l'opzione Consenti ai client di HTTP di sfogliare il database su Sì.
-
-
Configurare il documento utente.
-
Aprire il documento
userdell'utente di cui si vogliono usare le credenziali per il binding LDAP. Questo documento è memorizzato nella directory Domino. -
Nella pagina Fondamenti, nel campo Password di Internet, specificare una password.
Le informazioni sull'utente e sulla password vengono specificate durante la configurazione dell'origine dati.
-
-
Riavviare l'attività DIIOP sul server HCL Notes.
Per ulteriori informazioni, vedere Esecuzione delle attività del server nella documentazione di HCL Notes.
Connessione a un'origine dati HCL Notes
Dal progetto Discovery, completare i seguenti passaggi:
-
Nel riquadro di navigazione, scegliere Gestione collezioni.
-
Fare clic su Nuova raccolta.
-
Fare clic su Note, quindi su Avanti.
-
Dare un nome alla collezione.
-
Se la lingua dei documenti in HCL Notes non è l'inglese, selezionare la lingua appropriata.
Per un elenco delle lingue supportate, vedi Supporto linguistico.
-
Opzionale: Modificare la pianificazione della sincronizzazione.
Per ulteriori informazioni, vedere Opzioni di pianificazione delrawl.
-
Nella sezione Inserire le credenziali, aggiungere i valori ai seguenti campi:
- Nome host
- Il nome host del server HCL Notes.
- Nome utente
- Il nome utente da utilizzare per accedere al server HCL Notes.
- Password
- La password associata all'utente.
-
In Tipo di crawl, scegliere ciò che si desidera crawlare tra le seguenti opzioni:
- Se si desidera eseguire il crawling di un database HCL Notes specifico, scegliere Database, quindi aggiungere il nome del file del database al campo Nome del file del database.
- Se si desidera eseguire il crawling di più database, scegliere Directory. Nel campo Nome directory specificare la directory in cui sono memorizzati i database che si desidera sottoporre a crawling.
-
Opzionale: nella sezione Sicurezza, specificare se si desidera abilitare la sicurezza a livello di documento.
-
Se si desidera attivare la sicurezza a livello di documento, impostare l'interruttore Abilita sicurezza a livello di documento su
On.Se impostato su On, gli utenti possono eseguire il crawling dello stesso contenuto a cui hanno accesso in un database o in una directory di HCL Notes.
-
Per utilizzare la directory LDAP di Domino, impostare l'interruttore Usa directory LDAP remota su
On. Fornire dettagli sulla directory LDAP di Domino. Queste informazioni sono state raccolte durante l'esecuzione della fase di prerequisito.- URL server LDAP
- Il server LDAP URL a cui connettersi. Ad esempio,
ldap://<ldap_server>:<port>. - Nome utente vincolato LDAP
- Il nome utente da usare per collegarsi al servizio di directory.
- Password utente vincolante LDAP
- La password associata all'utente.
- DN base LDAP
- Il punto di partenza per la ricerca delle voci degli utenti in LDAP. Ad esempio,
CN=Users,DC=example,DC=com. - Filtro utente LDAP
- Il filtro da applicare alle ricerche di voci di utenti in LDAP. Se non specificato, il valore predefinito è
(userPrincipalName=\{0\}). - Filtro gruppo LDAP
- Il filtro da applicare alle ricerche di voci di gruppo in LDAP.
-
-
Opzionali: nella sezione Opzioni avanzate, è possibile scegliere le seguenti impostazioni di configurazione:
- Accessori per il trasporto a strisciamento
-
Se si desidera strisciare i file allegati ai documenti HCL Notes, impostare il selettore su
On. - Rilevamento automatico della pagina di codice
-
Se si desidera che il convertitore di codifica rilevi il codice delle pagine da sottoporre a crawling, mantenere l'interruttore impostato su
On. Se si imposta il selettore suOff, specificare i valori dei seguenti campi:- Pagina di codice da utilizzare
- Specificare la codifica dei caratteri delle pagine che si desidera sottoporre a crawling. Se non specificato, viene utilizzato il valore predefinito di
UTF-8. - Formula delle note
- Specificare una formula HCL Notes da usare per filtrare i dati da strisciare. Ad esempio,
SELECT @IsAvailable(Year) & Year > 2003. Per ulteriori informazioni, vedere Linguaggio delle formule nella documentazione di HCL Notes.
-
Specificare la data che si desidera utilizzare per filtrare i documenti. La data viene memorizzata in un campo denominato
_ _$Date$_ _nei documenti HCL Notes. Per impostazione predefinita, il campo memorizza la data dell'ultima modifica del documento. È possibile scegliere una data diversa da memorizzare nel campo.- Data di modifica del documento
- Utilizza la data dell'ultima modifica del documento. Questa opzione è selezionata per impostazione predefinita.
- Data di estrazione del documento
- Utilizza la data dell'ultimo crawling.
- Data di creazione del documento
- Utilizza la data di creazione del documento.
-
Se si desidera che il crawler estragga il testo dalle immagini nei documenti, espandere Altre impostazioni di elaborazione e impostare Applica il riconoscimento ottico dei caratteri (OCR) su
On.Quando l'OCR è abilitato e i documenti contengono immagini, l'elaborazione richiede più tempo. Per ulteriori informazioni, vedere Riconoscimento ottico dei caratteri.
-
Fai clic su Finish.
La collezione viene creata rapidamente. L'elaborazione dei dati richiede più tempo per l'aggiunta alla raccolta.
Se si desidera controllare i progressi, andare alla pagina Attività. Nel riquadro di navigazione, fare clic su Gestione raccolte, quindi fare clic per aprire la raccolta.