HCL Notes

Eseguire il crawling di un database HCL Notes (precedentemente Lotus Notes).

IBM Cloud Pak for Data IBM Software Hub

Queste informazioni si applicano solo alle distribuzioni installate.

Quali documenti vengono carrellati

  • Ciascun documento del database HCL Notes viene strisciato e aggiunto alla raccolta come documento.
  • Se un documento HCL Notes ha un allegato file e si sceglie di elaborare gli allegati file, solo i documenti supportati da Discovery vengono strisciati; tutti gli altri vengono ignorati. Per ulteriori informazioni, vedere Tipi di file supportati.
  • Se si sceglie di elaborare gli allegati, il crawler tenta di scansionare e indicizzare i file allegati ai documenti HCL Notes. I tipi di file supportati da Discovery sono indicizzati. Per ulteriori informazioni, vedere Tipi di file supportati.
  • È supportata la sicurezza a livello di documento. Quando questa opzione è attivata, gli utenti possono eseguire il crawling e la query dello stesso contenuto a cui possono accedere quando sono connessi a HCL Notes. Per ulteriori informazioni, vedere Supporto della sicurezza a livello di documento.
  • Quando una fonte viene ricaricata, i nuovi documenti vengono aggiunti, i documenti aggiornati vengono modificati nella versione corrente e i documenti eliminati vengono eliminati dall'indice della raccolta.
  • Tutti i connettori dell'origine dati Discovery sono di sola lettura. Indipendentemente dalle autorizzazioni concesse all'account di crawl, Discovery non scrive, aggiorna o cancella mai alcun contenuto nell'origine dati originale.

Requisiti dell'origine dati

Oltre ai requisiti dell'origine dati per tutte le distribuzioni installate, l'origine dati HCL Notes deve soddisfare i seguenti requisiti:

  • L'origine dei dati può strisciare HCL Notes 9.0.1 database.
  • L'origine dati HCL Notes supporta solo il protocollo Domino Internet Inter-ORB Protocol (DIIOP).
  • Per eseguire il crawling dei documenti, comprese le ACL, è necessario disporre di un accesso di livello almeno Reader al server, al database e all'accesso ai documenti sul server Domino.
  • Per le estrazioni di gruppi dalla directory LDAP interna di Domino, è necessario avere Reader accesso al database della directory names.nsf.
  • Per l'estrazione dei gruppi dalla directory LDAP esterna, è necessario disporre delle credenziali del server LDAP esterno.

procedura

prerequisita

  • Se si desidera attivare la sicurezza a livello di documento, è necessario eseguire alcune operazioni per impostarla. Per ulteriori informazioni, vedere Supporto della sicurezza a livello di documento.

    È possibile utilizzare il server LDAP utilizzato da HCL Notes (la directory LDAP interna di Domino o una directory LDAP esterna) come directory LDAP remota per gestire la sicurezza a livello di documento. Gli utenti che effettuano ricerche nella raccolta possono essere elencati in una directory LDAP esterna. Tuttavia, le credenziali utente utilizzate per impostare il crawl devono appartenere a un utente presente nella directory LDAP interna di Domino.

    Per configurare la sicurezza a livello di documento, è necessario raccogliere le seguenti informazioni:

    URL server LDAP
    Il server LDAP URL a cui connettersi. Ad esempio, ldap://<ldap_server>:<port>.
    Nome utente vincolato LDAP
    Il nome utente da usare per collegarsi al servizio di directory. Questo utente deve avere accesso amministrativo ed essere elencato nella directory LDAP interna di Domino.
    Password utente vincolante LDAP
    La password associata all'utente.
    DN base LDAP
    Il punto di partenza per la ricerca delle voci degli utenti in LDAP. Ad esempio, CN=Users,DC=example,DC=com.
    Filtro utente LDAP
    Il filtro da applicare alle ricerche di voci di utenti in LDAP. Se non specificato, il valore predefinito è (userPrincipalName=\{0\}).
    Filtro gruppo LDAP
    Il filtro da applicare alle ricerche di voci di gruppo in LDAP.
  • Prima di poter strisciare i server utilizzando il protocollo Domino Internet Inter-ORB Protocol (DIIOP), è necessario configurare il server HCL Notes per utilizzare il protocollo. Sul server che si desidera eseguire il crawling devono essere in esecuzione i task DIIOP e HTTP.

Per configurare il server HCL Notes in modo che utilizzi DIIOP, completare le seguenti operazioni:

  1. Configurare il documento del server HCL Notes.

    • In HCL Notes, aprire il documento server sul server HCL Notes che si vuole crawlare. Questo documento è memorizzato nella directory Domino.

    • Nella pagina Configurazione, espandere la sezione server.

    • Nella pagina Sicurezza, nella sezione Limitazioni di programmabilità, specificare le restrizioni di sicurezza appropriate per l'ambiente nei tre campi seguenti:

      • Eseguire gli agenti ristretti Lotus Script/Java
      • Esecuzione limitata Java/Javascript/COM
      • Eseguire senza restrizioni Java/Javascript/COM

      Ad esempio, si può specificare un asterisco (*) per consentire l'accesso illimitato agli agenti LotusScript/Java e specificare i nomi utente registrati nella directory Domino per le restrizioni Java/JavaScript/COM.

      Per eseguire il crawling di un server che utilizza il protocollo DIIOP, il crawler configurato deve poter accedere ai nomi utente specificati in questi campi.

    • Aprire la pagina Internet Protocol, quindi aprire la pagina HTTP. Impostare l'opzione Consenti ai client di HTTP di sfogliare il database su .

  2. Configurare il documento utente.

    • Aprire il documento user dell'utente di cui si vogliono usare le credenziali per il binding LDAP. Questo documento è memorizzato nella directory Domino.

    • Nella pagina Fondamenti, nel campo Password di Internet, specificare una password.

      Le informazioni sull'utente e sulla password vengono specificate durante la configurazione dell'origine dati.

  3. Riavviare l'attività DIIOP sul server HCL Notes.

Per ulteriori informazioni, vedere Esecuzione delle attività del server nella documentazione di HCL Notes.

Connessione a un'origine dati HCL Notes

Dal progetto Discovery, completare i seguenti passaggi:

  1. Nel riquadro di navigazione, scegliere Gestione collezioni.

  2. Fare clic su Nuova raccolta.

  3. Fare clic su Note, quindi su Avanti.

  4. Dare un nome alla collezione.

  5. Se la lingua dei documenti in HCL Notes non è l'inglese, selezionare la lingua appropriata.

    Per un elenco delle lingue supportate, vedi Supporto linguistico.

  6. Opzionale: Modificare la pianificazione della sincronizzazione.

    Per ulteriori informazioni, vedere Opzioni di pianificazione delrawl.

  7. Nella sezione Inserire le credenziali, aggiungere i valori ai seguenti campi:

    Nome host
    Il nome host del server HCL Notes.
    Nome utente
    Il nome utente da utilizzare per accedere al server HCL Notes.
    Password
    La password associata all'utente.
  8. In Tipo di crawl, scegliere ciò che si desidera crawlare tra le seguenti opzioni:

    • Se si desidera eseguire il crawling di un database HCL Notes specifico, scegliere Database, quindi aggiungere il nome del file del database al campo Nome del file del database.
    • Se si desidera eseguire il crawling di più database, scegliere Directory. Nel campo Nome directory specificare la directory in cui sono memorizzati i database che si desidera sottoporre a crawling.
  9. Opzionale: nella sezione Sicurezza, specificare se si desidera abilitare la sicurezza a livello di documento.

    • Se si desidera attivare la sicurezza a livello di documento, impostare l'interruttore Abilita sicurezza a livello di documento su On.

      Se impostato su On, gli utenti possono eseguire il crawling dello stesso contenuto a cui hanno accesso in un database o in una directory di HCL Notes.

    • Per utilizzare la directory LDAP di Domino, impostare l'interruttore Usa directory LDAP remota su On. Fornire dettagli sulla directory LDAP di Domino. Queste informazioni sono state raccolte durante l'esecuzione della fase di prerequisito.

      URL server LDAP
      Il server LDAP URL a cui connettersi. Ad esempio, ldap://<ldap_server>:<port>.
      Nome utente vincolato LDAP
      Il nome utente da usare per collegarsi al servizio di directory.
      Password utente vincolante LDAP
      La password associata all'utente.
      DN base LDAP
      Il punto di partenza per la ricerca delle voci degli utenti in LDAP. Ad esempio, CN=Users,DC=example,DC=com.
      Filtro utente LDAP
      Il filtro da applicare alle ricerche di voci di utenti in LDAP. Se non specificato, il valore predefinito è (userPrincipalName=\{0\}).
      Filtro gruppo LDAP
      Il filtro da applicare alle ricerche di voci di gruppo in LDAP.
  10. Opzionali: nella sezione Opzioni avanzate, è possibile scegliere le seguenti impostazioni di configurazione:

    Accessori per il trasporto a strisciamento

    Se si desidera strisciare i file allegati ai documenti HCL Notes, impostare il selettore su On.

    Rilevamento automatico della pagina di codice

    Se si desidera che il convertitore di codifica rilevi il codice delle pagine da sottoporre a crawling, mantenere l'interruttore impostato su On. Se si imposta il selettore su Off, specificare i valori dei seguenti campi:

    Pagina di codice da utilizzare
    Specificare la codifica dei caratteri delle pagine che si desidera sottoporre a crawling. Se non specificato, viene utilizzato il valore predefinito di UTF-8.
    Formula delle note
    Specificare una formula HCL Notes da usare per filtrare i dati da strisciare. Ad esempio, SELECT @IsAvailable(Year) & Year > 2003. Per ulteriori informazioni, vedere Linguaggio delle formule nella documentazione di HCL Notes.
  11. Specificare la data che si desidera utilizzare per filtrare i documenti. La data viene memorizzata in un campo denominato _ _$Date$_ _ nei documenti HCL Notes. Per impostazione predefinita, il campo memorizza la data dell'ultima modifica del documento. È possibile scegliere una data diversa da memorizzare nel campo.

    Data di modifica del documento
    Utilizza la data dell'ultima modifica del documento. Questa opzione è selezionata per impostazione predefinita.
    Data di estrazione del documento
    Utilizza la data dell'ultimo crawling.
    Data di creazione del documento
    Utilizza la data di creazione del documento.
  12. Se si desidera che il crawler estragga il testo dalle immagini nei documenti, espandere Altre impostazioni di elaborazione e impostare Applica il riconoscimento ottico dei caratteri (OCR) su On.

    Quando l'OCR è abilitato e i documenti contengono immagini, l'elaborazione richiede più tempo. Per ulteriori informazioni, vedere Riconoscimento ottico dei caratteri.

  13. Fai clic su Finish.

La collezione viene creata rapidamente. L'elaborazione dei dati richiede più tempo per l'aggiunta alla raccolta.

Se si desidera controllare i progressi, andare alla pagina Attività. Nel riquadro di navigazione, fare clic su Gestione raccolte, quindi fare clic per aprire la raccolta.