IBM Cloud Object Storage
Explorer des documents stockés dans une source de données IBM Cloud® Object Storage.
IBM Cloud IBM Cloud seulement
Ces informations s'appliquent uniquement aux déploiements gérés.
Quels documents sont explorés
Lors de l'exploration initiale du contenu, les documents de tout le contenu accessible à partir du noeud final de stockage sont explorés et ajoutés à votre collection. Il n'est pas possible d'explorer les points d'extrémité privés.
Lors des réexplorations planifiées suivantes, seuls les documents nouveaux et modifiés sont explorés et toutes les modifications sont reflétées dans votre collection. Les documents qui sont supprimés de la source de données externe ne sont pas supprimés de la collection.
Tous les connecteurs de source de données Discovery sont en lecture seule. Quels que soient les droits accordés au compte d'exploration, Discovery n'écrit, ne met à jour ou ne supprime jamais de contenu dans la source de données d'origine.
Le tableau suivant illustre les objets que Discovery peut explorer.
| Source de données | Objets explorés |
|---|---|
| IBM Cloud Object Storage | Compartiments, fichiers |
Ce dont vous avez besoin avant de commencer
Procurez-vous les licences de service requises pour le contenu du site Web auquel vous souhaitez vous connecter. Pour plus d'informations sur les licences, contactez l'administrateur système de la source de données.
- Noeud final
-
endpointpour vos données IBM Cloud Object Storage. Par exemple,s3.us-south.cloud-object-storage.appdomain.cloud.Ne pas inclure
http://ouhttps://dans la valeur du point final. Pour plus d'informations, voir Noeuds finaux régionaux.
En plus du noeud final, vous devez fournir des données d'identification pour activer l'authentification avec la librairie. Vous pouvez choisir d'utiliser l'une des méthodes d'authentification suivantes:
- HMAC
- Utilise un code d'authentification de message par hachage pour authentifier les utilisateurs. HMAC est une technique d'authentification cryptographique qui utilise une fonction de hachage et une clé secrète. Les données sont brouillées avant d'être envoyées sur Internet. Ensuite, le destinataire prévu utilise la clé secrète pour débrouiller les données. Pour plus d'informations, voir Authentification HMAC.
- Gestion des identités et des accès
- Utilise le service IBM Cloud Identity and Access Management (IAM) pour authentifier les utilisateurs. L'avantage de ce type d'authentification est que l'utilisateur peut utiliser le même processus pour accéder à toutes les ressources de IBM Cloud Platform. Pour plus d'informations, voir Authentification IAM.
Pour accéder aux données d'identification, accédez à la page des données d'identification du service de votre instance de service IBM Cloud Object Storage. Développez les données d'identification du service pour afficher les détails des données d'identification.
Pour plus d'informations, voir Données d'identification de service dans la documentation du produit Object Storage.
Authentification HMAC
Si vous souhaitez utiliser l'authentification HMAC, vous devez disposer des informations suivantes:
- ID de clé d'accès
access_key_idgénéré lors de la création de l'instance IBM Cloud Object Storage. Par exemple,347aa3a4b34344f8bc7c7cccdf856e4c.- Clé d'accès secrète
secret_access_keyà utiliser pour signer les demandes. Cette clé a été générée lors de la création de l'instance IBM Cloud Object Storage. Par exemple,gvurfb82712ad14W7a7915h763a6i87155d30a1234364f61.
Authentification IAM
Si vous souhaitez utiliser l'authentification IAM, vous devez disposer des informations suivantes:
- clé d'API IAM
- Exemple:
0viPHOY7LbLNa9eLftrtHPpTjoGv6hbLD1QalRXikliJ - ID instance de ressource
- Exemple:
cloud-object-storage:global:a/3ag0e9402tyfd5d29761c3e97696b71n:d6f74k03-6k4f-4a82-b165-697354o63903::
Connexion à la source de données
A partir de votre projet Discovery, effectuez les étapes suivantes :
-
Dans le panneau de navigation, sélectionnez Gestion des collections.
-
Cliquez sur Nouvelle collection.
-
Cliquez sur le lien situé à côté du champ Need to connect to a data source?, cliquez sur IBM Cloud Object Storage, puis sur Next.
-
Choisissez un type de données d'identification, puis complétez les zones avec les informations que vous avez collectées précédemment.
- Gestion des identités et des accès
- HMAC
Cliquez sur Suivant.
-
Attribuez un nom à la collection.
-
Si la langue des documents stockés n'est pas l'anglais, sélectionnez la langue appropriée.
Pour obtenir la liste des langues prises en charge, voir Langues prises en charge.
-
Facultatif: modifiez la planification de synchronisation.
Pour plus d'informations, voir Options de planification d'exploration.
-
Choisissez les seaux que vous souhaitez ramasser.
Plus vous sélectionnez de compartiments, plus le traitement des documents est long.
-
Si vous souhaitez limiter les types de fichier à ajouter à la collection, vous pouvez répertorier les extensions de fichier pour les types de fichier à inclure ou à exclure.
Lorsque vous choisissez de répertorier les extensions des types de fichier à exclure, vous devez ajouter au moins une extension de fichier.
Pour obtenir la liste des types de fichier pris en charge, voir Types de fichier pris en charge.
-
Si vous souhaitez que le moteur d'exploration extrait du texte des images sur le site, développez Plus de paramètres de traitementet définissez Appliquer la reconnaissance optique des caractères (OCR) sur
On.Lorsque la reconnaissance optique des caractères est activée et que vos documents contiennent des images, le traitement prend plus de temps. Pour plus d'informations, voir Reconnaissance optique des caractères.
-
Cliquez sur Terminer.
La collection est créée rapidement. Le traitement des données à mesure qu'elles sont ajoutées à la collection prend plus de temps.
Si vous souhaitez vérifier la progression, accédez à la page Activité. Dans le panneau de navigation, cliquez sur Gérer les collections, puis cliquez pour ouvrir la collection.