Démarrage rapide watsonx.data console

Lorsque vous vous connectez pour la première fois à la console web IBM® watsonx.data, l'assistant de démarrage rapide s'affiche. Dans ce tutoriel, vous apprendrez à utiliser l'assistant de démarrage rapide pour configurer les composants de base et commencer à utiliser watsonx.data en quelques minutes.

L'assistant vous guide tout au long du processus de configuration initiale des composants d'infrastructure de watsonx.data.

Configurer un espace de stockage

Votre site watsonx.data a besoin d'un panier de stockage d'objets pour stocker vos fichiers de données brutes. Vous pouvez provisionner un nouveau seau géré par IBM ou enregistrer votre propre seau. Vous pouvez ajouter d'autres seaux et les enregistrer ultérieurement. Vous pouvez également configurer les détails de la surveillance des requêtes. Vous pouvez activer ou désactiver le contrôle des requêtes pour stocker et gérer vos données diagonales.

Dans la section Configurer le stockage, effectuez les étapes suivantes :

  1. Sélectionnez l'une des options suivantes et donnez des précisions.

    • Découvrir une instance COS: Sélectionne une instance COS existante sur IBM et un bucket attaché sur votre compte IBM Cloud. Si plusieurs instances de COS IBM et plusieurs seaux sont détectés, sélectionnez l'instance de COS IBM qui contient le seau souhaité pour l'enregistrer auprès de watsonx.data.

    • Enregistrer le mien: Vous pouvez utiliser n'importe quel godet IBM COS existant à partir d'une instance existante ou provisionner une nouvelle instance. Pour provisionner une nouvelle instance IBM COS, fournissez les détails suivants :

      Ajouter un compartiment
      Zone Description
      Type de compartiment Sélectionnez Amazon S3, IBM Storage Ceph, ou IBM Cloud Object Storage.
      Région La région dans laquelle l'ensemble de données est disponible.
      Nom du compartiment Saisissez le nom de votre seau.
      Nom d'affichage Saisissez le nom du seau à afficher à l'écran.
      Noeud final Saisissez le point de terminaison URL.
      Clé d'accès Saisissez votre clé d'accès.
      Clé secrète Saisissez votre clé secrète.
      Statut de la connexion Cliquez sur le lien Tester la connexion pour vérifier si la connexion du seau avec watsonx.data est réussie ou non. Le système affiche le message d'état.

    Si vous sélectionnez un godet IBM COS existant, la taille par défaut est de 10 Go. Il est destiné à un usage exploratoire et ne peut être utilisé pour stocker des données de production ou des données sensibles. Les administrateurs de l'instance watsonx.data peuvent désactiver ce bac pour des raisons de conformité.

    Lorsque vous enregistrez votre propre seau, veillez à fournir les informations correctes pour la configuration du seau. L'assistant de démarrage rapide ne valide pas les détails de la configuration du seau et vous ne pouvez pas les modifier ultérieurement.

Dans la section Surveillance des requêtes, effectuez les étapes suivantes :

  1. Utilisez l'interrupteur à bascule pour activer (ou désactiver) la fonction de surveillance des requêtes.

    Le catalogue associé qui apparaît avec le seau de surveillance des requêtes est de type Hive.

  2. Si vous activez la fonction QHMM, vous devez configurer les détails de stockage des données QHMM. Sélectionnez l'une des options suivantes et donnez des précisions.

    • Découvrir une instance COS: Sélectionne une instance COS existante sur IBM et un bucket attaché sur votre compte IBM Cloud. Si plusieurs instances de COS IBM et plusieurs seaux sont détectés, sélectionnez l'instance de COS IBM qui contient le seau souhaité pour l'enregistrer auprès de watsonx.data.

    • Enregistrer mon propre godet : vous pouvez enregistrer un godet existant en tant que godet QHMM. Seuls les types de seaux suivants peuvent être enregistrés en tant que seaux QHMM : Amazon S3, IBM Storage Ceph, ou IBM Cloud Object Storage. Pour enregistrer un godet existant en tant que godet QHMM, fournissez les informations suivantes :

      Ajouter un compartiment
      Zone Description
      Type de compartiment Sélectionnez Amazon S3, IBM Storage Ceph, ou IBM Cloud Object Storage.
      Région La région dans laquelle l'ensemble de données est disponible.
      Nom du compartiment Saisissez le nom de votre seau.
      Nom d'affichage Saisissez le nom du seau à afficher à l'écran.
      Noeud final Saisissez le point de terminaison URL.
      Clé d'accès Saisissez votre clé d'accès.
      Clé secrète Saisissez votre clé secrète.
      Statut de la connexion Cliquez sur le lien Tester la connexion pour vérifier si la connexion du seau avec watsonx.data est réussie ou non. Le système affiche le message d'état.

    Le stockage (par défaut ou BYOB) peut être modifié ultérieurement à partir de la page de la console watsonx.data. Voir Surveillance des requêtes.

  3. Cliquez sur Suivant.

Configurer un catalogue

Votre site watsonx.data a besoin de catalogues de métadonnées pour gérer vos schémas de tables. La création des services de support pour le catalogue de métadonnées ajoute 3 UR/H à votre taux d'exécution de l'instance lorsque vous terminez le processus de démarrage rapide.

Dans la page Configurer le catalogue, effectuez les étapes suivantes :

  1. Sélectionnez le format de tableau pour gérer vos données. Apache Hive et Apache Iceberg sont disponibles.

Pour activer la fonction de surveillance des requêtes, vous devez sélectionner le catalogue Apache Hive.

  1. Cliquez sur Suivant.

Configurer un moteur

Votre site watsonx.data a besoin d'un moteur de recherche pour travailler avec vos données.

Dans la page Configurer le moteur, effectuez les étapes suivantes :

  1. Sélectionnez le moteur qui exécutera et traitera les données que vous avez jointes.

  2. Sélectionnez la taille du moteur en fonction des exigences de votre charge de travail.

    Taille du moteur
    Taille Description
    Starter/Lite ( IBM ) (2 RUs/heure) Comprend 1 nœud coordinateur et 1 nœud travailleur. Tous les nœuds sont Starter.
    Démarrage ( AWS ) ( 5.6 RUs/hour) Comprend 1 nœud coordinateur et 1 nœud travailleur. Tous les nœuds sont optimisés pour le cache.
    Petite ( 11.2 RU/heure) Comprend 1 nœud coordinateur et 3 nœuds travailleurs. Tous les nœuds sont optimisés pour le cache.
    Moyen ( 19.6 RU/heure) Comprend 1 nœud coordinateur et 6 nœuds travailleurs. Tous les nœuds sont optimisés pour le cache.
    Grande ( 36.4 RU/heure) Comprend 1 nœud coordinateur et 12 nœuds travailleurs. Tous les nœuds sont optimisés pour le cache.
  3. Cliquez sur Suivant.

Examiner les détails de la configuration

Dans la page Résumé, effectuez les étapes suivantes :

  1. Passez en revue les configurations avant de terminer la mise en place de votre site watsonx.data.

  2. Cliquez sur Terminer et allez-y.

Une fois la configuration terminée, la page d'accueil watsonx.data s'affiche. La consommation d'unités de ressources commence peu après la création des services d'assistance à l'aide de l'assistant de démarrage rapide. Vous pouvez consulter le taux d'exécution soumis à la facturation à partir de l'onglet Facturation et utilisation. Pour plus d'informations, voir Facturation et utilisation.

Etapes suivantes

Vous êtes prêt à utiliser le site watsonx.data ou vous pouvez le configurer davantage.