Ajout de stockage et interrogation de données

Dans ce tutoriel, vous apprendrez à ajouter un stockage que vous possédez et à explorer la façon dont le service watsonx.data interagit avec les données que vous apportez.

Exemple de scénario: Votre équipe travaille au développement d'un pipeline de données automatisé qui nécessite d'interroger les données du compartiment de données dont vous disposez. Votre responsable vous demande d'extraire des données du compartiment de données à l'aide de l'instance watsonx.data.

Pour ce scénario, vous devez créer le moteur de requête Presto, établir une connexion avec le stockage, ingérer des données dans le seau de données et afficher le résultat dans l'instance watsonx.data

Objectif

  • Création d'une infrastructure dans le service watsonx.data.

  • Etablissement de la connexion avec le compartiment de données client.

  • Requête à partir du compartiment

Diagramme de flux de travail*Diagramme " caption-side="bottom"} flux{: caption="travail*

Avant de commencer

Pour ce tutoriel, vous devez disposer des éléments suivants :

  • Abonnement de watsonx.data sur le cloud.
  • Détails de configuration du compartiment de données que vous apportez. Cette opération est requise pour établir une connexion avec watsonx.data.
  • Mise à disposition de l'instance de service watsonx.data

Ajout du stockage que vous possédez et ingestion de données

Dans cette section du tutoriel, vous allez apprendre à enregistrer le compartiment de stockage que vous apportez et à y ajouter des données.

  1. Pour ajouter un compartiment de stockage que vous possédez, voir Ajout d'une paire stockage-catalogue.
  2. Vous pouvez utiliser l'option Créer une table à partir de la page Gestionnaire de données pour charger des sources locales ou externes de fichiers de données afin de créer des tables. Vous pouvez également ingérer des fichiers volumineux à l'aide de l'interface de ligne de commande. Voir plus Création d'un travail d'ingestion à l'aide du fichier de configuration.

Interrogation des données

Dans cette section du tutoriel, vous allez apprendre à accéder à l'espace de travail Requête et à créer des requêtes SQL pour interroger vos données à partir du compartiment.

Pour exécuter une requête SQL, procédez comme suit :

  1. Dans le menu de navigation, sélectionnez SQL. La page de l 'espace de travail Query s'ouvre.

  2. Sélectionnez lePresto (Java ) moteur du Moteur dérouler.

  3. Sélectionnez un catalogue, par exemple, le schéma par défaut, et une table, par exemple, order_detail, pour exécuter la requête.

  4. Cliquez sur le menu déroulant dynamique et sélectionnez la requête requise.

    • Pour un catalogue et un schéma, vous pouvez exécuter la requête Générer le chemin.
    • Pour une table, vous pouvez exécuter la requête Generate path, Generate SELECT, Generate ALTER et Generate DROP.
    • Pour une colonne, vous pouvez exécuter la requête Generate path, Generate SELECT et Generate DROP.

    Prenez en compte l'exemple de requête suivant pour afficher les détails de la table:

    Exemple :

    SELECT * FROM "iceberg-beta"."default"."order_detail" LIMIT 10;
    
  5. Cliquez sur Exécuter pour lancer la requête.

  6. Sélectionnez l'onglet Ensemble de résultats ou Détails pour afficher les résultats. Si nécessaire, vous pouvez sauvegarder la requête.

  7. Cliquez sur Requêtes sauvegardées pour afficher les requêtes sauvegardées.

  8. Cliquez sur Expliquer pour afficher le plan d'exécution logique ou réparti pour une requête SQL spécifiée.