Erste Schritte mit Ihrer Abfrageengine

Nach erfolgreicher Bereitstellung der Presto können Sie Ihre watsonx.data Erfahrung beginnen, indem Sie die Möglichkeiten von Presto erkunden, indem Sie Testabfragen ausführen und Ihr erstes Schema und Tabellen erstellen.

In diesem Tutorial lernen Sie, einige Testabfragen auszuführen, um die Möglichkeiten von Presto zu verstehen und Ihr erstes Schema zu erstellen, um eine grundlegende Struktur für die Organisation Ihrer Daten zu schaffen. Wenn Ihr Schema vorhanden ist, können Sie mit der Erstellung Ihrer Tabelle fortfahren. Tabellen sind wesentliche Komponenten zum Speichern und Organisieren von Daten.

Beispielszenario: Um Folgendes zu verstehen:

  • Abfrage von Tabellen mit Presto in watsonx.data
  • Informationen zu den für den Kickstart verfügbaren Daten
  • In diesem Abschnitt erfahren Sie, wie Sie Schemas und Tabellen zum Speichern, Organisieren und Abfragen von Daten erstellen.

Ziel

  • Testabfragen ausführen
  • Erstes Schema und erste Tabelle erstellen

Vorbereitende Schritte

Für dieses Lernprogramm ist Folgendes erforderlich:

  • Abonnieren Sie watsonx.data in IBM Cloud.
  • Stellen Sie Ihre watsonx.data Instanz bereit. Weitere Informationen finden Sie unter Instanz bereitstellen.

Testabfragen ausführen

In diesem Abschnitt des Tutorials wird beschrieben, wie Sie den Abfragearbeitsbereich verwenden und Testabfragen ausführen, um sich mit der Funktionsweise der Presto vertraut zu machen.

Gehen Sie wie folgt vor, um die SQL-Abfrage auszuführen:

  1. Wählen Sie im Navigationsmenü die Option SQL. Die Seite Arbeitsbereich Abfrage wird geöffnet.
  2. Wählen Sie den Presto aus der Motorliste aus.
  3. Rufen Sie System-und Benchmarking-Daten auf. watsonx.data stellt Standardkataloge tpcds und tpch bereit. Diese Kataloge stellen automatisch generierte Daten für das Benchmarking bereit. Sie können sie auch zum Ausführen von Beispielabfragen und -daten verwenden.
  4. Wählen Sie ein Schema aus dem tpch-Katalog aus (z. B. Tiny) und wählen Sie dann eine Tabelle aus (z. B. Customer). Klicken Sie auf das Überlaufmenü, um Pfad generieren oder SELECT generieren auszuwählen.
  5. Wählen Sie Auswahl generieren und dann einen Grenzwert aus, z. B. 100.
  6. Klicken Sie auf Ausführen, um die Abfrage auszuführen.
  7. Wählen Sie die Registerkarte Ergebnismenge oder Details aus, um die Ergebnisse anzuzeigen. Falls erforderlich, können Sie die Abfrage sichern.

Daten speichern

  1. Wählen Sie im Navigationsmenü die Option Datenmanager. Die Seite Datenmanager wird geöffnet.
  2. Wählen Sie den Katalog iceberg_data. Der Katalog ist standardmäßig verfügbar.
  3. Klicken Sie auf Erstellen. Wählen Sie Schema erstellen aus, um ein Schema unter dem Katalog iceberg_data zu erstellen. Weitere Informationen finden Sie unter Schema erstellen.
  4. Ordnen Sie Ihrem Schema einen Namen zu, z. B. new_schema.
  5. Zum Speichern von Daten müssen Sie Tabellen innerhalb des Schemas erstellen. Verwenden Sie eine der folgenden Optionen, um eine Tabelle zu erstellen:
  • Option 1: Sie können eine Tabelle (mit den im tpcds-Katalog verfügbaren Standarddaten) erstellen, indem Sie eine SQL-Abfrage ausführen.

    a. Rufen Sie die Seite Arbeitsbereich abfragen auf.

    b. Führen Sie die Abfrage Tabelle erstellen aus. Es folgt eine Beispielabfrage:

      CREATE TABLE IF NOT EXISTS
      "iceberg_data"."new_schema"."new_table"
      AS SELECT * FROM "tpcds"."sf1"."catalog_returns"
      LIMIT
       100;
    

    Die SQL-Abfrage erstellt eine Tabelle mit dem Namen new_table unter Verwendung von new_schema in iceberg_data catalog. Außerdem werden Daten aus der Tabelle catalog_returns geladen, die das Schema sf1 im Katalog tpcds verwendet.

    Sie können zum Katalog iceberg_data wechseln und eine SELECT-Abfrageanweisung ausführen, um zu überprüfen, ob new_table Daten enthält.

  • Option 2: Sie können eine Tabelle erstellen, indem Sie Ihre eigenen Daten (.csv, Parquet, .json, Format .txt) hochladen.

    a. Rufen Sie die Seite Datenmanager auf.

    b. Sie können eine Tabelle mit Ihren Daten im Format .csv, parquet, .json, .txt erstellen. Informationen hierzu finden Sie unter Tabelle erstellen.

    Sie können zur Seite Arbeitsbereich abfragen wechseln. Wählen Sie die neu erstellte Tabelle aus dem Katalog iceberg_data aus und führen Sie eine SELECT-Abfrageanweisung aus, um zu prüfen, ob die Tabelle Daten enthält.

Daten aus der erstellten Tabelle abfragen

Sie können eine Abfrage SELECT generieren aus der neuen Tabelle ausführen, die im Katalog iceberg_data erstellt wird. Gehen Sie dazu wie folgt vor:

  1. Wechseln Sie im Navigationsmenü zur Seite Arbeitsbereich abfragen.
  2. Wählen Sie die Tabelle new_table im Schema new_schema im Katalog iceberg_data aus.
  3. Wählen Sie SELECT generieren aus.
  4. Bearbeiten Sie den Grenzwert wie im Beispiel gezeigt auf 100:
      SELECT * FROM
      "iceberg_data"."new_schema"."new_table"
      LIMIT
       100;
    
  5. Klicken Sie auf die Schaltfläche Ausführen, um die Abfrage auszuführen.
  6. Wählen Sie die Registerkarte Ergebnismenge oder Details aus, um die Ergebnisse anzuzeigen. Sie können die Abfrage auch sichern.