Aggiunta di memoria e query dei dati
In questa esercitazione, imparerai ad aggiungere un'archiviazione di tua proprietà ed esplorare come il servizio watsonx.data interagisce con i dati che hai portato.
Scenario di esempio: il proprio team sta lavorando sullo sviluppo di una pipeline di dati automatica che richiede l'esecuzione di query dei dati dal bucket di dati di cui si dispone. Il tuo gestore ti richiede di recuperare i dati dal bucket di dati utilizzando l'istanza watsonx.data.
Per questo scenario, è necessario creare il motore di query Presto, stabilire la connessione con lo storage, ingerire i dati nel bucket dei dati e visualizzare il risultato nell'istanza watsonx.data.
Obiettivo
-
Creazione dell'infrastruttura nel servizio watsonx.data.
-
Connessione con il bucket dei dati del cliente.
-
Query dal bucket
Prima di iniziare
Questa esercitazione richiede:
- Sottoscrizione di watsonx.data su cloud.
- I dettagli di configurazione del bucket di dati che si porta in. Questo è richiesto per stabilire la connessione con watsonx.data.
- Fornitura dell'istanza del servizio watsonx.data
Aggiunta dell'archiviazione di cui sei proprietario e inserimento dei dati
In questa sezione dell'esercitazione, imparerai come registrare il bucket di archiviazione che porti e aggiungervi dati.
- Per aggiungere un bucket di archiviazione di cui sei proprietario, vedi Aggiunta di una coppia di archiviazione - catalogo.
- È possibile utilizzare l'opzione Crea tabella dalla pagina Gestore dati per caricare origini locali o esterne di file di dati per creare tabelle. Puoi anche inserire file di grandi dimensioni utilizzando la CLI. Vedi altro Creazione di un lavoro di inserimento utilizzando il file di configurazione.
Query dei dati
In questa sezione dell'esercitazione, si apprende come passare allo spazio di lavoro Query e creare query SQL per eseguire la query dei dati dal bucket.
Per eseguire una query SQL, procedere come segue:
-
Dal menu di navigazione, selezionare SQL. Viene aperta la pagina Area di lavoro Query.
-
Seleziona ilPresto (Java ) motore dal Motore cadere in picchiata.
-
Selezionare un catalogo, ad esempio, uno schema predefinito e una tabella, ad esempio order_detail, per eseguire la query.
-
Fare clic sul menu di overflow e selezionare la query richiesta.
- Per un catalogo e uno schema, è possibile eseguire la query Crea percorso.
- Per una tabella, è possibile eseguire la query Genera percorso, Genera SELECT, Genera ALTER e Genera DROP.
- Per una colonna, è possibile eseguire la query Genera percorso, Genera SELECT e Genera DROP.
Considerare la seguente query di esempio per visualizzare i dettagli dalla tabella:
Esempio:
SELECT * FROM "iceberg-beta"."default"."order_detail" LIMIT 10; -
Fare clic su Esegui su per eseguire la query.
-
Selezionare la scheda Serie di risultati o Dettagli per visualizzare i risultati. Se necessario, è possibile salvare la query.
-
Fare clic su Query salvate per visualizzare le query salvate.
-
Fare clic su Spiega per visualizzare il piano di esecuzione logico o distribuito per una query SQL specificata.