Integrazione di Data Build Tool (dbt)
IBM® watsonx.data si integra con Data Build Tool (dbt), uno strumento di analisi dei dati che aiuta a trasformare i dati in watsonx.data in forme più semplici e accessibili per gli utenti aziendali. Permette ad analisti e scienziati di costruire pipeline di dati utilizzando diversi modelli e di disporre di dati curati per il processo decisionale. È possibile eseguire query SQL utilizzando lo strumento db e analizzare i dati disponibili in watsonx.data.
dbt consente ad analisti e scienziati di svolgere alcuni dei seguenti compiti relativi ai dati:
-
Gestite flussi di lavoro complessi per la trasformazione dei dati e supportate funzionalità come il controllo di versione, il codice modulare e l'integrazione continua.
-
Preparate i dati per il reporting e l'analisi trasformando i dati grezzi in un formato strutturato, facilitando la creazione di approfondimenti.
-
Creare modelli stratificati e riutilizzabili che rappresentino le diverse fasi della trasformazione dei dati.
-
Garantire l'affidabilità delle trasformazioni identificando i problemi nel processo.
-
Generare una documentazione chiara e di facile comprensione per i modelli e fornire una visualizzazione del percorso dei dati per tracciarne il passaggio attraverso la pipeline.
-
Gestire le dipendenze tra i modelli e garantire che le trasformazioni vengano eseguite nella sequenza corretta e possano integrarsi con un flusso di dati più ampio.
Per ulteriori informazioni su dbt, vedere:
dbt è supportato in watsonx.data per i motori Spark e Presto. dbt utilizza i seguenti adattatori Data Build Tool (dbt) per collegare il core dbt con i motori Spark e Presto. Gli adattatori aiutano a costruire, testare e documentare i modelli di dati.
- dbt-watsonx-presto per connettersi a Presto
- dbt-watsonx-spark per connettersi a Apache Spark
Comandi di base di dbt
-
Iniziare un progetto dbt: impostare un nuovo progetto dbt.
dbt init my_project -
Debug della connessione dbt: verifica il profilo e la connessione dbt.
dbt debug -
Dati di partenza: Caricare i dati di partenza nel database/fonte di dati.
dbt seed -
Eseguire i modelli dbt: Costruire ed eseguire i modelli.
dbt run -
Testare i modelli dbt: Esegue test sui modelli.
dbt test -
Generare documentazione: Crea e distribuisce la documentazione per il progetto dbt.
dbt docs generate dbt docs serve
Per ulteriori informazioni sui comandi dbt, vedere riferimento ai comandi dbt.