Note di rilascio per watsonx.data

Utilizza queste note sulla release per informazioni sugli ultimi aggiornamenti a IBM® watsonx.data che sono raggruppati per data.

Per le novità di watsonx.data as a Service su IBM Cloud con esperienza gen AI, vedere le note di rilascio per watsonx.data as a Service su IBM Cloud con esperienza gen AI.

Per conoscere le novità di watsonx.data on-prem, consultare le note di rilascio di watsonx.data.

Per le novità watsonx.data Premium dell'edizione on-premise, consulta le note di rilascio per Premium on-premise.

Caratteristiche di anteprima della tecnologia: Offriamo anche una sezione di anteprima tecnologica che include le funzioni attualmente in fase di anteprima. Queste caratteristiche non sono generalmente disponibili e possono cambiare prima del rilascio. Per visualizzare le note di rilascio degli elementi in anteprima tecnologica, vedere Anteprima tecnologica.

10 dicembre 2025 - Versione 2.3

Miglioramenti al provisioning delle istanze

Questa versione watsonx.data introduce i seguenti miglioramenti:

Ora è possibile fornire watsonx.data istanze con Virtual Private Endpoint (VPE) abilitato nelle seguenti nuove regioni: Dallas (us-south), Washington DC (us-east) e Francoforte (eu-de). Per abilitare VPE durante il provisioning, aggiungere il parametro "vpe_required":"true" al comando CLI. Per informazioni su come eseguire il provisioning di un'istanza abilitata per VPE, vedere Provisioning di un'istanza abilitata per Virtual Private Endpoint(VPE).

Miglioramenti alle fonti di dati e all'archiviazione

Questa versione di watsonx.data introduce i seguenti miglioramenti alle fonti di dati e all'archiviazione:

  • Ora è possibile applicare IBM Knowledge Catalog politiche di governance alla fonte dati. MongoDB Per ulteriori informazioni, vedere Connessione a IBM Knowledge Catalog(IKC).

  • Ora è possibile associare Azure Data Lake Storage Gen2 con Presto (C++) utilizzando ServicePrincipal l'autenticazione.

  • Ora è possibile associare più cataloghi di tipo Iceberg a un singolo bucket o contenitore di archiviazione oggetti. Ogni catalogo deve essere configurato con un percorso di base univoco e non sovrapposto sull'archivio per garantire un corretto isolamento dei dati.

    Ad esempio:

    • Catalog1 può essere associato a s3a://mybucket/foo/bar
    • Catalog2 può essere associato a s3a://mybucket/lorem/ipsum

    Questo miglioramento semplifica la separazione logica dei dati all'interno dello stesso archivio e il loro riutilizzo in più cataloghi, migliorando la flessibilità e l'organizzazione. Questo comportamento si applica a tutte le nuove istanze del piano Lite, che ora sono limitate all'ambito dell'account. Per ulteriori informazioni, vedere Aggiunta di più Apache Iceberg cataloghi a un unico archivio.

    Questa funzione è disponibile solo per le watsonx.data istanze Lite. In precedenza, ogni bucket o contenitore di archiviazione oggetti poteva essere collegato solo a un singolo catalogo.

Miglioramenti al motore e all'assistenza

Questa release di watsonx.data introduce i seguenti miglioramenti del motore e del servizio:

  • Prestissimo offre ora prestazioni migliorate nella scrittura Apache Iceberg delle tabelle rispetto alle Java implementazioni. Sono disponibili le seguenti funzionalità:

    • Supporto per tabelle partizionate - Prestissimo scrive su tabelle Iceberg partizionate e applica trasformazioni di partizione in modo efficiente utilizzando la valutazione batch. Supporta identità, trasformazioni temporali (anno, mese, giorno, ora), bucket e troncamento e genera percorsi di directory di partizioni conformi a Iceberg.
    • Raccolta delle statistiche sui file di dati - Durante le operazioni di scrittura, Prestissimo raccoglie e riporta le statistiche essenziali sui file di dati nei file manifest di Iceberg, inclusi il numero di record, la dimensione dei file e i dettagli delle partizioni.
    • Supporto per la scrittura di tabelle ordinate: Prestissimo supporta la scrittura di tabelle Iceberg ordinate per consentire prestazioni di query ottimizzate per carichi di lavoro che traggono vantaggio dai dati ordinati.
  • Spark senza server con capacità flessibile per il piano Enterprise

    Capacità su richiesta

    • Nel piano watsonx.data Enterprise, il motore Spark supporta un modello serverless, offrendo comunque la flessibilità di allocare capacità dedicata quando necessario.
    • L'esecuzione di lavori Spark su una piattaforma serverless elimina la necessità di nodi dedicati per ogni motore Spark.
    • L'ambiente Spark serverless fornisce un pool condiviso di nodi con una quota massima di risorse di 8 vCPUs e 32 GB di memoria.

    Questo comportamento si applica a tutte le nuove watsonx.data istanze, che ora sono limitate all'ambito dell'account.

    Capacità dedicata

    • Per i carichi di lavoro che richiedono una maggiore capacità, è possibile fornire nodi dedicati con configurazioni di memoria personalizzabili. Per ulteriori dettagli sulle capacità serverless e on-demand, consulta Gestione della capacità Spark.
    • Il processo di creazione di Spark Engine è ora semplificato, concentrandosi solo sui dettagli essenziali (nome del motore, versione Spark, bucket home e cataloghi associati), mentre le attività di prenotazione della capacità sono state spostate in una nuova scheda Gestione capacità nella pagina dei dettagli del motore. Questo aggiornamento rimuove la configurazione della capacità dal flusso di creazione, rendendo l'impostazione del motore più veloce e meno complessa.
    • Dopo aver creato un motore, è possibile gestire i tipi di VM, configurare i pool di nodi e impostare le soglie di fallback su richiesta nella scheda Capacità.

    Questo comportamento si applica a tutte le nuove watsonx.data istanze, che ora sono limitate all'ambito dell'account.

    La quota massima di risorse per il piano Enterprise è di 256 vCPUs e 1024 GB di memoria. Per aumentare questo limite, è necessario contattare IBM l'assistenza.

    Per ulteriori dettagli sulle capacità serverless e on-demand, consulta Gestione della capacità Spark.

Persistenza dei componenti a livello di account per l'istanza Lite Plan

Ora è possibile conservare componenti a livello di account quali cataloghi, database, bucket e le relative proprietà dei metadati indipendentemente dalle singole istanze. Quando un'istanza viene eliminata, questi componenti rimangono accessibili da qualsiasi altra istanza all'interno dello stesso account e della stessa regione. Questo comportamento si applica a tutte le nuove istanze del piano Lite, che ora sono limitate all'ambito dell'account.

Riutilizzo del nome dello schema nei cataloghi Iceberg per l'istanza Lite Plan

In precedenza, quando si faceva riferimento a una tabella utilizzando un nome composto da tre parti (<catalog>.<schema>.<table>), i nomi degli schemi dovevano essere univoci in tutti i cataloghi all'interno di watsonx.data un'istanza. Questa restrizione impediva la creazione di schemi con lo stesso nome in cataloghi diversi. Questa limitazione non si applica ai cataloghi Iceberg. Ora è possibile riutilizzare i nomi degli schemi in più cataloghi Iceberg. Ad esempio:

  • myiceberg_catalog1.abcschema.mytable
  • myiceberg_catalog2.abcschema.mytable

Questo comportamento si applica a tutte le nuove istanze del piano Lite, che ora sono limitate all'ambito dell'account.

I nomi degli schemi devono comunque essere univoci in altri tipi di catalogo come Hive, Delta e Hudi.

Miglioramenti alla gestione degli accessi

Questa versione di watsonx.data introduce i seguenti miglioramenti nella gestione degli accessi:

  • Gli amministratori possono creare criteri di restrizione basati sul contesto e definire indirizzi IP attendibili. Ora è possibile configurare indirizzi IP attendibili per consentire l'accesso sicuro a watsonx.data (interfaccia utente e API) per utenti designati. Questa funzionalità aggiunge un ulteriore livello di protezione garantendo che solo il traffico proveniente da indirizzi IP approvati possa accedere all'interfaccia utente e all'API. Qualsiasi tentativo di accesso watsonx.data da indirizzi IP al di fuori dell'intervallo definito verrà bloccato. Per ulteriori informazioni, vedere Protezione dell'accesso all'interfaccia utente con controlli basati su IP.

  • È ora disponibile un nuovo CPG leggero come plug-in scaricabile, che consente una perfetta integrazione con qualsiasi motore di policy (ad esempio, ApacheIBM Knowledge Catalog Ranger, Collibra). Per ulteriori informazioni, vedere Connettore Common Policy Gateway(CPG).

Miglioramenti alla fatturazione

Questa versione di watsonx.data introduce i seguenti miglioramenti alla funzione di fatturazione:

  • La misurazione dei watsonx.data componenti ora opera a livello di runtime, acquisendo gli eventi di avvio, arresto e pausa per ogni runtime collegato a un motore. Fornisce una chiara visibilità sul consumo del motore e sull'utilizzo delle risorse. Per motori come Presto, questa rimane una mappatura uno a uno, mentre Spark introduce più sottotipi di runtime (ad esempio, Kernel, HistoryServer, Application), ciascuno dei quali viene monitorato individualmente per le ore attive e inattive. L'interfaccia utente rifletterà queste modifiche visualizzando barre delle attività a livello di runtime e collegamenti alla cronologia degli eventi relativi a ciascun runtime, garantendo chiarezza e precisione. Per ulteriori informazioni, consulta Misurazione e esperienza di utilizzo. Questo comportamento si applica a tutte le nuove watsonx.data istanze, che ora sono limitate all'ambito dell'account.
Miglioramenti al piano Lite:

Questa versione watsonx.data introduce i seguenti miglioramenti al piano Lite:

La fornitura del piano Lite in watsonx.data è stata semplificata eliminando il supporto per casi d'uso multipli. Tutte le nuove istanze vengono fornite con il caso d'uso Generative AI predefinito. I casi d'uso relativi Power BI all'ingegneria dei dati e all'utilizzo dei dati sono stati deprecati e non sono più disponibili. Il metodo di provisioning CLI ora consente solo il caso d'uso Generative AI predefinito, garantendo un'esperienza coerente e semplificata.

OpenTelemetry miglioramento

Questa versione introduce le seguenti watsonx.data funzionalità avanzate di osservabilità e monitoraggio per il motore Presto ( Java ).

  • Ora è possibile integrare OpenTelemetry con Presto ( Java ) motore per monitorare l'esecuzione delle query e le prestazioni del sistema. OpenTelemetry consente di acquisire dati telemetrici quali tracce e metriche, che possono essere visualizzati e analizzati utilizzando strumenti quali Instana, Prometheus e Grafana. Per ulteriori informazioni, consultare OpenTelemetry.

  • Nuove dashboard Grafana Instana e : ora è possibile utilizzare le dashboard Grafana Instana e per monitorare le prestazioni e fornire una visione più completa dello stato di salute e delle prestazioni del sistema. Per ulteriori dettagli, consulta la sezione Dashboard di supporto.

Miglioramento dell'ottimizzatore di query

Questa versione watsonx.data introduce i seguenti miglioramenti al Query Optimizer.

  • Il timeout predefinito per la riscrittura delle query per Query Optimizer è ora configurabile. A partire dalla versione 2.3, è possibile modificare questo valore di timeout utilizzando l'API PATCH aggiornando la proprietà optplus.query-timeout-seconds. Per ulteriori informazioni, vedere Aggiornamento del timeout di riscrittura delle query per Query Optimizer.

  • Supporto per Hive e registrazione metastore Iceberg in Query Optimizer per istanze Lite di watsonx.data.

    Query Optimizer supporta tipi di metastore distinti per i cataloghi Hive e Iceberg.

    Gli utenti possono ora registrarsi:

    • Hive cataloghi che utilizzano il tipo di metastore watsonx-data-hive.
    • I cataloghi Iceberg utilizzano il tipo di metastore iceberg-rest.

    Questo miglioramento consente un controllo più granulare e la compatibilità con le architetture di metastore in evoluzione. La registrazione viene effettuata utilizzando la REGISTER_EXT_METASTORE procedura con sintassi e proprietà aggiornate.

    A partire da questa versione, il supporto legacy per il tipo di watsonx-data metastore unificato continua ad essere supportato nella versione Enterprise, mentre non è più disponibile per le istanze Lite. Per ulteriori informazioni, vedere Sincronizzazione manuale di Query Optimizer con metastore.

Risparmio rispetto al supporto HTTP del protocollo nel piano watsonx.data Lite

Il Metadata Service (MDS) ora watsonx.data esegue il servizio Thrift tramite il HTTP protocollo invece del precedente protocollo binario. Questa modifica influisce sugli endpoint di servizio e sulle configurazioni di connessione.

Modifiche principali:

  • Il protocollo MDS Thrift (thrift://) viene modificato in Thrift Over HTTP (https://).
  • Il account_id è obbligatorio per tutte le chiamate API Thrift effettuate al servizio MDS Thrift tramite HTTP.
  • Il catalog parametro query è necessario quando si richiamano API che coinvolgono il catalogo Iceberg.

Per Spark e Presto motori all'interno di watsonx.data, questi aggiornamenti vengono applicati automaticamente sia ai cataloghi nuovi che a quelli migrati. Per i motori esterni come Spark, Db2, e Netezza, gli utenti devono aggiornare manualmente le impostazioni di connessione per riflettere il nuovo protocollo, la porta e il parametro di query.

Miglioramenti al servizio metadati multi-tenant (MDS)

Questa versione watsonx.data introduce i seguenti miglioramenti a MDS.

  • AccountId è ora richiesto per tutte le chiamate dirette al servizio REST MDS (Iceberg Catalog e Unity Catalog). Le richieste che non includono questa intestazione non andranno a buon fine.
  • L'endpoint per le operazioni Iceberg è stato aggiornato da /mds/iceberg a /api/v1/iceberg.

Per ulteriori informazioni, vedi Documentazione API.

Miglioramenti CLI CPDCTL

Questa versione di watsonx.data introduce i seguenti miglioramenti all'interfaccia della riga di comando IBM Cloud Pak for Data ( IBM cpdctl):

  • La retrocompatibilità è stata abilitata per i comandi bucket, engine``service, ingestion, component, e in CPDCTL.

A partire dalla versione 1.8.85 CPDCTL, questi comandi possono ora connettersi alle watsonx.data versioni precedenti alla versione 2.2.1, garantendo un'integrazione e una compatibilità più fluide tra i diversi ambienti.

  • Una nuova opzione sotto il bucket comando wx-data bucket list-objects elenca gli oggetti in un bucket aggiunto in watsonx.data. Per ulteriori dettagli sulle operazioni relative al bucket comando in watsonx.data, consultare bucket.

  • È ora disponibile un flag --en-apikey nascosto come soluzione alternativa per gestire i casi limite in cui il --api-key flag non supera la convalida nei comandi sparkjob create``tablemaint e. Per ulteriori informazioni, consultare Informazioni aggiuntive sull'utilizzo e sugli esempi del comando cpdctl wx-data.

Interfaccia chat basata su Gen AI in watsonx.data

Ora puoi chattare con un'interfaccia di chat basata sull'intelligenza artificiale generativa, watsonx.data Assistant, per porre domande su IBM® watsonx.data. L'assistente risponde alle tue domande in watsonx.data base alle sue conoscenze sulla documentazione IBM del prodotto. Aiuta a esplorare e conoscere il prodotto in modo più semplice e veloce. Per abilitare la funzione e iniziare a utilizzarla, consulta watsonx.data Assistente - interfaccia di genAI chat basata su tecnologia.

Servizio di richiamo

Questa versione introduce i seguenti watsonx.data miglioramenti al servizio di recupero:

  • Ora è possibile configurare il gpt-oss-120b modello AI per il servizio di recupero a livello di istanza nella watsonx.data console. Per informazioni sulla configurazione del modello AI per il servizio di recupero, vedere Configurare il modello AI per il servizio di recupero.
Miglioramento dell'ingestione

Questa versione watsonx.data introduce il seguente miglioramento nell'acquisizione:

  • Nel pannello di destinazione della schermata di acquisizione è disponibile un nuovo pulsante per controllare la modalità di eliminazione delle tabelle in formato Iceberg acquisite con Copy-on-Write (COW) come modalità predefinita. Passando alla modalità Merge-on-Read è possibile eliminare le righe durante l'acquisizione.
Funzioni obsolete

Le seguenti funzioni sono deprecate in questa versione:

  • I nomi utente ibmlhapikey e ibmlhtoken utilizzati per l'autenticazione degli utenti sono stati dichiarati obsoleti a partire dalla versione 2.2.0 e contrassegnati per la rimozione. Ora, nel 2.3.0 il supporto è stato completamente rimosso.

Per l'autenticazione, è necessario utilizzare il nuovo formato:

ibmlhapikey_<username>

ibmlhtoken_<username>

Per ulteriori informazioni, consultare Gestione degli accessi e governance in watsonx.data.

Caratteristiche dell'anteprima tecnologica

Per questa versione, ulteriori aggiornamenti e miglioramenti sono disponibili tra le funzionalità della Technology Preview. Per esaminare gli aggiornamenti dell'anteprima tecnologica per questa versione, vedere Anteprima tecnologica 2.3.

13 novembre 2025 - Versione 2.2.2 Nuova funzionalità 1 ( NF1 )

NF12.2.2watsonx.data La versione viene rilasciata in diverse aree geografiche in più fasi e non è disponibile in tutte le regioni. Per sapere se la 2.2.2NF1 versione è disponibile nella tua regione, contatta IBM l'assistenza.

Caratteristiche dell'anteprima tecnologica
Per questa versione, ulteriori aggiornamenti e miglioramenti sono disponibili tra le funzionalità della Technology Preview. Per esaminare gli aggiornamenti dell'Anteprima tecnologica per questa versione, vedere Anteprima tecnologica 2.2.2 NF1.
Funzioni obsolete
I casi d'uso High Performance BI e Data Engineering sono deprecati quando si crea un'istanza di watsonx.data Lite tramite l'interfaccia utente. È comunque possibile creare un'istanza watsonx.data Lite con questi casi d'uso utilizzando la CLI. Tuttavia, questi casi d'uso saranno rimossi dalla CLI nella versione 2.3.1.

31 ottobre 2025 - Versione 2.2.2

Miglioramenti al motore e all'assistenza

Questa release di watsonx.data introduce i seguenti miglioramenti del motore e del servizio:

  • Milvus in watsonx.data supporta ora i seguenti tipi di archiviazione esterna per l'archiviazione di dati vettoriali, file di indice e registri binari: Google Cloud Storage (GCS), Azure Data Lake Storage (ADLS) Gen1, e S3-compatible.
  • Milvus la funzionalità di ridimensionamento è ora disattivata per le dimensioni della maglietta Starter. Non è più possibile passare dalla taglia della maglietta Milvus Starter a qualsiasi altra taglia. Non è inoltre consentito il ritorno a Starter da una configurazione più grande.
Miglioramenti alle fonti di dati e all'archiviazione

Questa versione di watsonx.data introduce i seguenti miglioramenti alle fonti di dati e all'archiviazione:

  • È ora possibile applicare i criteri di governance di IBM Knowledge Catalog all'origine dati, Teradata. Per ulteriori informazioni, vedere Connessione a IBM Knowledge Catalog(IKC).
  • È ora possibile creare un deposito in stato attivo senza associarlo a un catalogo. Questo miglioramento elimina la necessità di attivazione manuale.
  • Ora è possibile abilitare e disabilitare le funzioni ACL su uno storage abilitato ACL nella vista topologia. Per ulteriori informazioni, vedere Disabilitazione o abilitazione dell'ACL su uno storage abilitato all'ACL.
  • È ora possibile utilizzare GlusterFS,, un file system distribuito e scalabile, come backend di archiviazione supportato per MinIO. Per ulteriori informazioni, vedere Impostazione dello storage replicato GlusterFS con MinIO.
  • È ora possibile configurare qualsiasi archiviazione di oggetti compatibile con S3 in watsonx.data utilizzando l'opzione Archiviazione personalizzata S3. Per ulteriori informazioni, consultare la sezione Archiviazione personalizzata di S3.
  • È ora possibile aggiornare le credenziali per Azure Data Lake Storage (ADLS) e Google Cloud Storage.
  • È ora possibile scegliere di salvare i dettagli di connessione nel database della console di istanza o nel catalogo predefinito della piattaforma dati per le seguenti origini dati:
    • IBM Db2
    • IBM Netezza
    • MySQL
    • Oracle
    • PostgreSQL
    • Snowflake
    • SQL Server
Delta Lake cataloghi ora disponibili con l'estensione del controllo degli accessi di Spark

È ora possibile utilizzare i cataloghi Delta Lake con l'estensione di controllo degli accessi di Spark, consentendo una maggiore sicurezza durante l'invio di applicazioni Spark. La funzione introduce un'ulteriore autorizzazione, assicurando che solo gli utenti autorizzati possano accedere e operare sui cataloghi watsonx.data attraverso i lavori Spark. Per ulteriori informazioni, vedere Migliorare l'invio di applicazioni Spark utilizzando l'estensione del controllo degli accessi di Spark.

Personalizzare il payload dell'applicazione Spark

Quando si invia un'applicazione Spark in watsonx.data, è possibile personalizzare il payload dell'applicazione per includere le seguenti caratteristiche:

  • Chiavi di idempotenza: Garantisce che le applicazioni inviate vengano elaborate una sola volta, anche in caso di errori di comunicazione client-server.
  • Controlli sul tempo massimo di esecuzione: Definisce un tempo massimo di esecuzione per le applicazioni Spark. Se il timeout non è specificato, i lavori continuano a essere eseguiti fino al completamento, indipendentemente dalla loro durata.

Per ulteriori informazioni, vedere Personalizzazione dei parametri per l'invio di applicazioni Spark.

Gateway di politica comune (CPG)

Il provisioning del Common Policy Gateway (CPG) è ora opzionale. È possibile creare un'istanza watsonx.data senza il provisioning automatico di CPG, a meno che non sia esplicitamente richiesto un motore di policy. Con questa funzione, il provisioning CPG è ora completamente opzionale e reversibile. Se è necessario un motore per le politiche dei clienti, come Ranger o IKC, il CPG può essere fornito in un secondo momento. Per ulteriori informazioni, vedere Abilitazione o disabilitazione dei motori gateway dei criteri comuni.

Miglioramenti CLI CPDCTL

Questa versione di watsonx.data introduce i seguenti miglioramenti all'interfaccia della riga di comando IBM Cloud Pak for Data ( IBM cpdctl):

  • Utilizzate il nuovo gruppo di comando access-control per gestire i criteri di accesso alle risorse dell'istanza watsonx.data, tra cui la visualizzazione, l'aggiornamento e la revoca dell'accesso per utenti e gruppi. Per ulteriori informazioni, vedere Controllo degli accessi.
Miglioramenti al gestore dei dati

Gli utenti possono ora creare schemi con percorsi personalizzati per visualizzare e sincronizzare i dati a un livello più granulare. Con questa nuova funzione, gli utenti possono sincronizzare solo una directory specifica (ad esempio, /test1 o /test1/schema1 ) per recuperare le tabelle in quel percorso, invece di sincronizzare l'intero catalogo. Questa capacità di sincronizzazione mirata migliora le prestazioni e la precisione nella gestione dei dati.

Miglioramenti dell'integrazione

IBM watsonx.data supporta ora il tracciamento del lignaggio a livello di colonna per Presto grazie all'integrazione con Manta. Grazie a questo miglioramento, gli utenti possono ora esplorare le dipendenze dettagliate delle colonne, le relazioni e le modifiche dei metadati, consentendo una visione più approfondita dei flussi di dati e migliorando la tracciabilità delle pipeline.

Funzioni obsolete

Il pacchetto IBM Client è deprecato e l'installazione e il supporto del pacchetto ibm-lh-client non saranno disponibili a partire dalla release 2.3.0 di watsonx.data. Le utilità e i comandi del pacchetto Client sono sostituiti da IBM CPDCTL CLI. Gli utenti sono incoraggiati a migrare e ad esplorare il CPDCTL. Per ulteriori informazioni su come utilizzare IBM CPDCTL CLI, vedere IBM cpdctl.

Utilizzate i seguenti strumenti disponibili per le funzionalità equivalenti del pacchetto Client:

  • python-run / dev-sandbox- Utilizza l'ambiente standard Python per sviluppare ed eseguire gli script Spark.
  • presto-run / Presto CLI – Utilizza la CLI Presto ufficiale per eseguire query SQL su watsonx.data.
  • cert-mgmt- Utilizzare lo strumento chiave JVM per gestire i certificati HTTPS.

23 settembre 2025 - Versione 2.2.1 Nuove funzionalità introdotte (NFI)

Note di rilascio per la versione 2.2.1 NFI di watsonx.data as a Service su IBM Cloud con l'esperienza di IA generativa, vedere IBMwatsonx.data as a Service versione 2.2.1 Nuove funzionalità introdotte(NFI).

Miglioramento del servizio di metadati
Il Servizio Metadati (MDS) di watsonx.data supporta ora l'emissione di credenziali vendute attraverso le API REST di Iceberg e Unity. Richiedendo credenziali temporanee, i consumatori esterni di metadati possono ora accedere in modo sicuro ai dati dallo storage degli oggetti senza dover gestire chiavi di accesso a lunga durata.

La funzione di supporto delle credenziali vendute in watsonx.data è disponibile solo per archivi quali Amazon S3, Google Cloud Storage (GCS) e Azure Data Lake Storage (ADLS). Per abilitare il supporto delle credenziali vendute per Amazon S3 l'archiviazione, i consumatori di metadati devono specificare il campo ARN (Amazon Resource Name) del ruolo quando il S3 componente viene registrato in watsonx.data. Per ulteriori dettagli, vedere Aggiunta di Amazon S3 archivi.

11 settembre 2025 - Versione 2.2.1

Miglioramenti al motore e all'assistenza

Questa versione di watsonx.data introduce i seguenti miglioramenti al motore e al servizio:

  • Introdotta la versione v3 dell'API watsonx.data. È possibile continuare a utilizzare la versione v2 fino alla versione watsonx.data 2.3. Vedere la documentazione dell'API(v3 ).
  • È ora possibile eseguire il provisioning del motore Spark watsonx.data con il runtime Spark impostato su Spark 4.0, che consente di eseguire applicazioni Spark su Spark 4.0. Per i dettagli sulle versioni di Spark supportate, vedere Versione di Spark supportata.
  • Il servizio Milvus in watsonx.data è ora aggiornato alla versione 2.5.12.
  • È ora possibile utilizzare lo strumento di backup open-source Milvus per eseguire il backup e il ripristino dei dati da Milvus all'interno di watsonx.data.
  • Il motore Spark accelerato da Gluten in watsonx.data è ora in grado di eseguire applicazioni che utilizzano la versione Spark 3.5. Per i dettagli sulle versioni di Spark supportate, vedere Versione di Spark supportata.
  • È ora possibile utilizzare il Vector Transport Service (VTS) con Milvus in watsonx.data per migrare o gestire i dati vettoriali tra i vari sistemi. Per ulteriori dettagli, vedere Utilizzo del servizio di trasporto vettoriale.
Miglioramento dell'ottimizzatore di query

È ora possibile monitorare i miglioramenti delle prestazioni delle query attraverso la dashboard dell'ottimizzatore. L'ottimizzatore gestisce attivamente i piani di query per i cataloghi associati e migliora le prestazioni dei motori Presto (C++). Per maggiori dettagli, vedere Gestione degli aggiornamenti statistici dalla dashboard di Optimizer.

Miglioramenti alla gestione degli accessi

Questa versione di watsonx.data introduce i seguenti miglioramenti nella gestione degli accessi:

  • La gestione dei privilegi per un servizio Milvus in watsonx.data ora include i seguenti privilegi globali:

    • DescribeDatabase- Fornisce informazioni dettagliate sul database specificato.

    • AlterDatabase- Modifica le proprietà di un database esistente.

Per maggiori dettagli sulla gestione dell'accesso degli utenti in Milvus, vedere Ruoli e autorizzazioni predefiniti in watsonx.data.

Miglioramenti CLI CPDCTL

Questa versione di watsonx.data introduce i seguenti miglioramenti all'interfaccia della riga di comando IBM Cloud Pak for Data ( IBM cpdctl):

  • A partire dalla versione CPDCTL 1.8.25, la compatibilità è limitata alla versione watsonx.data 2.2.1 e successive. Questa modifica è dovuta alla deprecazione del supporto dell'API v2 come parte del grande aggiornamento alle API v3. Per gli utenti di versioni precedenti del CPDCTL, consultare l'archivio delle release del CPDCTL.

    Alcuni comandi potrebbero essere cambiati a causa degli aggiornamenti delle specifiche API. Utilizzate l'opzione --help per rivedere e adattare la sintassi dei comandi più recente.

  • A partire dalla versione watsonx.data 2.2.1, è possibile utilizzare HashiCorp Vault attraverso cpdctl per una gestione sicura dei segreti e flussi di lavoro di automazione semplificati.

  • Una nuova opzione del comando service wx-data service generate-engine-dump permette di generare i dump per i nodi worker e coordinatori di Presto in watsonx.data. Per informazioni dettagliate sul comando service per le operazioni di assistenza in watsonx.data, vedere assistenza.

  • Utilizzate il nuovo comando component per recuperare i dettagli della configurazione e lo stato dei vari componenti di watsonx.data. Per informazioni dettagliate sul comando component, che consente di ottenere i dettagli della configurazione di vari componenti in watsonx.data, vedere i comandi e l'uso di wx-data.

  • A partire dalla versione CPDCTL 1.8.5, non è più necessario impostare instance ID come variabile d'ambiente. Questo metodo è deprecato e verrà rimosso in una versione futura. Invece, impostare direttamente instance ID utilizzando il comando profile. Per informazioni dettagliate sull'impostazione della variabile d'ambiente instance ID, vedere Comandi e uso di config.

Miglioramenti alle fonti di dati e all'archiviazione

È ora possibile importare cataloghi e progetti dalla piattaforma dati per le seguenti fonti di dati:

  • IBM Db2
  • IBM Netezza
  • MySQL
  • Oracle
  • PostgreSQL
  • Snowflake
  • SQL Server
Automazione semantica per l'arricchimento dei dati

watsonx.data supporta ora funzionalità di ricerca semantica che consentono agli utenti di interrogare i dati utilizzando il linguaggio naturale, rendendo l'esplorazione dei dati più intuitiva ed efficiente. Per informazioni dettagliate sulle funzionalità di ricerca semantica, vedere Esecuzione di ricerche semantiche in watsonx.data.

Miglioramenti dell'anteprima pubblica

Le funzioni di anteprima pubblica sono ora accessibili dall'interfaccia utente Configurazioni. È ora possibile accedere e gestire facilmente le funzioni di anteprima pubblica di watsonx.data dall'interfaccia utente Configurazioni. Le funzioni in anteprima pubblica sono evidenziate con il tag Preview, che ne facilita l'identificazione. È possibile attivare o disattivare le caratteristiche per esplorare le funzionalità. Ogni funzione in anteprima pubblica include un link alla sua documentazione dettagliata, che consente di saperne di più. Per maggiori dettagli sulle funzionalità dell'anteprima pubblica, vedere Cosa c'è di nuovo in watsonx.data(anteprima pubblica).

Funzioni obsolete

Le seguenti funzioni sono deprecate in questa versione:

  • watsonx.data La versione API v2 è ora deprecata

watsonx.data La versione API v2 è completamente rimossa dall'edizione per sviluppatori watsonx.data a partire dalla versione 2.2.1. Sarà completamente rimosso dall'edizione del software watsonx.data nella versione 2.3. È necessario migrare all'ultima versione API supportata ( v3 ) per garantire la compatibilità e l'accesso alle nuove funzioni.

  • L'opzione di registrare motori Spark esterni in watsonx.data è deprecata in questa versione e sarà rimossa nella versione 2.3. watsonx.data include già motori Spark integrati che si possono fornire e utilizzare direttamente, tra cui il motore Spark accelerato da Gluten (Provisioning Gluten accelerated Spark engine ) e il motore Spark nativo watsonx.data (Provisioning a Spark engine ).

05 agosto 2025 - Versione 2.2.0 Nuova funzionalità 1 ( NF1 )

Supporto per i tipi di dati BLOB e CLOB

Il supporto dei tipi di dati BLOB e CLOB in watsonx.data è stato aggiornato per allinearsi allo standard SQL, che Presto segue come motore di query federato.

Leggi il supporto: I BLOB e i CLOB possono essere letti da sistemi federati basati su JDBC. Quando vengono letti, sono mappati come segue:

  • Da BLOB a VARBINARIO
  • Da CLOB a VARCHAR

Supporto alla scrittura: È supportata anche la scrittura di dati BLOB e CLOB, che vengono trattati come segue:

  • VARBINARY per i dati binari
  • VARCHAR per i dati dei caratteri

Creare un supporto per le tabelle: Non è possibile utilizzare BLOB o CLOB come tipi di colonna quando si creano nuove tabelle. Per questi casi d'uso sono supportati solo VARBINARY e VARCHAR.

Aggiornamento della versione del motore

I motori Presto ( Java ) e Presto (C++) sono ora aggiornati alla versione 0.294.

Connessione a watsonx BI

È ora possibile collegare watsonx.data con IBM watsonx BI per accedere direttamente ai dati disponibili in diverse fonti di dati, facilitando l'utilizzo dei dati da parte di data scientist e analisti di dati. Per informazioni sulla connessione a watsonx BI, vedere Integrazione con watsonx BI.

Miglioramento del piano Lite

Questa versione di watsonx.data introduce i seguenti miglioramenti al piano Lite:

  • Motore Spark serverless per il piano Lite: Il motore Spark nell'istanza del piano watsonx.data Lite opera in un modello serverless. È ora possibile eseguire i lavori Spark su una piattaforma senza server, eliminando la necessità di nodi dedicati per ogni motore Spark. Il serverless Spark consente un limite massimo di risorse di 8 vCPU×32 GB, dove gli utenti possono accedere a un pool condiviso di nodi. I runtime di Spark sono programmati su qualsiasi nodo disponibile nel piano dati, anziché su un nodo dedicato. Per informazioni su come eseguire il provisioning di un'istanza di piano Lite e creare un motore Spark in essa, vedere Provisioning di un motore Spark serverless per piano Lite.

  • È stata introdotta una nuova configurazione di dimensioni Lite per il motore Presto ( Java ), che offre una configurazione di distribuzione a singolo nodo per scopi di sperimentazione e sviluppo iniziale. Il motore Lite Presto ( Java ) è disponibile solo nelle istanze del piano watsonx.data Lite. Per ulteriori informazioni, vedere Provisioning di un motore Presto(Java ).

Miglioramento dell'ingestione

Questa versione di watsonx.data include il seguente miglioramento dell'ingestione:

Il formato di file.txt è ora accettato per l'inserimento dei dati. Questo miglioramento amplia la flessibilità consentendo agli utenti di caricare senza problemi file di testo semplice oltre ai formati già supportati.

Miglioramenti del servizio

È ora possibile configurare il timeout delle query utilizzando due impostazioni: Tempo massimo di esecuzione della query e Timeout del client di query. Per ulteriori informazioni, vedere Gestione delle impostazioni utente in watsonx.data: Timeout di sessione, timeout di interrogazione e impostazioni dei messaggi di accesso

11 luglio 2025

L'11 luglio 2025 è stata rilasciata una nuova versione di watsonx.data con le seguenti modifiche:

Nuova disponibilità regionale
watsonx.data su AWS è ora disponibile nella regione di Mumbai.

07 luglio 2025 - Versione 2.2.0 Hotfix 1

La versione 2.2 hotfix di watsonx.data è stata rilasciata il 07 luglio 2025. Questa release include aggiornamenti e correzioni di sicurezza.

11 giugno 2025 - Versione 2.2.0

Miglioramenti al motore e all'assistenza

Questa versione di watsonx.data introduce i seguenti miglioramenti al motore e al servizio:

  • Introdotte nuove versioni dell'API per la connessione a un servizio Milvus utilizzando un percorso host proxy. Per ulteriori informazioni, vedere Connessione al servizio Milvus.
  • Per i motori Presto (C++), i cataloghi Hive e Iceberg sono ora abilitati con la configurazione della regione. Per ulteriori informazioni, vedere Provisioning di un motore Presto(C++).
  • Nuovo motore Spark accelerato da Gluten: è ora possibile fornire il motore Spark accelerato da Gluten e utilizzarlo per eseguire carichi di lavoro analitici complessi sfruttando l'elevata scalabilità del framework Spark SQL e le alte prestazioni delle librerie native. Per informazioni su come lavorare con il nuovo motore Spark accelerato da Gluten, vedere Lavorare con il motore Spark accelerato da Gluten.
  • Eseguire query più veloci nello spazio di lavoro utilizzando un job di Spark per trasformare i dati delle tabelle Iceberg: Per accelerare la lettura delle tabelle Iceberg, è ora possibile utilizzare un job Spark per trasformare i dati delle tabelle Iceberg dal formato Merge-on-Read (MOR) al formato Copy-on-Write (COW). Per ulteriori informazioni, vedere Invio di lavori Spark per la conversione da MoR a CoW.
  • È possibile utilizzare la funzionalità API di Spark per configurare il limite di applicazioni che possono essere elencate e i criteri di filtro da utilizzare per filtrare le applicazioni Spark.
Miglioramenti CLI CPDCTL

Questa versione di watsonx.data introduce i seguenti miglioramenti all'interfaccia della riga di comando IBM Cloud Pak for Data ( IBM cpdctl):

  • È possibile utilizzare il comando tablemaint per eseguire diverse operazioni di manutenzione delle tabelle Iceberg in watsonx.data.

  • È possibile utilizzare il comando wx-data service per eseguire varie operazioni relative alla serviceability, come l'elenco delle tabelle, il recupero dell'elenco dei bucket abilitati a QHMM e il monitoraggio delle statistiche e delle query relative a QHMM.

Per ulteriori informazioni, vedere IBM cpdctl.

Miglioramenti dell'integrazione

Questa versione di watsonx.data introduce la seguente integrazione avanzata con altri servizi:

  • Nuovo metodo di consegna: Consegna come tabella in watsonx.data

I prodotti di dati che utilizzano fonti di dati supportate possono ora essere consegnati alle tabelle della vostra istanza di watsonx.data utilizzando il metodo deliver as a table in watsonx.data. Questo metodo consente agli utenti con i permessi appropriati di creare nuove tabelle o di aggiungere a quelle esistenti. Per ulteriori informazioni, vedere Integrazione con Data Product Hub.

  • Nuovo metodo di consegna: Accesso in watsonx.data

È ora possibile sottoscrivere un prodotto di dati creato dall'istanza watsonx.data utilizzando il metodo di consegna access in watsonx.data. Questo metodo consente ai consumatori di accedere direttamente alle risorse di watsonx.data attraverso Data Product Hub. Dopo la consegna, i consumatori vedranno i dettagli su come accedere all'istanza watsonx.data e le risorse specifiche a cui hanno accesso. Per ulteriori informazioni, vedere Integrazione con Data Product Hub.

  • Ora è possibile connettersi al server di query di Spark nei modi seguenti ed eseguire query per analizzare i dati.

    • Utilizzo di DBeaver (client JDBC )
    • Utilizzando il codice di Java ( JDBC Client)
    • Utilizzo di Python ( PyHive JDBC Client)

    Per ulteriori informazioni, vedere Connessione al server di query Spark tramite il driver Spark JDBC.

Miglioramenti alla fatturazione

Questa versione di watsonx.data introduce i seguenti miglioramenti alla funzione di fatturazione:

  • Granularità della fatturazione: Gli utenti potranno ora visualizzare i loro estratti conto in un formato dettagliato, offrendo una maggiore granularità e trasparenza
  • Accuratezza della fatturazione: L'utilizzo della fatturazione da parte degli utenti sarà ora monitorato a livello di singolo minuto, sostituendo il precedente metodo dell'high-watermark
Miglioramento del monitoraggio e della gestione della cronologia delle query (QHMM)

Questa versione di watsonx.data introduce il seguente miglioramento di QHMM:

La pagina di monitoraggio delle query è stata rimossa dalla configurazione guidata di avvio rapido ed è stata consolidata con la pagina Configura un bucket. Ora è possibile attivare, disattivare e configurare i dettagli di archiviazione di QHMM direttamente dalla pagina aggiornata Configura un bucket disponibile nella procedura guidata di avvio rapido. Per informazioni sulla configurazione aggiornata della procedura guidata di avvio rapido, vedere Avvio rapido.

Miglioramenti alle fonti di dati e all'archiviazione

Questa versione di watsonx.data include il seguente miglioramento dell'archiviazione:

È ora possibile utilizzare il sito SQL Server con l'autenticazione New Technology LAN Manager (NTLM) e l'autenticazione Microsoft Entra. NTLM è un metodo di autenticazione a sfida e risposta basato su Windows. Per ulteriori informazioni, vedere SQL Server.

È ora possibile creare i seguenti archivi in uno stato attivo per impostazione predefinita:

  • IBM Cloud Object Storage
  • Amazon S3
  • IBM Storage Ceph
  • MinIO
  • Google Cloud Storage
  • Azure Storage del lago di dati
  • Apache Ozone
Miglioramenti alla gestione degli accessi

Questa versione di watsonx.data introduce i seguenti miglioramenti nella gestione degli accessi:

  • È possibile utilizzare la funzionalità di esportazione per scaricare i criteri delle risorse esistenti e importarli in un altro ambiente richiesto. In questo modo si garantisce la coerenza e si facilita la migrazione. Per informazioni su come utilizzare la funzionalità di importazione ed esportazione, vedere Gestione dell'accesso degli utenti.
  • Un amministratore del catalogo o un utente che appartiene a un gruppo con ruolo di amministratore può ora rimuovere il proprio accesso al catalogo. Per ulteriori informazioni su come rimuovere un utente per un componente, vedere Gestione dell'accesso degli utenti.
  • Gli utenti non amministratori hanno accesso in sola lettura e possono ora visualizzare la pagina Driver Manager nella sezione Configurazioni. In questo modo possono vedere l'elenco dei conducenti attivi e i loro dettagli senza dover consultare un amministratore. Per ulteriori informazioni, vedere Gestione driver.
Miglioramenti alla revisione e alla tracciabilità

Questa versione di watsonx.data introduce i seguenti miglioramenti per l'auditing e la tracciabilità:

L'elenco degli eventi tracciabili ora include attività dettagliate relative al server MDS Thrift e al server MDS Rest, fornendo informazioni su come le applicazioni e gli utenti interagiscono con questi componenti critici. Per informazioni, vedere Eventi del server MDS Thrift ed Eventi del server MDS Rest.

Funzioni obsolete

Le seguenti funzioni sono deprecate in questa versione:

  • Le API Milvus che utilizzano l'host REST (API con il prefisso /api/v1 ) sono deprecate a partire da watsonx.data v2.2.

  • Azure Data Lake Storage (ADLS) Gen1 è ora deprecato e sarà rimosso in una prossima versione. È necessario passare all'ADLS Gen2 perché l'ADLS Gen1 non è disponibile.

  • Il metodo di autenticazione dell'utente che prevede l'uso di ibmlhapikey e ibmlhtoken come nome utente è ora deprecato e sarà rimosso in una prossima versione. È possibile utilizzare invece ibmlhapikey_<username> e ibmlhtoken_<username>. Per maggiori informazioni, vedere Gestione degli accessi e governance in watsonx.data.

10 aprile 2025 - Versione 2.1.2 Hotfix 1

Miglioramenti al motore e all'assistenza

Questa versione di watsonx.data introduce il seguente miglioramento del servizio:

È stato introdotto Tiny Milvus, un'implementazione leggera e a singolo nodo del database vettoriale Milvus, adatta alla sperimentazione e allo sviluppo in fase iniziale.

Tiny Milvus fornisce l'esperienza di base di Milvus ed è progettato specificamente per essere utilizzato all'interno della piattaforma watsonx.ai. Serve come punto di ingresso per l'esplorazione dell'IA basata su vettori con requisiti minimi di risorse per garantire una gestione e un'analisi efficaci dei dati. Si distingue da altre configurazioni di Milvus disponibili all'interno di watsonx.data, che supportano una scalabilità più ampia e funzionalità di livello enterprise.

Tiny Milvus supporta fino a 10K vettori, rendendolo adatto per prove rapide e sperimentazioni iniziali senza infrastrutture pesanti. Non è destinato a carichi di lavoro di produzione.

Per ulteriori informazioni sull'uso di Tiny Milvus, vedere Impostazione di un archivio vettoriale watsonx.data Milvus.

04 aprile 2025 - Versione 2.1.2

Miglioramenti alle fonti di dati e all'archiviazione

Questa versione di watsonx.data include il seguente miglioramento dell'archiviazione:

Ora è possibile connettersi alla IBM Db2 for i all'origine dati. Per informazioni su IBM Db2 for i, vedere IBM Db2 for i.

Miglioramenti della connettività

Questa versione di watsonx.data include il seguente miglioramento della connettività:

È ora possibile connettersi in modo sicuro e privato a un'istanza di watsonx.data utilizzando endpoint privati virtuali. Per informazioni sulla configurazione degli endpoint di rete in watsonx.data, vedere Impostazione di endpoint privati virtuali.

Miglioramenti dell'integrazione

Questa versione di watsonx.data introduce le seguenti integrazioni migliorate con altri servizi:

  • Ora è possibile definire le politiche di governance di IBM Knowledge Catalog per il motore Presto (C++) quando si integra con watsonx.data. Per informazioni sulla connessione a IBM Knowledge Catalog (IKC), vedere Connessione a IBM Knowledge Catalog(IKC).
  • È ora possibile esportare i file di configurazione per il motore Presto di destinazione, in base alla selezione del driver ODBC (Simba o CData), per stabilire più facilmente le connessioni con watsonx.data. Questo miglioramento evita di configurare manualmente i dettagli del motore Presto utilizzando PowerBI. Per ulteriori informazioni sulla connessione a Presto tramite i file di configurazione, vedere Connessione a Presto tramite i file di configurazione.
  • Integrazione con Data Product Hub: è possibile integrare watsonx.data con DPH per confezionare tabelle e query SQL in prodotti di dati personalizzati per casi d'uso specifici. Per ulteriori informazioni, vedere Integrazione con Data Product Hub.
Miglioramento dell'ingestione

Questa versione di watsonx.data include il seguente miglioramento dell'ingestione:

I lavori di ingestione che utilizzano un motore Spark esterno ora forniscono i log all'interno di watsonx.data. Questo miglioramento consente agli utenti di identificare e risolvere efficacemente i problemi di esecuzione dei lavori direttamente all'interno di watsonx.data sulla piattaforma cloud (istanza SaaS ). I dettagli della procedura di ingestione sono disponibili in Ingestione di dati tramite Spark attraverso la console web.

Miglioramenti al motore e all'assistenza

Questa versione di watsonx.data introduce i seguenti miglioramenti al motore e al servizio:

È ora possibile utilizzare il Data Lake Storage Azure Gen2 con AccessKey Authmode con motore Spark per archiviare i dati durante la presentazione di applicazioni Spark. Per informazioni su Azure Data Lake Storage Gen2, vedere Azure Data Lake Storage.

Miglioramenti all'area di lavoro delle query

Questa versione di watsonx.data introduce il seguente miglioramento dell'area di lavoro delle query:

È ora possibile annullare una o più query in esecuzione. Inoltre, è possibile rimuovere le query dal foglio di lavoro dopo che sono state annullate o completate con successo, facilitando l'organizzazione dell'area di lavoro. Per ulteriori informazioni, vedere Esecuzione di query SQL.

Miglioramenti alla gestione degli accessi

Questa versione di watsonx.data introduce i seguenti miglioramenti nella gestione degli accessi:

  • Gli amministratori possono ora configurare l'accesso per IBM Db2 e IBM Netezza. Possono assegnare ruoli agli utenti di watsonx.data per visualizzare, modificare e amministrare i motori IBM Netezza e IBM Db2. Per informazioni sui permessi a livello di risorsa, vedere (Db2 e Netezza ).
  • Gli amministratori possono ora concedere o revocare autorizzazioni specifiche a utenti o ruoli durante la creazione e la visualizzazione dei propri schemi. Per informazioni sulle regole dei criteri dei dati, vedere Gestione delle regole dei criteri dei dati.
  • Il flusso proxy DAS, precedentemente deprecato, è stato rimosso e non è più disponibile in watsonx.data.
Miglioramento del monitoraggio e della gestione della cronologia delle query (QHMM)

Questa versione di watsonx.data introduce i seguenti miglioramenti di QHMM:

  • È ora possibile selezionare il motore Presto associato a un catalogo QHMM quando si configura il monitoraggio delle query in watsonx.data. Per informazioni sulla configurazione di QHMM, vedere Configurazione del monitoraggio delle query.
  • Ora è possibile utilizzare lo script di migrazione per trasferire i dati QHMM dal bucket di origine al bucket di destinazione in watsonx.data. Per ulteriori informazioni sull'uso dello script di migrazione, vedere Uso dello script di shell QHMM.
Miglioramenti CLI CPDCTL

Questa versione di watsonx.data introduce i seguenti miglioramenti all'interfaccia della riga di comando IBM Cloud Pak for Data ( IBM cpdctl):

  • A partire dalla versione 2.1.2, è disponibile per impostazione predefinita il comando wx-data, che consente di eseguire operazioni quali l'ingesting, la gestione dei motori e così via, in watsonx.data.
  • È possibile utilizzare i comandi wx-data engine create e wx-data engine delete per eseguire il provisioning e la cancellazione di tutti i motori disponibili in watsonx.data.
  • Potete usare il comando sparkjob per inviare, elencare e ottenere i dettagli di un'applicazione Spark.
  • INSTANCE_ID utilizzato per impostare l'ambiente dell'istanza è sostituito da WX_DATA_INSTANCE_ID.

Per ulteriori informazioni, vedere IBM cpdctl.

28 febbraio 2025 - Versione 2.1.1

Nuova disponibilità regionale

watsonx.data è ora disponibile nella regione di Toronto per i piani Lite ed Enterprise. Per l'approvvigionamento, vedere il piano Provisioning watsonx.data Lite e il piano Provisioning watsonx.data Enterprise.

Miglioramenti alle fonti di dati e all'archiviazione

Questa versione di watsonx.data include i seguenti miglioramenti per l'archiviazione:

  • Ora è possibile testare le connessioni per le seguenti fonti di dati e archiviazione:

    • Apache Phoenix
    • IBM Data Virtualization Manager
    • BigQuery
    • Google Cloud Storage
  • Ora è possibile registrare e caricare tabelle Hudi e Delta esterne preesistenti su un archivio di oggetti utilizzando le API Register table e load table metadata.

Miglioramento dell'ingestione

Una volta completato un lavoro di acquisizione, è ora possibile accedere ai dati acquisiti direttamente dalla pagina Cronologia acquisizione, che semplifica il flusso di lavoro e fa risparmiare tempo.

Miglioramenti dell'integrazione

Questa versione di watsonx.data introduce le seguenti integrazioni migliorate con altri servizi:

  • La pagina Informazioni sulla connessione ora include:
    • Presto dettagli di configurazione per l'integrazione DBT. Da questa pagina è possibile copiare i dettagli di configurazione dell' Presto, necessari per l'integrazione con DBT.
    • Opzione per esportare il file TDS, che include i dettagli di configurazione del motore dell' Presto, necessari per l'integrazione dell' Tableau.

Per ulteriori informazioni, vedere Informazioni sulla connessione.

Miglioramenti al motore e all'assistenza

Questa release di watsonx.data introduce i seguenti miglioramenti del motore e del servizio:

  • Ora è possibile creare un'applicazione Spark dalla scheda Applicazioni della pagina dei dettagli del motore Spark. Per ulteriori informazioni, vedere Invio dell'applicazione Spark dalla console.
  • È ora possibile utilizzare la versione di Spark, 3.5.4, per eseguire le applicazioni in watsonx.data. In watsonx.data, Apache Spark 3.4.4 e Apache Spark 3.5.4 sono le versioni supportate.
  • Milvus consente quanto segue:
    • In Milvus ora è possibile eseguire una ricerca ibrida di tipo " GroupBy " basata su più colonne vettoriali e personalizzare anche la dimensione del gruppo quando si eseguono le query di ricerca. Per ulteriori informazioni, consultare Collegamento watsonx Assistant a watsonx.data Milvus per la ricerca personalizzata.
    • Milvus ora supporta dimensioni personalizzate con una capacità di 3 miliardi di vettori con un massimo di 1.024 dimensioni.
    • Milvus ora consente di aumentare o diminuire le dimensioni tra le taglie predefinite di magliette (piccola, media e grande) o le taglie personalizzate. Per ulteriori informazioni, vedere Aggiunta di un serviz Milvus.
  • A partire dalla versione watsonx.data 2.1.1, è supportato Milvus 2.5.0. Per ulteriori informazioni, vedere Milvus.
Miglioramenti alla gestione degli accessi

Questa versione di watsonx.data introduce i seguenti miglioramenti nella gestione degli accessi:

  • Il servizio di gestione degli accessi (AMS) in watsonx.data può ora utilizzare l'autenticazione JSON Web Token (JWT) per le richieste in arrivo da Presto, garantendo un controllo degli accessi sicuro ed efficiente. Per ulteriori informazioni, vedere Collegamento a un motore Presto e tramite Presto CLI(remoto ).
  • Ora è possibile assegnare utenti e ruoli ai componenti dell'infrastruttura in gruppi di venti. Per ulteriori informazioni, vedi Gestione dell'accesso utente.
  • Ora è possibile utilizzare le politiche SQL di SQL Server 2014 e SQL Server 2016 per gestire i dati con i motori Spark. Apache Ranger Hadoop È possibile definire le politiche di Ranger quando il motore Spark accede ai dati dai cluster di Hadoop. La politica di abilitazione di Ranger garantisce una solida sicurezza e governance dei dati. Con la politica Ranger, è possibile configurare l'autorizzazione delle tabelle ( L3 ), il filtraggio a livello di riga e il mascheramento delle colonne per i dati. Per ulteriori informazioni, vedere Abilitazione dell' Apache are la politica del ranger per le risorse.
Miglioramenti CLI CPDCTL

IBM CPDCTL La CLI viene ora utilizzata per configurare e gestire diverse operazioni in watsonx.data. Utilizzando l' CPDCTL CLI, è possibile gestire le impostazioni di configurazione, eseguire lavori di acquisizione, gestire motori, fonti di dati e archivi. I seguenti due plugin sono attualmente utilizzati per eseguire queste operazioni:

  • config- Configurare un ambient watsonx.data e di servizio e gli utenti.

  • wx-data- Per eseguire altre operazioni come l'ingestione, la gestione dei motori, ecc. in watsonx.data. Per ulteriori informazioni, consultare IBM cpdctl.

    watsonx.data L'edizione per sviluppatori è ora abilitata nella versione IBM v1.6.104 CPDCTL e successive.

Funzioni obsolete

Le seguenti funzioni sono deprecate in questa versione:

  • La funzione proxy del servizio di accesso ai dati (DAS) è ora obsoleta e verrà rimossa in una versione futura. Non è possibile utilizzare la funzione proxy del servizio di accesso ai dati (DAS) per accedere all'archiviazione di oggetti ( S3, ADLS e ABS). Se utilizzi DAS proxy flow e riscontri problemi, contatta l'assistenza IBM. Per una panoramica della funzione DAS, vedere Servizio di accesso ai dati(DAS ).

  • IBM Il pacchetto Client è ora obsoleto e verrà rimosso in una versione futura. Le utilità e i comandi nel pacchetto Client sono sostituiti con un IBM e CPDCTL CLI. Per ulteriori informazioni su come utilizzare IBM CPDCTL CLI, vedere IBM cpdctl.

04 febbraio 2025 - Versione 2.1.0 e Hotfix 2

Miglioramento del piano Lite
IBM® watsonx.data Il piano Lite è ora disponibile nella regione di Sydney. Per ulteriori informazioni sul provisioning di un'istanza del piano Lite nella regione di Sydney, vedere Provisioning del piano Lite.

10 gennaio 2025 - Versione 2.1.0 e Hotfix 1

Miglioramento del piano aziendale
Se si utilizza IBM Cloud CLI per eseguire il provisioning di un'istanza del piano Enterprise nella regione di Sydney, è necessario utilizzare il nome del piano lakehouse-enterprise-mcsp. Per ulteriori informazioni, vedere Provisionamento di un'istanza tramite CLI.

13 dicembre 2024 - Versione 2.1.0

Miglioramenti alle fonti di dati e all'archiviazione

Questa versione include le seguenti nuove fonti di dati e miglioramenti per l'archiviazione:

  • Ora è possibile connettersi a fonti di dati di terz Apache Phoenix. Per ulteriori informazioni, consultare Apache Phoenix

  • Se lavorate con fonti di dati MySQL, ora potete gestire i driver nella sezione Driver manager della pagina Configurazioni. Ciascuno di questi driver viene sottoposto a una serie di fasi di convalida. Non è più possibile testare le connessioni MySQL. Per ulteriori informazioni, vedere MySQL.

Quando si esegue l'aggiornamento alla versione 2.1.0, qualsiasi MySQL catalogo esistente non è più collegato al motore. Ciò significa che è necessario ristabilire la connessione tra il MySQL catalogo e il motore.

  • La funzione di connessione di prova è ora disponibile per le seguenti fonti di dati supportate da Arrow Flight service:

    • Apache Derby
    • Salesforce
    • Greenplum
    • MariaDB
  • Ora è possibile testare la connessione per Azure Data Lake Storage (ADLS) e l'origine dati IBM Data Virtualization Manager for z/OS.

Miglioramenti dell'integrazione

Questa versione di watsonx.data introduce le seguenti integrazioni nuove o migliorate con altri servizi:

  • Ora è possibile attivare la connessione Databand dalla pagina Configurazioni. Per ulteriori informazioni, vedere Monitoraggio dell'esecuzione delle applicazioni Spark tramite Databand.

  • È ora possibile recuperare le informazioni di connessione di Presto dall'istanza watsonx.data > Configurazioni > Informazioni sulla connessione per la seguente integrazione:

    • Strumenti di BI
    • DataBuildTool (dbt)
  • A partire dalla versione watsonx.data 2.1, è possibile integrarsi solo con uno dei seguenti motori di policy:

    • Apache Ranger
    • IBM Knowledge Catalog (IKC)

Per ulteriori informazioni, vedere Informazioni sulla connessione.

  • È ora possibile integrare IBM Manta Data Lineage con watsonx.data per acquisire e pubblicare lavori, esecuzioni ed eventi di dataset da Spark attraverso l'interfaccia utente di Manta. Per ulteriori informazioni, vedere IBM Manta Data Lineage.

  • È ora possibile utilizzare tutti i tipi di dati Presto con l'adattatore dbt per Presto. Specificare il tipo di dati come column_types nel file dbt_project.yml Per ulteriori informazioni, vedere Installazione e utilizzo di watsonx.

Miglioramenti al motore e all'assistenza

Questa release di watsonx.data introduce i seguenti miglioramenti del motore e del servizio:

Interrogare le informazioni sulla cronologia utilizzando l'utility ibm-lh

È possibile ottenere le seguenti informazioni sulla cronologia delle query utilizzando l'utility ibm-lh:

  • Informazioni di base sulla query.
  • Informazioni di base sugli errori delle query non riuscite.
  • Informazioni sulle statistiche della query.
  • Interrogare le informazioni sulla memoria.
  • Interrogare le informazioni sulla garbage collection.
  • Interrogazione in tempo reale.
  • Dettagli sull'uso della memoria delle query.
  • Informazioni dopo aver unito le due tabelle.
  • Informazioni contenenti tutte le colonne di una tabella.
  • Informazioni sugli errori della query.
  • Conteggio di tutti i codici di errore.
  • Conteggio di tutti i messaggi di errore.
  • Conteggio di tutti i tipi di guasto.

Per ulteriori informazioni, vedere Recupero dei registri QHMM mediante l'utilità ibm-lh.

Miglioramenti all'ingestione

Questa versione di watsonx.data introduce i seguenti miglioramenti nell'ingestione:

  • Anteprima della tabella di destinazione: Prima di inviare un lavoro di ingestione, gli utenti possono ora visualizzare l'anteprima dello schema della tabella di destinazione e modificare le intestazioni delle colonne e i tipi di dati. Ciò consente la convalida e garantisce che i dati vengano inseriti nella struttura corretta delle tabelle. Per ulteriori informazioni, vedere Ingestione di dati utilizzando Spark attraverso la console web.

  • Ingestione Java per la creazione di tabelle: Il Data Manager include ora un'opzione per creare tabelle utilizzando il flusso di ingestione Java navigando verso l'ingestione locale, offrendo flessibilità e controllo in base alle dimensioni del file e ad altri fattori. Per ulteriori informazioni, vedere Creazione di tabelle e Ingesting di dati utilizzando Spark attraverso la console web.

  • Supporto migliorato per l'archiviazione delle fonti:

    • Azure Data Lake Storage (ADLS): È ora disponibile il supporto per l'ingestione dei dati direttamente da ADLS.
    • Google Cloud Storage (GCS): È ora disponibile il supporto per l'acquisizione di dati direttamente da GCS.
  • Archiviazione transitoria: Gli utenti possono ora selezionare il bucket esterno da usare come area di staging per le ingestioni locali. Se non viene specificato alcun deposito, watsonx.data può dedurre e selezionare un bucket appropriato. Per ulteriori informazioni, vedere Ingestione di dati utilizzando Spark attraverso la console web.

Introduzione al servizio di metadati (MDS)

A partire dalla versione 2.1, watsonx.data utilizza Metadata Service (MDS) invece di Hive Metastore (HMS). MDS è compatibile con le moderne API di catalogo aperte, Unity Catalog API e Apache Iceberg REST Catalog API, consentendo una maggiore integrazione degli strumenti e una maggiore flessibilità. Questa nuova architettura offre prestazioni comparabili e continua a supportare i client Spark e Presto attraverso l'interfaccia Thrift o HMS esistente. Per ulteriori informazioni, vedere Panoramica del servizio metadati(MDS).

Si consiglia di utilizzare l'MDS negli ambienti di prova per poi passare all'uso in produzione.

Funzioni obsolete

La seguente funzione è deprecata in questa versione:

  • La funzione API REST per catturare le modifiche DDL in watsonx.data attraverso l'ascoltatore di eventi sarà deprecata dalla versione 2.1 di watsonx.data.

13 novembre 2024 - Versione 2.0.4 Hotfix

Miglioramenti del piano Lite

Questa release di hotfix include i seguenti miglioramenti del piano Lite:

  • Lite plan ora include uno storage IBM COS dedicato ai campioni di sola lettura associato al motore Presto per supportare l'interrogazione dei dati di campione e di benchmarking.

  • È ora possibile lavorare con i fogli di lavoro di esempio tpcds per i casi d'uso ad alte prestazioni e con il foglio di lavoro di esempio Gosales per i casi d'uso Data engineering e GenAI.

  • Query Optimizer è ora automaticamente abilitato per i casi d'uso della BI ad alte prestazioni.

29 ottobre 2024 - Versione 2.0.4

Miglioramenti al motore e all'assistenza

Questa release include i seguenti miglioramenti del motore e del servizio:

  • Il valore predefinito della proprietà 'task.max-drivers-per-task per i worker PrestoJava) e Presto (C++) è ora impostato in base al numero di vCPUs.

  • È possibile attivare la funzionalità di potatura dei file in Query History Monitoring and Management (QHMM) dalla pagina di monitoraggio delle query. È inoltre possibile configurare la dimensione massima e la percentuale di soglia per il bucket di archiviazione QHMM. Quando la soglia viene raggiunta durante il caricamento dei file o quando viene eseguito un programma di pulizia (predefinito ogni 24 ore), i dati più vecchi vengono eliminati. Per ulteriori informazioni, vedere Configurazione del monitoraggio delle query.

  • Query History Monitoring and Management (QHMM) non memorizza più i dati diagnostici nel bucket di prova predefinito di IBM Managed (wxd-system). Per memorizzare i dati diagnostici, è ora necessario utilizzare un tipo di archiviazione supportato da QHMM. Per ulteriori informazioni sull'uso del proprio archivio, vedere Configurazione del monitoraggio delle query.

  • È ora possibile verificare lo stato di ottimizzazione della query controllando il parametro 'wxdQueryOptimized nel file JSON. Per ulteriori informazioni, vedere Esecuzione di query dalla CLI di Presto(C++)o dall'area di lavoro Query.

Miglioramenti alle fonti di dati

Questa release include le seguenti fonti di dati e miglioramenti per l'archiviazione:

  • La funzione di connessione di prova è ora disponibile per le seguenti fonti di dati:

    • Apache Pinot
    • Cassandra
    • Prometheus
  • Nuova fonte di dati SAP HANA è ora disponibile. È possibile utilizzare Driver manager nella pagina Configurazioni per gestire i driver dell'origine dati SAP HANA. Ciascuno di questi driver è sottoposto a una serie di convalide.

Piano Lite

Per migliorare l'usabilità, i cataloghi di sistema (cmx e system) sono ora nascosti per gli utenti del piano Lite. L'istanza del piano Lite con motore Presto (C++) include 'tpch come catalogo di benchmarking e l'istanza con motore PrestoJava) include 'tpch e 'tpcds come cataloghi di benchmarking.

Funzioni obsolete

Le seguenti funzioni sono deprecate in questa versione:

  • La funzione dell'API REST per catturare le modifiche DDL in watsonx.data tramite un ascoltatore di eventi è deprecata in questa versione e sarà rimossa da watsonx.data con la versione 2.1.

  • Il supporto per il runtime Apache Spark 3.3 è deprecato. È necessario aggiornare a Spark 3.4. Per aggiornare la versione di Apache Spark, vedere Modifica dei dettagli del motore Spark.

25 settembre 2024 - Versione 2.0.3

Miglioramenti alle fonti di dati e all'archiviazione

Questa versione include le seguenti nuove fonti di dati e miglioramenti per l'archiviazione:

  • È ora possibile abilitare Azure Data Lake Storage Gen1 Blob e Google Cloud Storage per Milvus. Per ulteriori informazioni, vedere Blob ADLS Gen1 e Google Cloud Storage.

  • È possibile creare o aggiungere una nuova origine dati al motore senza allegare un catalogo. È possibile allegare un catalogo all'origine dati in una fase successiva.

  • È ora possibile utilizzare la memoria Apache Ozone per il motore Presto ( Java ). Per ulteriori informazioni, vedere Apache Ozone.

  • Ora è possibile configurare l'origine dati Apache Kafka per utilizzare il meccanismo di autenticazione Salted Challenge Response Authentication Mechanism (SCRAM). È possibile caricare un certificato autofirmato. Per ulteriori informazioni, vedere Apache Kafka.

Miglioramenti dell'integrazione

Questa versione di watsonx.data introduce le seguenti integrazioni nuove o migliorate con altri servizi:

  • È ora possibile integrare watsonx.data con data build tool (dbt) per il motore Spark per la trasformazione dei dati in-place all'interno di watsonx.data. Per ulteriori informazioni, vedere Informazioni sull'integrazione dbt.

  • È possibile integrare watsonx.data con Databand. Questa integrazione può migliorare le capacità di monitoraggio, fornendo approfondimenti che vanno al di là di Spark UI e Spark History. Per ulteriori informazioni, vedere Monitoraggio dell'esecuzione delle applicazioni Spark tramite Databand.

  • È possibile integrare watsonx.data con i seguenti strumenti di visualizzazione di Business Intelligence (BI) per accedere alle fonti di dati collegate e creare visualizzazioni di dati interessanti e interattive:

    • Tableau
    • Looker
    • Domo
    • Qlik
    • PowerBI

    Per ulteriori informazioni, vedere Sugli strumenti di visualizzazione della BI.

Miglioramenti al motore e all'assistenza

Questa release di watsonx.data introduce i seguenti miglioramenti del motore e del servizio:

  • Le tabelle Iceberg sono supportate da Query Optimizer. Per ulteriori informazioni, vedere Query Optimizer.

  • È ora possibile utilizzare lo strumento di costruzione dei dati (adattatore dbt-watsonx-presto) per costruire, testare e documentare i modelli di dati per il motore Presto (Java). Per ulteriori informazioni, vedere dbt-watsonx-presto.

  • Una nuova proprietà di personalizzazione (file-column-names-read-as-lower-case) è ora disponibile per il motore Presto (C++) per evitare la mancata corrispondenza tra maiuscole e minuscole nei nomi delle colonne. Per ulteriori informazioni, vedere Proprietà del catalogo per Presto(C++).

Miglioramenti alla gestione degli accessi

Questa versione di watsonx.data introduce i seguenti miglioramenti nella gestione degli accessi:

  • È ora possibile aggiungere utenti e gruppi di utenti per definire le regole dei criteri dei dati. Per ulteriori informazioni, vedere Politiche sui dati.

  • Gli amministratori possono ora selezionare i cataloghi TPCDS e TPCH per creare criteri di controllo degli accessi. 'Seleziona' è l'unica operazione consentita per definire le regole con questi cataloghi. Per definire le politiche sui dati, vedere Politiche sui dati.

  • Gli amministratori possono ora modificare la configurazione del gruppo di risorse dopo averla creata. Per ulteriori informazioni, vedere Configurazione dei gruppi di risorse Presto.

Politiche di governance IBM Knowledge Catalog per le fonti di dati

È ora possibile applicare i criteri di governance di IBM Knowledge Catalog alle seguenti fonti di dati in Presto:

  • Oracle
  • PostgreSQL
  • MySQL
  • SQL Server
  • Db2
Miglioramenti all'ingestione

Questa versione di watsonx.data include i seguenti miglioramenti al flusso di lavoro di ingestione:

Piano Lite

È possibile eseguire il provisioning dell'istanza del piano Lite in base ai tre casi d'uso seguenti. Selezionare un caso d'uso dall'elenco per procedere:

  • IA generativa: questa opzione consente di esplorare i casi d'uso dell'IA generativa. L'istanza fornita comprende Presto, Milvus e Spark.
  • High Performance BI: questa opzione consente di esplorare le funzionalità di visualizzazione della BI. L'istanza fornita comprende Presto (C++) e Spark.
  • Carichi di lavoro di ingegneria dei dati: è possibile utilizzare i carichi di lavoro di ingegneria dei dati per esplorare vari casi d'uso basati sui carichi di lavoro. L'istanza fornita include Presto (Java) e Spark.

Per ulteriori informazioni, vedere Piano Lite.

27 agosto 2024 - Versione 2.0.2

Miglioramenti alle fonti di dati e all'archiviazione

Questa versione include le seguenti nuove fonti di dati e miglioramenti per l'archiviazione:

  • Il Content Aware Storage (CAS) è ora chiamato Data Access Service (DAS).

  • Apache Hive è aggiornato alla versione 4.0.0.

  • Ora è possibile visualizzare l'endpoint DAS dalla pagina Dettagli dello storage. Per ulteriori informazioni, vedere Esplorazione degli oggetti di archiviazione.

Miglioramenti dell'integrazione

Questa versione di watsonx.data introduce le seguenti integrazioni nuove o migliorate con altri servizi:

  • È ora possibile utilizzare le funzionalità di governance di IBM Knowledge Catalog per le viste SQL all'interno della piattaforma watsonx.data. Per ulteriori informazioni, vedere Integrazione con IBM Knowledge Catalog(IKC).

  • IBM watsonx.data ora supporta i criteri Ranger di Apache per governare i dati con i motori Presto (C++). Per ulteriori informazioni, vedere Apache Politica dei ranger.

Miglioramenti del motore e dei servizi

Questa release di watsonx.data introduce i seguenti miglioramenti del motore e del servizio:

  • Gli amministratori delle istanze possono ora configurare gruppi di risorse in Presto. Per ulteriori informazioni, vedere Gruppi di risorse.

  • È ora possibile utilizzare un'API per eseguire le query e recuperare i risultati. Per ulteriori informazioni, vedere API.

  • È ora possibile configurare o modificare il livello di log di Presto (Java) tramite la personalizzazione dell'API. Per ulteriori informazioni, API.

  • È ora possibile generare statistiche sulle colonne Number of Distinct Values (NDV) con la procedura Iceberg Spark Analyze per migliorare il Cost-Based Optimizer (CBO) di Spark per una migliore pianificazione delle query.

  • È ora possibile utilizzare l'opzione di origine dati personalizzata per connettersi ai connettori Black Hole e Local File per il motore Presto (Java). Per ulteriori informazioni, vedere Origine dati personalizzata.

  • È ora possibile generare snippet JSON per il motore Presto e il servizio Milvus. È possibile fare copia/incolla nella watsonx.data Presto e Milvus connector UI in IBM Cloud Pak for Data e watsonx per semplificare la creazione della connessione. Per ulteriori informazioni, vedere Informazioni sulla connessione.

Miglioramenti alla gestione degli accessi

Questa versione di watsonx.data introduce i seguenti miglioramenti nella gestione degli accessi:

Miglioramenti dell'ingestione

Questa versione di watsonx.data introduce i seguenti miglioramenti nell'ingestione:

01 Agosto 2024 - Versione 2.0.1

Origini dati

  • È ora possibile connettersi alle fonti di dati Db2 utilizzando la chiave API IBM come meccanismo di autenticazione. Per ulteriori informazioni, vedere IBM Db2.
  • Presto (C++) può ora essere associato alle fonti di dati Arrow Flight service. Sono supportate le operazioni di sola lettura. Sono supportate le seguenti fonti di dati Arrow Flight service:
    • Salesforce
    • MariaDB
    • Greenplum
    • Apache Derby

Per ulteriori informazioni, vedere Arrow Flight service.

  • I seguenti nuovi database sono disponibili per il motore Presto (Java):

Integrazioni

  • Quando si integra IBM Knowledge Catalog con IBM watsonx.data, è possibile configurare regole di protezione dei dati per le singole righe di una tabella, consentendo agli utenti di accedere a un sottoinsieme di righe di una tabella. Per ulteriori informazioni, vedere Filtraggio delle righe.

  • È ora possibile applicare i seguenti criteri Apache Ranger per i motori Presto (Java):

  • È ora possibile integrare IBM watsonx.data con IBM on-premises DataStage. È possibile utilizzare il servizio DataStage per caricare e leggere i dati da IBM watsonx.data. Per ulteriori informazioni, Integrazione con DataStage.

Autenticazione ed autorizzazione

  • L'estensione del controllo degli accessi di Spark consente un'ulteriore autorizzazione, migliorando la sicurezza al momento della presentazione della domanda. Se si abilita l'estensione nella configurazione di spark, solo gli utenti autorizzati possono accedere e gestire i cataloghi IBM watsonx.data attraverso i lavori Spark. Per ulteriori informazioni, vedere Migliorare l'invio di applicazioni Spark utilizzando l'estensione del controllo degli accessi di Spark.

  • IBM watsonx.data ora supporta il proxy e la firma dello storage di oggetti per Azure Data Lake Storage e Azure Blob Storage. Per ulteriori informazioni, vedere Utilizzo del proxy DAS per accedere ai bucket compatibili con ADLS e ABS.

  • Il Lightweight Directory Access Protocol (LDAP) è ora disponibile per le fonti di dati Teradata e Db2. L'utente deve impostare questa configurazione a livello di server. Per Teradata, scegliere esplicitamente il tipo di meccanismo di autenticazione come LDAP nell'interfaccia utente. Per ulteriori informazioni, Teradata.

Il proxy DAS per accedere ai bucket ADLS e ABS e i miglioramenti LDAP sono disponibili in anteprima tecnica nella versione 2.0.1.

  • Milvus supporta ora l'isolamento degli utenti a livello di partizione. Gli amministratori possono autorizzare azioni specifiche degli utenti sulle partizioni. Per ulteriori informazioni, vedere Assistenza(Milvus).

Archiviazione

  • È ora possibile aggiungere il seguente archivio al motore Presto (Java) in IBM watsonx.data:
    • Azure Storage del lago di dati Gen2
    • Azure Storage Data Lake Gen1 Blob

Per ulteriori informazioni, consultare Azure Data Lake Storage Gen2 e Azure Data Lake Storage Gen1 Blob.

  • È possibile modificare la chiave di accesso e la chiave segreta di un bucket registrato dall'utente per uno storage. Questa funzione non è applicabile ai bucket predefiniti, ADLS o Google Cloud Storage. Questa funzione può essere utilizzata solo se le nuove credenziali superano con successo il test di connessione.

Motori

  • È ora possibile utilizzare le istruzioni di colonna ALTER TABLE ADD, DROP e RENAME per l'origine dati MongoDB.
  • È ora possibile configurare il modo in cui Presto gestisce i tipi di dati non supportati. Per ulteriori informazioni, vedere ignorare-unsupported-datatypes.

Cataloghi

  • È ora possibile associare e dissociare cataloghi a un motore in blocco tramite l'interfaccia utente in Gestione associazioni nella pagina del gestore dell'infrastruttura.

Personalizzazione e proprietà dell'API

Gestore infrastruttura

  • È possibile utilizzare la funzione di ricerca per i seguenti valori nella pagina Gestione infrastrutture:
    • nome del database
    • hostname registrato
    • creato dal nome utente
  • È ora possibile utilizzare l'interruttore "Non disturbare" nella sezione Notifiche sotto l'icona della campana per attivare o disattivare le notifiche a comparsa.
  • Le informazioni sulla connettività si trovano nel riquadro Informazioni sulla connessione della pagina Configurazioni. Queste informazioni possono essere copiate e scaricate in uno snippet JSON.

Area di lavoro delle query

  • È possibile eseguire query su tutte le tabelle di uno schema attraverso l'area di lavoro delle query SQL senza specificare il percorso <catalog>.<schema>, selezionando i cataloghi e gli schemi richiesti dal nuovo elenco a discesa. Per ulteriori informazioni, Esecuzione di query SQL.

watsonx.data piani tariffari

  • È ora possibile eliminare l'istanza del piano Lite esistente prima di raggiungere il limite massimo dell'account di 2000 RU, creare una nuova istanza e consumare le restanti unità di risorse disponibili nell'account. Per ulteriori informazioni, vedere watsonx.data Lite plan.

03 luglio 2024 - Versione2.0.0

Nuovi tipi di dati per le origini dati

I seguenti nuovi tipi di dati sono ora disponibili per alcune origini dati. È possibile accedere a questi tipi di dati su Gestore dati pagina sotto il Aggiungi colonna opzione.

  • BLOB

    • Db2
    • Teradata
    • Oracle
    • MySQL
    • SingleStore
  • CLOB

    • Db2
    • Teradata
    • Oracle
  • BINARY

    • SQL Server
    • MySQL

Poiché il tipo di dati numerici non è supportato inwatsonx.data, è possibile utilizzare il tipo di dati decimal come alternativa equivalente al tipo di dati numeric perNetezza fonte di dati.

Ora puoi utilizzare i tipi di dati BLOB e CLOB con l'istruzione SELECT nell'area di lavoro Query per creare ed eseguire query sui dati perOracle ESingleStore Origine dei dati.

Ora puoi utilizzare i tipi di dati BLOB e CLOB perMySQL EPostgreSQL origini dati come equivalenti a LONGTEXT, BYTEA e TEXT perché questi tipi di dati non sono compatibili conPresto (Java ). Questi tipi di dati sono mappati su CLOB e BLOB inPresto (Java ) se le origini dati dispongono di tabelle esistenti con tipi di dati LONGTEXT, TEXT e BYTEA.

  • MySQL (CLOB come equivalente a LONGTEXT)
  • PostgreSQL (CLOB come equivalente a TEXT)
  • PostgreSQL (BLOB equivalente a BYTEA)
  • Netezza (decimale come equivalente a numerico)
  • Oracle (BLOB e CLOB con l'istruzione SELECT)
  • SingleStore (BLOB e CLOB con l'istruzione SELECT)

Nuove operazioni per origine Db2 dati

È possibile eseguire le seguenti operazioni per i tipi di dati BLOB e CLOB perDb2 fonte di dati:

  • INSERISCI
  • CREA
  • CTAS
  • Modifica
  • RILASCIA

Nuove fonti di Arrow Flight service dati basate

Ora è possibile utilizzare le seguenti fonti di dati con Arrow Flight service:

  • Greenplum
  • Salesforce
  • MariaDB
  • Apache Derby

Per ulteriori informazioni, vedere Arrow Flight service.

Nuove origini dati

Ora è possibile utilizzare le seguenti fonti di dati:

  • Cassandra
  • BigQuery
  • ClickHouse
  • Apache Pinot

Per ulteriori informazioni, vedere Aggiunta di una coppia database-catalogo.

Comando per recuperare la cronologia di acquisizione

Ora puoi recuperare lo stato di tutti i lavori di acquisizione inviati utilizzando ibm-lh get-status--all-jobs comando CLI. È possibile recuperare lo stato di tutti i processi di acquisizione inviati. Ottieni i record della cronologia a cui hai accesso. Per ulteriori informazioni, vedere Opzioni e parametri supportati nello strumento ibm-lh.

Ruoli aggiuntivi per l'autorizzazione IBM Knowledge CatalogS2S (IKC)

Oltre all'accesso ai dati,IBM Knowledge CatalogS2S l'autorizzazione richiede l'accesso ai metadati e l'accesso all'API della console per l'integrazionewatsonx.data. I seguenti nuovi ruoli vengono creati per la configurazione dell'accesso al servizio IKC:

  • Visualizzatore
  • Visualizzatore Metastore

Apache Politiche dei ranger

IBMwatsonx.data ora supportaApache Politiche Ranger per consentire l'integrazione conPresto motori. Per ulteriori informazioni, vedere Apache Politica dei ranger.

Upgrade della versione

  • Presto (Java ) il motore è ora aggiornato alla versione0.286.
  • Il servizio Milvus è stato aggiornato alla versione 2.4.0. Le caratteristiche importanti includono:
    • Migliori prestazioni (basso utilizzo della memoria)
    • Supporta dati sparsi
    • Motore SPLADE integrato per l'incorporamento di vettori sparsi
    • BGEM3 Ricerca ibrida (densa+sparsa).

Hive Accesso a Metastore (HMS) in watsonx.data

Ora puoi recuperare le informazioni sui metadati perHive Metastore utilizzando le API REST invece di ottenere le informazioni dai dettagli del motore. I dettagli HMS vengono utilizzati da entità esterne per l'integrazionewatsonx.data. È necessario disporre del ruolo di amministratore, amministratore di Metastore o visualizzatore di Metastore per eseguire l'API.

Automazione semantica per l'arricchimento dei dati

L'automazione semantica per l'arricchimento dei dati sfrutta l'intelligenza artificiale generativaIBM Knowledge Catalog per comprendere i tuoi dati a un livello più profondo e migliorarli con l'arricchimento automatizzato per renderli preziosi per l'analisi. L'integrazione del livello semantico è disponibile per gli utenti del piano Lite solo come versione di prova di 30 giorni. Per ulteriori informazioni, vedere Automazione semantica per l'arricchimento dei dati inwatsonx.data.

Query Optimizer per migliorare le prestazioni delle query

Ora puoi utilizzare Query Optimizer per migliorare le prestazioni delle query elaborate daPresto motore (C++). Se Query Optimizer determina che l'ottimizzazione è fattibile, la query viene sottoposta a riscrittura; in caso contrario, l'ottimizzazione del motore nativo ha la precedenza. Per ulteriori informazioni, vedere Panoramica dello Strumento per ottimizzare le query.

Nuovo nome per Presto il motore in watsonx.data

Presto viene rinominato inPresto (Java ).

Nuovo motore ( Presto C++) in watsonx.data

Puoi fornire aPresto (C++) motore (versione0.286 ) Inwatsonx.data per eseguire query SQL sull'origine dati e recuperare i dati interrogati. Per ulteriori informazioni, vederePresto (C++) panoramica.

Utilizzo di proxy per accedere a S3 e bucket S3 compatibili

Le applicazioni esterne e i motori di query possono accedere aS3 ES3 bucket compatibili gestiti dawatsonx.data attraverso unS3 procura. Per ulteriori informazioni, vedere UtilizzandoS3 delega per l'accessoS3 ES3 secchi compatibili.

Flag di funzionalità maiuscole/minuscole per il motore Presto ( Java )

Il flag di funzionalità mista maiuscole e minuscole, che consente di alternare il comportamento con distinzione tra maiuscole e minuscole e senza distinzione tra maiuscole e minuscolePresto (Java ), è disponibile. Il flag è impostato su OFF per impostazione predefinita e può essere impostato su ON durante la distribuzione diwatsonx.data. Per ulteriori informazioni, si veda Presto(Java), panoramica sul supporto delle lettere miste.

Nuovo tipo di archiviazione Google Cloud Storage

Ora puoi utilizzare il nuovo tipo di archiviazioneGoogle Cloud Storage. Per ulteriori informazioni, vedere Aggiunta della coppia catalogo di archiviazione.

31 maggio 2024 - Versione 1.1.5

Fornitura motore Spark nel piano watsonx.data Lite

Puoi ora aggiungere un motore Spark di piccole dimensioni (nodo singolo) nell'istanza del piano Lite watsonx.data. Per ulteriori informazioni, vedere watsonx.data Lite plan.

Aggiornamenti relativi ai laboratori Spark

  • Utilizzo dei notebook Jupyter dei laboratori Spark

: Ora potete installare l'estensione Jupyter dal VS Code Marketplace all'interno del vostro laboratorio Spark e lavorare con i Jupyter Notebook. Per ulteriori informazioni, vedere Creazione di blocchi note Jupyter.

  • Accedere a Spark UI dai laboratori Spark

È ora possibile accedere all'interfaccia utente (UI) di Spark dai laboratori Spark per monitorare vari aspetti dell'esecuzione di un'applicazione Spark. Per ulteriori informazioni, vedere Accesso a Spark UI dai laboratori Spark.

Nuova regione da fornire per IBM Cloud istanza

Puoi ora eseguire il provisioning della tua istanza di IBM Cloud nella regione Sydney.

30 Apr 2024 - Versione 1.1.4

Una nuova versione di watsonx.data è stata rilasciata nell'aprile 2024.

Questa release include le seguenti funzioni e aggiornamenti:

Kerberos autenticazione per HDFS connessioni

È ora possibile abilitare l'autenticazione Kerberos per connessioni Apache Hadoop Distributed File System (HDFS) sicure. Per ulteriori informazioni, vedi HDFS.

Nuove origini dati

Le seguenti nuove origini dati sono ora disponibili:

  • Oracle
  • Amazon Redshift
  • Informix
  • Prometheus

Per ulteriori informazioni, consultare Origini dati.

Verifica connessioni SSL

Ora è possibile verificare le connessione SSL per le origini dati MongoDB e SingleStore.

Caricamento dei file di descrizione per l'origine Apache Kafka dati

L'origine dati Apache Kafka memorizza i dati come messaggi byte che i produttori e i consumatori devono interpretare. Per interrogare questi dati, i consumatori devono prima associarli in colonne. Ora, è possibile caricare i file di descrizione dell'argomento che convertono i dati non elaborati in un formato tabella. Ogni file deve essere un file JSON che contiene una definizione per una tabella. Per caricare questi file JSON dall'IU, vai alla pagina della panoramica del database Apache Kafka che hai registrato e seleziona l'opzione Add topic. Per ulteriori informazioni, vedi Apache Kafka.

Piani di licenza per watsonx.data

IBM® watsonx.data offre ora i seguenti piani di licenza.

  • Piano Lite
  • piano Enterprise

Per ulteriori informazioni sui diversi piani di licenza, vedi Piani dei prezzi diIBM® watsonx.data.

Presto Aggiornamento versione motore ( Java )

ILPresto (Java ) il motore è ora aggiornato alla versione0.285.1.

Pausa o ripresa Milvus

Ora è possibile mettere in pausa o riprendere il servizio Milvus. La sospensione del tuo servizio può evitare di incorrere in addebiti.

Spark è ora disponibile come motore nativo

Oltre a registrare i motori Spark esterni, puoi ora eseguire il provisioning del motore Spark nativo sulla tua istanza IBM watsonx.data. Con il motore Spark nativo, puoi gestire completamente la configurazione del motore Spark, gestire l'accesso ai motori Spark e visualizzare le applicazioni utilizzando l'IU watsonx.data e gli endpoint API REST. Per ulteriori informazioni, consultare Provisioning Native Spark Engine.

Inserisci dati utilizzando motori Spark nativi

Puoi ora inoltrare i lavori di inserimento utilizzando i motori Spark nativi. Per ulteriori informazioni, vedere Lavorare con diversi formati di tabella.

27 marzo 2024 - Versione 1.1.3

Una nuova versione di watsonx.data è stata rilasciata nel marzo 2024.

Questa release include le seguenti funzioni e aggiornamenti:

Nuovo tipo di dati per alcune origini dati

È ora possibile utilizzare il tipo di dati BINARY con l'istruzione SELECT nell'area di lavoro Query per creare ed eseguire query sui dati per le seguenti origini dati:

  • Elasticsearch
  • SQL Server
  • MySQL

Nuovi tipi di dati: BLOB e CLOB sono disponibili per le origini dati MySQL, PostgreSQL, Snowflake, SQL Server e Db2. È possibile utilizzare questi tipi di dati solo con le istruzioni SELECT nell'area di lavoro Query per creare ed eseguire query sui propri dati.

Eliminare i dati utilizzando la funzione DELETE FROM per le origini dati Iceberg

È ora possibile eliminare i dati dalle tabelle nelle origini dati Iceberg utilizzando la funzione DELETE FROM.

È possibile specificare la modalità di eliminazione della proprietà della tabella per le nuove tabelle utilizzando la modalità di copia su scrittura o la modalità di unione su lettura (predefinita).

Istruzione ALTER VIEW per origine dati Iceberg

È ora possibile utilizzare la seguente istruzione SQL nello spazio di lavoro Query per creare ed eseguire query sui propri dati per ALTER VIEW:

ALTER VIEW nome RENAME TO nuovo_nome

Carica i certificati SSL per le Netezza Performance Server fonti dati

Ora è possibile ricercare e caricare il certificato SSL per connessioni SSL nelle origini dati Netezza Performance Server. I formati di file validi per il certificato SSL sono .pem, .crt e .cer. È possibile caricare i certificati SSL utilizzando l'opzione Aggiunta di una coppia database - catalogo nel gestore infrastruttura.

Richiesta dati da Db2 e Watson Query

Puoi ora interrogare i nickname creati in Db2 e le tabelle virtuali dalle istanze Watson Query.

Connessione SSL per origine IBMData Virtualization Manager for z/OS dati

È ora possibile attivare la connessione SSL per l'origine dati di IBM Data Virtualization Manager for z/OS utilizzando l'interfaccia utente Aggiungi database per proteggere e codificare la connessione al database. Selezionare Convalida certificato per convalidare se il certificato SSL restituito dall'host è attendibile. È possibile scegliere di specificare il nome host nel certificato SSL.

Utilizza i dati dal Apache Hudi catalogo

È ora possibile connettersi e utilizzare i dati del catalogo Apache Hudi.

Aggiungi Milvus come servizio in watsonx.data

È ora possibile fornire Milvus come servizio in watsonx.data con le seguenti caratteristiche:

  • Eseguire il provisioning di diverse varianti di archiviazione come nodi starter, medi e grandi.

  • Assegnate i ruoli di amministratore o di utente agli utenti Milvus: I criteri di accesso degli utenti sono ora disponibili per gli utenti Milvus. Utilizzando l'interfaccia utente di controllo degli accessi, è possibile assegnare agli utenti Milvus i ruoli di amministratore o di utente e concedere, revocare o aggiornare i privilegi.

  • Configurare l'Object storage per Milvus per memorizzare i dati. È possibile aggiungere o configurare un bucket personalizzato e specificare il nome utente, la password, la regione e l' URL del bucket.

Per ulteriori informazioni, vedere Milvus.

Carica i dati in batch utilizzando lo strumento di inserimento ibm - lh

È ora possibile utilizzare lo strumento di inserimento ibm-lh per eseguire le procedure di inserimento batch in modalità non interattiva (dall'esterno del contenitore ibm - lh - tools), utilizzando il pacchetto ibm - lh - client. Per ulteriori informazioni, vedi Utilizzo e comandi ibm - lh.

Creazione dello schema utilizzando l'inserimento in massa nella console Web

È ora possibile creare uno schema utilizzando il processo di inserimento di massa nella console Web, se lo schema non è stato precedentemente creato.

Utilizza le query di viaggio nel tempo nelle Apache Iceberg tabelle

È ora possibile eseguire le seguenti query di viaggio nel tempo utilizzando rami e tag nelle istantanee delle tabelle di Apache Iceberg:

  • SELECT *FROM <table name> FOR VERSION AS OF 'historical-tag'

  • SELECT *FROM <table name> FOR VERSION AS OF 'test-branch'

Accesso a Cloud Object Storage senza credenziali È ora possibile accedere al proprio bucket Cloud Object Storage senza credenziali, utilizzando l'endpoint Data Access Service (DAS).

28 febbraio 2024 - Versione 1.1.2

Una nuova versione di watsonx.data è stata rilasciata nel febbraio 2024.

Questa release include le seguenti funzioni e aggiornamenti:

Connessione SSL per origini dati

È ora possibile attivare la connessione SSL per le seguenti origini dati utilizzando l'interfaccia utente Aggiungi database per proteggere e codificare la connessione al database.:

  • Db2

  • PostgreSQL

Per ulteriori informazioni, consultare Aggiunta di un database.

Cronologia lavoro inserimento sicuro

Ora, gli utenti possono visualizzare solo la propria cronologia del lavoro di inserimento. Gli amministratori possono visualizzare la cronologia dei lavori di inserimento per tutti gli utenti.

Miglioramenti SQL

È ora possibile utilizzare le seguenti istruzioni SQL nell'area di lavoro Query per creare e eseguire query sui propri dati:

  • Apache Iceberg fonti di dati
    • CREATE VIEW
    • DROP VIEW
  • Origini dati MongoDB
    • DELETE

Nuovi tipi di dati BLOB e CLOB per origine Teradata dati

Nuovi tipi di dati BLOB e CLOB sono disponibili per l'origine dati Teradata. È possibile utilizzare questi tipi di dati solo con le istruzioni SELECT nell'area di lavoro Query per creare ed eseguire query sui propri dati.

Crea una nuova tabella durante l'inserimento dei dati

In precedenza, avevi una tabella di destinazione in watsonx.data per l'inserimento dei dati. Ora, puoi creare una nuova tabella direttamente dal file di dati di origine (disponibile in formato parquet o CSV) utilizzando l'inserimento dei dati da Data Manager. È possibile creare la tabella utilizzando i seguenti metodi di inserimento:

  • Inserimento dei dati utilizzando il programma di caricamento copie Iceberg.

  • Inserimento dei dati utilizzando Spark.

Esegui operazioni ALTER TABLE su una colonna

Con un'origine dati Iceberg, è ora possibile eseguire operazioni ALTER TABLE su una colonna per le seguenti conversioni del tipo di dati:

  • da int a bigint

  • da float a double

  • decimale (num1, dec_digits) in decimale (num2, dec_digits), dove num2>num1.

Prestazioni delle query migliori utilizzando file ordinati

Con un'origine dati Apache Iceberg, è possibile generare file ordinati, che riducono la latenza dei risultati delle query e migliorano le prestazioni di Presto ( Java ). I dati nella tabella Iceberg vengono ordinati durante il processo di scrittura all'interno di ogni file.

È possibile configurare l'ordine per ordinare i dati utilizzando la proprietà della tabella sorted_by. Quando si crea la tabella, specificare un array di una o più colonne coinvolte nell'ordinamento. Per disabilitare la funzione, impostare la proprietà di sessione sorted_writing_enabled su false.

31 gennaio 2024 - Versione 1.1.1

Una nuova versione di watsonx.data è stata rilasciata nel gennaio 2024.

Questa release include le seguenti funzioni e aggiornamenti:

Data Virtualization Manager for z/OS®IBM connettore

Ora è possibile utilizzare il nuovo connettore IBM Data Virtualization Manager for z/OS® per leggere e scrivere IBM Z® senza spostare, replicare o trasformare i dati. Per ulteriori informazioni, consultare Connessione a un'origine dati DVM(Data Virtualization Manager)IBM Data Virtualization Manager.

Teradata Il connettore è abilitato per più ALTER TABLE istruzioni

Il connettore Teradata ora supporta le istruzioni ALTER TABLE RENAME TO, ALTER TABLE DROP COLUMN e ALTER TABLE RENAME COLUMN column_name TO new_column_name.

Supporto per le query di viaggio nel tempo

Connettore Iceberg perPresto (Java ) ora supporta le query sui viaggi nel tempo.

La proprietà format_version ora mostra la versione corrente

La proprietà format_version ora mostra il valore corretto (versione corrente) quando si crea una tabella Iceberg.

29 Nov 2023 - Versione 1.1.0

Una nuova versione di watsonx.data è stata rilasciata nel mese di novembre 2023.

Questa release include le seguenti funzioni e aggiornamenti:

Presto ( Java ) comportamento sensibile alle maiuscole/minuscole

ILPresto (Java ) il comportamento viene modificato da senza distinzione tra maiuscole e minuscole a con distinzione tra maiuscole e minuscole. Ora è possibile fornire i nomi oggetto nel formato maiuscolo / minuscolo originale come nel database. Per ulteriori informazioni, vedere Configurazione della ricerca con distinzione tra maiuscole e minuscole conPresto(Java).

Funzione di rollback

È possibile utilizzare la funzione Rollback per eseguire il rollback o il rollforward di qualsiasi istantanea per le tabelle Iceberg.

Cattura modifiche DDL (Data Definition Language)

È ora possibile catturare e tracciare le modifiche DDL in watsonx.data utilizzando un ascoltatore di eventi.

Inserisci dati utilizzando Spark

Ora è possibile utilizzare IBM Analytics Engine che è alimentato da Apache Spark per eseguire lavori di ingestione in watsonx.data.

Per ulteriori informazioni, vedi Inserimento dei dati utilizzando Spark.

Integrazione con Db2 e Netezza Performance Server

Puoi ora registrare i motori Db2 o Netezza Performance Server nella console watsonx.data.

Per ulteriori informazioni, consultare Registrazione di un motore.

Nuovi connettori

È ora possibile utilizzare i connettori in watsonx.data per stabilire connessioni ai seguenti tipi di database:

  • Teradata
  • Delta Lake
  • Elasticsearch
  • SingleStoreDB
  • Snowflake

Per ulteriori informazioni, consultare Aggiunta di un database.

AWS EMR per Spark

Puoi ora eseguire applicazioni Spark da Amazon Web Services Elastic MapReduce (AWS EMR) per ottenere i casi di utilizzo watsonx.data Spark:

  • Acquisizione dei dati
  • Query di dati
  • Manutenzione tabella

Per ulteriori informazioni, vedi Using AWS EMR for Spark use case.

7 luglio 2023 - Versione 1.0.0

watsonx.data è una nuova architettura aperta che combina gli elementi dei modelli data warehouse e data lake. Le funzioni e le ottimizzazioni migliori disponibili su watsonx.data lo rendono una scelta ottimale per l'automazione e l'analisi dei dati di prossima generazione. Nella prima release (watsonx.data 1.0.0), sono supportate le seguenti funzioni:

  • Creazione, ridimensionamento, pausa, ripresa ed eliminazione del filePresto (Java ) motore di interrogazione
  • Associazione e dissociazione di un catalogo con un motore
  • Esplorazione degli oggetti del catalogo
  • Aggiunta ed eliminazione di una coppia database - catalogo
  • Aggiornamento delle credenziali del database
  • Aggiunta ed eliminazione della coppia bucket - catalogo
  • Esplorazione degli oggetti bucket
  • Caricamento dei dati
  • esplorazione dei dati
  • Query dei dati
  • Cronologia della query