Foire aux questions

Il s'agit d'un recueil de questions fréquemment posées (FAQ) sur le service IBM® watsonx.data.

général

Qu'est-ce que IBM® watsonx.data?

IBM® watsonx.data est le data lakehouse hybride et ouvert qui permet d'alimenter l'IA et l'analyse avec toutes vos données, où que vous soyez. Il s'agit d'une solution de gestion de données pour la collecte, le stockage, l'interrogation et l'analyse de toutes les données de votre entreprise (structurées, semi-structurées et non structurées) avec une plateforme de données unifiée unique. Il fournit une plateforme flexible et fiable qui est optimisée pour travailler sur des formats de données ouverts.

Que puis-je faire avec IBM® watsonx.data?

Vous pouvez utiliser IBM® watsonx.data pour collecter, stocker, interroger et analyser toutes les données de votre entreprise avec une plateforme de données unifiée unique. Vous pouvez vous connecter aux données dans plusieurs emplacements et démarrer en quelques minutes avec la gouvernance, la sécurité et l'automatisation intégrées. Vous pouvez utiliser plusieurs moteurs de requête pour exécuter des analyses et des charges de travail d'IA, ce qui réduit les coûts de votre entrepôt de données de jusqu'à 50%.

Quels sont les formats de données pris en charge dans IBM® watsonx.data?

Les formats de données suivants sont pris en charge dans IBM® watsonx.data:

  1. Ingestion: L'ingestion de données dans IBM® watsonx.data prend en charge les formats de fichier de données CSV et Parquet.
  2. Créer une table à partir d'un fichier: créez une table à partir d'un fichier dans IBM® watsonx.data prend en charge les formats de fichier de données CSV, Parquet, JSON et TXT.

Quelles sont les principales fonctionnalités d' IBM watsonx.data?

Les principales fonctions d' IBM® watsonx.data sont les suivantes:

  • Une architecture qui sépare complètement le calcul, les métadonnées et le stockage pour offrir une flexibilité ultime.
  • Plusieurs moteurs tels quePresto (Java ),Presto (C++) et Spark qui permettent un traitement rapide, fiable et efficace du Big Data à grande échelle.
  • Formats ouverts pour les jeux de données analytiques, permettant à différents moteurs d'accéder aux données et de les partager en même temps.
  • Partage de données entre watsonx.data, Db2® Warehouseet Netezza Performance Server ou toute autre solution de gestion de données via un support de format de table Iceberg commun, des connecteurs et un magasin de métadonnées partageable.
  • Une gouvernance intégrée compatible avec les solutions existantes, notammentIBM Knowledge Catalog.
  • Un stockage d'objets simple et économique est disponible dans les environnements de cloud hybride et multicloud.
  • Intégration à un écosystème robuste de solutions IBMet de services tiers pour faciliter le développement et le déploiement de cas d'utilisation clés.

**Quelle est la taille maximale du stockage géré par défaut IBM ? **

Le IBM stockage géré est un stockage par défaut de 10 GB.

Presto

Qu'est-ce que Presto?

Presto est un moteur de requête SQL distribué, capable d'interroger de vastes ensembles de données situés dans différentes sources de données, ce qui permet de résoudre les problèmes de données à grande échelle.

Quels sont les types de serveurs Presto?

Une installation Presto comprend trois types de serveurs : le coordinateur, le travailleur et le gestionnaire de ressources.

Quelles sont les instructions SQL prises en charge dans IBM watsonx.data?

Pour plus d'informations sur les instructions SQL prises en charge, voir Instructions SQL prises en charge.

Metastore

Qu'est-ce que HMS (Hive Metastore)?

Hive Metastore (HMS) est un service qui stocke les métadonnées liées à Presto et à d'autres services dans un système de gestion de base de données relationnelle (RDBMS) ou un système de fichiers distribués HadoopHDFS.

Installation et configuration

Comment mettre à disposition une instance de service IBM® watsonx.data ?

Pour mettre à disposition une instance, voir Initiation à watsonx.data.

Comment puis-je supprimer mon instance IBM® watsonx.data ?

Pour supprimer une instance, voir Suppression d'une instance watsonx.data.

Comment puis-je accéder à la console Web IBM® watsonx.data ?

Pour accéder à la console Web IBM® watsonx.data, connectez-vous à votre compte IBM Cloud et suivez les étapes indiquées ici Ouvrez la console Web dans Initiation à watsonx.data.

Comment mettre à disposition un moteur?

A partir de la console Web IBM® watsonx.data, accédez à Infrastructure Manager pour mettre à disposition un moteur. Pour plus d'informations, voir Mise à disposition d'un moteur.

Comment configurer le catalogue ou le métamagasin?

Pour configurer un catalogue avec un moteur, voir Association d'un catalogue à un moteur.

Comment configurer un espace de stockage ?

Dans la console Web IBM® watsonx.data, allez dans le Gestionnaire d'infrastructure pour configurer un stockage. Pour plus d'informations, voir Ajouter une paire de catalogues de stockage.

Accès

Comment puis-je gérer l'accès IAM pour IBM® watsonx.data?

IBM Cloud® Identity and Access Management (IAM) contrôle l'accès aux instances de service IBM® watsonx.data pour les utilisateurs de votre compte. Chaque utilisateur qui accède au service IBM® watsonx.data dans votre compte doit se voir attribuer une politique d'accès avec un rôle IAM. Pour plus d'informations, voir Gérer l'accès IAM pour watsonx.data.

Comment puis-je ajouter et supprimer des utilisateurs?

Pour ajouter ou supprimer des utilisateurs dans un composant, voir Gestion de l'accès utilisateur.

Comment est fourni le contrôle d'accès pour les utilisateurs?

Pour permettre aux utilisateurs de limiter les accès non autorisés, voir Gestion des règles de stratégie de données.

Quel est le processus d'affectation de l'accès à un utilisateur?

Pour affecter l'accès à un utilisateur, voir Gestion des rôles et des privilèges.

Quel est le processus d'affectation de l'accès à un groupe?

Pour affecter l'accès à un groupe, voir Gestion des rôles et des privilèges.

Moteur Presto

Comment créer un moteur?

Pour créer un moteur, voir Mise à disposition d'un moteur.

Comment puis-je mettre en pause et reprendre un moteur?

Pour mettre en pause un moteur, voir Pause d'un moteur.

Pour reprendre un moteur mis en pause, voir Reprendre un moteur.

Comment puis-je supprimer un moteur?

Pour supprimer un moteur, voir Suppression d'un moteur.

Comment exécuter des requêtes SQL?

Vous pouvez utiliser l'interface de l'espace de travail Requête dans IBM® watsonx.data pour exécuter des requêtes et des scripts SQL sur vos données. Pour plus d'informations, voir Exécution de requêtes SQL.

Bases de données et connecteurs

Comment puis-je ajouter une base de données?

Pour ajouter une base de données, voir Ajout d'une paire base de données-catalogue.

Comment puis-je supprimer une base de données?

Pour supprimer une base de données, voir Suppression d'une paire base de données-catalogue.

Quelles sont les sources de données actuellement prise en charge par IBM® watsonx.data ?

IBM® watsonx.data prend actuellement en charge les sources de données suivantes:

  1. IBM Db2
  2. IBM Netezza
  3. Apache Kafka
  4. MongoDB
  5. MySQL
  6. PostgreSQL
  7. SQL Server
  8. Custom
  9. Teradata
  10. SAP HANA
  11. Elasticsearch
  12. SingleStore
  13. Snowflake
  14. IBM Data Virtualization Manager for z/OS

Comment puis-je charger les données dans IBM® watsonx.data?

Il existe trois façons de charger les données dans IBM® watsonx.data.

  1. Console Web: vous pouvez utiliser l'onglet Travaux d'ingestion de la page Gestionnaire de données pour charger facilement et en toute sécurité des données dans la console IBM® watsonx.data. Pour plus d'informations, voir Ingesting data by using Spark.
  2. Interface de ligne de commande: vous pouvez charger des données dans IBM® watsonx.data via l'interface de ligne de commande. Pour plus d'informations, voir Chargement ou ingestion de données via l'interface de ligne de commande.
  3. Création de tables: vous pouvez charger ou ingérer des fichiers de données locaux pour créer des tables à l'aide de l'option Créer une table. Pour plus d'informations, voir Création de tables.

Comment créer des tables?

Vous pouvez créer une table via la page Gestionnaire de données à l'aide de la console Web. Pour plus d'informations, voir Création de tables.

Comment créer un schéma?

Vous pouvez créer un schéma via la page Gestionnaire de données à l'aide de la console Web. Pour plus d'informations, voir Création d'un schéma.

Comment interroger les données chargées?

Vous pouvez utiliser l'interface de l'espace de travail Requête dans IBM® watsonx.data pour exécuter des requêtes et des scripts SQL sur vos données. Pour plus d'informations, voir Exécution de requêtes SQL.

Ingestion

Quelles sont les options de stockage disponibles ?

Les options de stockage disponibles sont IBM Storage Ceph, IBM Cloud Object Storage (COS), AWS S3, et MinIO stockage d'objets.

Quel type de fichier de données peut être ingéré?

Seuls les fichiers de données Parquet et CSV peuvent être ingérés.

Un dossier de plusieurs fichiers peut-il être ingéré ensemble?

Oui, un dossier de plusieurs fichiers de données doit être ingéré. Un dossier S3 doit être créé avec des fichiers de données pour l'ingestion. Le dossier source doit contenir tous les fichiers parquet ou tous les fichiers CSV. Pour des informations détaillées sur la création de dossier S3, voir Préparation de l'ingestion de données.

Quelles commandes sont prises en charge dans l'interface de ligne de commande lors de l'ingestion?

Pour les commandes prises en charge dans l'interface de ligne de commande lors de l'ingestion, voir Chargement ou ingestion de données via l'interface de ligne de commande.

Plans de tarification

Où puis-je en savoir plus sur chaque plan de tarification?

watsonx.data en tant que service offre trois plans de tarification:

  1. Plan Lite: il fournit une limite d'utilisation gratuite de 2000 unités de ressource (surveillées sur la page Facturation et utilisation d' IBM Cloud) dans un délai de 30 jours. La valeur de plafond est affichée sur la page de mise à disposition du catalogue IBM Cloud et est reflétée sur votre page de facturation dans votre instance watsonx.data lors de la mise à disposition.
  2. Plan Enterprise: vous payez par heure pour chaque ressource d'infrastructure que vous ajoutez. Commencez par les services de support, puis générez les moteurs et les services de votre choix. Il s'agit d'un taux horaire calculé en unités de ressources qui correspond à votre mode de paiement, qu'il s'agisse de "Paiement à la carte" ou "Abonnement".

Pour plus d'informations, voir Plans d'abonnement.

Plan Lite

La carte de crédit du plan Lite est-elle gratuite?

Oui, si vous utilisez un compte d'essai IBM cloud, le plan Lite est sans carte de crédit. Vous disposez d'une limite d'utilisation libre de 2000 unités de ressource dans un délai de 30 jours, selon la première des deux extrémités pour essayer le produit. Pour plus d'informations, voir Plans d'abonnement.

Qu'est-ce qui est inclus dans le plan Lite?

Le plan Lite est fourni pour vous permettre d'essayer les fonctions de base de watsonx.data et est disponible pour tous les types de compte IBM Cloud tels que l'essai, le paiement à la carte et l'abonnement. Il prend en charge uniquement les fonctions de base. Il n'est pas disponible sur AWS et est limité à une instance watsonx.data par compte IBM Cloud (interrégional).

Principales fonctions prises en charge:

  1. Possibilité de mettre en pause et de reprendre le moteur Presto.
  2. Possibilité de se connecter à un IBM Cloud fourni par Cloud Object Storage (COS) et de fournir des informations d'identification à votre propre COS ou stockage S3.
  3. Possibilité de supprimer Presto, Milvus et les connexions à votre propre espace de stockage.

Limites :

  1. Il est limité à la mise à disposition d'une seule instance par groupe de ressources.
  2. Il est limité à 2000 unités de ressources (RU) avant que l'instance ne soit suspendue. La valeur de plafond est affichée sur la page IBM Cloud de mise à disposition de catalogue et est reflétée sur votre page de facturation dans votre instance watsonx.data lors de la mise à disposition. Votre licence expire lorsque vous atteignez la limite maximale de 2000 unités de licence ou que vous dépassez la période d'essai de 30 jours.
  3. Il est limité à un moteur d' Presto, ou un service d' Milvus, avec une taille de démarreur ( 1.25 s d'unités de remorquage par heure), ou les deux.
  4. Il est limité aux plus petites tailles de noeud et aux profils pour chaque moteur et service. Vous ne pouvez pas augmenter la taille du noeud.
  5. Les instances Lite ne peuvent pas être utilisées à des fins de production.
  6. Les instances lite peuvent être supprimées à tout moment et sont irrécupérables (pas de BCDR).
  7. Les fonctions de mise à l'échelle du moteur ne sont pas disponibles.

Quelle est la limite d'utilisation du plan Lite?

Le plan Lite de l'instance watsonx.data est généralement un compte d'essai gratuit, avec des limites de capacité (2000 unités de ressources), pour une période de 30 jours. Vous pouvez utiliser le compte pour explorer et vous familiariser avec watsonx.data. Vous devez créer un compte de cloud IBM payant ("Pay as you go" ou "Subscription"), puis mettre à disposition une instance de plan Enterprise pour accéder à toutes les fonctions.

J'ai épuisé toutes mes unités de ressources. Comment supprimer mon instance de plan allégé?

Vous pouvez supprimer l'instance de plan Lite du groupe de ressources ou la collection de ressources de cloud IBM la supprimera après une période de 40 jours.

Le plan Lite est terminé. Comment effectuer une mise à niveau vers le plan Enterprise?

Avant ou après la conclusion de votre plan Lite, vous pouvez créer un compte payant, qu'il s'agisse de "Abonnement" ou de "Paiement à la carte" IBM Cloud. Vous pouvez maintenant créer votre nouvelle instance watsonx.data. Le plan Enterprise est disponible dans les environnements IBM Cloud et AWS. Vous pouvez créer une instance de plan d'entreprise une fois que vous avez créé un compte de cloud IBM payant ("Abonnement" ou "Paiement à la carte"), puis vous pouvez utiliser un compartiment Cloud Object Store que vous possédez pour stocker des données. Pour plus d'informations, voir How to create instance for watsonx.data enterprise plan et How to use a Cloud Object Store bucket you own to store data.

Comment sauvegarder les données d'un plan Lite dans un plan d'entreprise?

Vous pouvez créer un compartiment IBM Cloud Object Store (COS) que vous possédez et le connecter à votre instance de plan Lite de watsonx.data. Vous pouvez ensuite écrire des données dans ce compartiment COS que vous possédez. Ensuite, une fois que vous avez créé un compte de cloud IBM payant ("Pay as you go" ou "Subscription"), vous pouvez créer une instance d'entreprise de watsonx.data et la connecter au même compartiment COS que vous possédez pour continuer à utiliser les mêmes fichiers de données.

Plan Enterprise

Qu'est-ce qui est inclus dans le plan Enterprise?

En plus du plan Lite, le plan Enterprise inclut les fonctions suivantes:

  1. Vous payez par heure pour chaque ressource d'infrastructure que vous ajoutez. En commençant par les services de support, générez les moteurs et les services de votre choix. Il s'agit d'un taux horaire calculé en unités de ressources qui correspond à votre mode de paiement, qu'il s'agisse de "Paiement à la carte" ou "Abonnement".
  2. Presto et moteur Spark externe et service d' Milvus.
  3. Métamagasin Hive et catalogue Iceberg.
  4. Gestionnaire d'infrastructure et éditeur de requête.
  5. Db2 Warehouse et intégration de Netezza.
  6. Possibilité d'échelonner (augmenter et diminuer) la taille des nœuds pour les moteurs Presto.
  7. Disponible dans les environnements IBM Cloud et AWS.

Quels sont les différents plans de paiement du plan d'entreprise?

Les différents plans de paiement du plan d'entreprise sont "Abonnement" ou "Paiement à la carte".

Le coût des services tels qu' Milvus est-il inclus dans le plan d'entreprise?

Oui, le service d' Milvus s est inclus dans le plan Entreprise.