Gestion de la capacité du moteur Spark
S'applique à: [Moteur à étincelle] [Moteur à] {: tag-blue} étincelle à accélération par gluten
L'onglet Capacité d'une instance Spark Engine fournit une vue d'ensemble complète de l'utilisation globale du processeur et de la mémoire, ce qui vous aide à surveiller efficacement la consommation des ressources. Par défaut, vous pouvez profiter d'un moteur sans serveur qui adapte automatiquement les ressources en fonction de la charge de travail. De plus, pour les charges de travail à grande échelle ou à haute performance, vous avez la possibilité d'allouer une capacité dédiée, garantissant ainsi des performances et une fiabilité optimales.
Fonctions principales
- Chaque moteur Spark peut être associé à plusieurs pools de réservations (pools de nœuds avec différentes variantes).
- Charges de travail dédiées avec mise à l'échelle automatique : un environnement dédié fournit aux utilisateurs leur propre capacité de calcul réservée, garantissant des performances et un contrôle constants. Lorsqu'il est associé à la mise à l'échelle automatique, les utilisateurs bénéficient à la fois d'une fiabilité et d'une efficacité optimales.
- Des quotas seront appliqués tant pour la capacité dédiée que pour la capacité à la demande.
- Pour les utilisateurs qui exécutent fréquemment des tâches volumineuses ou longues, il est recommandé d'ajouter une capacité dédiée afin de garantir des performances prévisibles.
Spark sans serveur
- Modèle de coût à l'utilisation : les clients ne paient que pour les ressources informatiques consommées lors de l'exécution des charges de travail. Cela évite de payer pour une capacité inutilisée lorsque l'utilisation est intermittente ou faible.
- Mise à l'échelle automatique : les plateformes sans serveur ajustent automatiquement les ressources à la hausse ou à la baisse en fonction de la demande, éliminant ainsi le besoin d'un approvisionnement manuel ou d'une planification des capacités.
- Aucune gestion d'infrastructure : la plateforme gère les correctifs, la mise à l'échelle et la maintenance, réduisant ainsi les frais généraux opérationnels.
- Rentabilité rapide : les clients peuvent déployer rapidement sans planification préalable ni dimensionnement de l'infrastructure.
Avantages d'une capacité dédiée avec mise à l'échelle automatique
-
Performances de base stables : la capacité dédiée garantit que les charges de travail à exécution longue ou à utilisation continue disposent de ressources informatiques garanties sans concurrence.
-
Mise à l'échelle efficace pour répondre aux pics de demande : couches de mise à l'échelle automatique au-dessus de la base de référence dédiée pour ajouter automatiquement plus de capacité lorsque l'utilisation atteint des pics, garantissant ainsi le maintien des performances même en cas de pics imprévus.
-
Coût optimisé pour les charges de travail soutenues : les clients paient pour les ressources dédiées dont ils ont besoin en permanence, tandis que l'autoscaling évite le surprovisionnement en n'ajoutant de la capacité supplémentaire qu'en cas de besoin.
-
Flexibilité opérationnelle : les équipes peuvent configurer à la fois la capacité minimale dédiée pour les charges de travail continues et un plafond d'autoscaling supérieur pour contrôler les dépenses.
-
Fiabilité améliorée : les événements de mise à l'échelle se produisent automatiquement, ce qui réduit le risque d'indisponibilité et garantit que les services gèrent les fluctuations de charge sans intervention manuelle.
Avant de commencer
Pour profiter de cette fonctionnalité, vous devez utiliser la version 2.3 (et supérieure) de watsonx.data.
Affichage et configuration des détails relatifs à la capacité
Pour afficher l'onglet Capacité, procédez comme suit :
-
Connectez vous à la console watsonx.data.
-
Accédez au gestionnaire d'infrastructure. Cliquez sur le moteur Spark.
-
Cliquez sur l'onglet Capacité. Vous pouvez consulter les sections suivantes :
- Mesures d'utilisation globales: affiche le total vCPUs et la mémoire allouée, ainsi que les pourcentages de consommation du processeur et de la mémoire en temps réel.
- Dédié: capacité dédiée pour les charges de travail importantes. Il affiche les détails des pools de capacité configurés, y compris vCPU et l'allocation de mémoire, les niveaux de consommation et les options de gestion des pools (ajouter, modifier, suspendre ou supprimer).
- À la demande: lorsqu'un moteur Spark est créé, il fournit automatiquement une capacité à la demande. Il s'agit de l'option sans serveur par défaut qui adapte dynamiquement les ressources en fonction des besoins liés à la charge de travail. Il affiche la consommation de mémoire de vos applications.
Capacité du moteur Spark à la demande
La capacité à la demande est le modèle d'exécution sans serveur par défaut pour les moteurs Spark. Elle est conçue pour offrir flexibilité et simplicité sans nécessiter de planification préalable des ressources. Lorsqu'un moteur Spark est créé, il inclut automatiquement une capacité à la demande, permettant ainsi l'exécution des charges de travail. Les ressources sont provisionnées de manière dynamique en fonction des exigences de la charge de travail, et sont automatiquement mises à l'échelle jusqu'au nombre maximal de cœurs disponibles pour la capacité à la demande dans un moteur Spark, comme spécifié.
Pour mettre à jour le quota de capacité à la demande,
Dans l'onglet Capacité, cliquez sur À la demande. Cliquez sur Modifier le quota. Un curseur horizontal vous permet de sélectionner la capacité souhaitée (en cœurs) dans la plage autorisée (0 à 100 cœurs). Cliquez sur Sauvegarder.
Par exemple, lorsque vous définissez le quota à 40 cœurs, le moteur adapte automatiquement les ressources à cette limite en fonction des exigences de la charge de travail. Pour passer à plus de 100 cœurs, vous devez contacter le IBM support technique.
Création d'une capacité dédiée pour votre charge de travail
La capacité dédiée permet de réserver des ressources informatiques pour les charges de travail Spark, garantissant ainsi des performances prévisibles et la stabilité des coûts pour les tâches volumineuses ou de longue durée. Contrairement à la capacité à la demande, qui s'adapte de manière dynamique, la capacité dédiée vous permet d'associer des pools de réservation avec des configurations spécifiques à votre moteur Spark.
- Chaque moteur Spark peut associer jusqu'à trois pools de capacité de différents types, ce qui offre une grande flexibilité pour répondre à diverses exigences en matière de charge de travail.
- La capacité dédiée prend en charge les paramètres minimum et maximum du pool de nœuds, vous permettant ainsi de contrôler l'allocation des ressources et les limites de mise à l'échelle.
- Si une capacité dédiée est attachée, les charges de travail s'exécutent par défaut sur celle-ci. Si aucune capacité dédiée n'est disponible, les charges de travail reviennent automatiquement à la capacité à la demande.
Pour ajouter un pool de capacité dédié à vos charges de travail Spark :
Dans l'onglet Capacité, cliquez sur l'onglet Dédié. Cliquez sur Ajouter un pool de nœuds+. La page Modifier la variante (dédiée) s'ouvre. Indiquez les informations suivantes :
-
Indiquez un nom pour la configuration dans le champ Nom du type d'instance.
-
Sélectionnez la combinaison de mémoire souhaitée dans la liste Sélectionner une variante. Les configurations suivantes sont disponibles.
Configurations mémoire Type d'arôme Saveur Cœur Mémoire (Go) Noyau utilisable Mémoire utilisable (Go) Stockage aléatoire par cœur (Go) Stockage secondaire (Go / Niveau) Usage général bx2.16x64 16 64 14 60 50 900 Go / niveau 10 IOPS Usage général bx2.32x128 32 128 30 124 50 1600 Go / niveau 10 IOPS Mémoire intensive mx2.16x128 16 128 14 124 50 900 Go / niveau 10 IOPS Mémoire intensive mx2.32x256 32 256 30 252 50 1600 Go / niveau 10 IOPS Stockage intensif mx2.16x128 16 128 14 124 100 1600 Go / niveau 10 IOPS Stockage intensif mx2.32x256 32 256 30 252 100 3000 Go / niveau 10 IOPS -
Spécifiez le nombre minimum et maximum de nœuds requis pour la mise à l'échelle. La capacité dédiée prend en charge les paramètres minimum et maximum du pool de nœuds, vous permettant ainsi de contrôler l'allocation des ressources et les limites de mise à l'échelle.
-
Sélectionnez Définir comme capacité par défaut pour choisir cette configuration comme capacité par défaut pour le moteur Spark sélectionné.
-
Cliquez sur Sauvegarder.