Gestion des mises à jour statistiques à partir du tableau de bord de Query Optimizer

Une fois que l'optimiseur de requêtes est activé avec succès pour le moteur Presto (C++), il permet d'améliorer les performances des requêtes et d'optimiser les capacités dans plusieurs catalogues.

L' optimiseur de requêtes permet de collecter, de stocker et de synchroniser les statistiques des tables et des colonnes pour les tables spécifiées. Ces statistiques fournissent des informations essentielles sur les données, notamment le nombre de lignes, le nombre de valeurs distinctes, les valeurs minimales et maximales de chaque colonne et la distribution globale des données. Seuls les catalogues Hive et Iceberg sont pris en charge pour la collecte de statistiques.

Les tâches décrites dans cette rubrique rassemblent des statistiques et des métadonnées, et les synchronisent avec l'optimiseur de requêtes pour permettre une planification et une exécution plus précises et plus efficaces des requêtes. Seuls les catalogues Hive et Iceberg sont pris en charge pour la collecte de statistiques.

Visualisation des moteurs Presto (C++)

  1. Dans le menu de navigation, sélectionnez Configurations et cliquez sur la tuile Query Optimizer Manager. La page Gestionnaire de l'optimiseur de requêtes s'ouvre.
  2. Cliquez sur l'onglet Moteurs. Il affiche les moteurs Presto (C++), leur statut et les catalogues associés.

Collecte d'informations statistiques à partir de catalogues

Vous pouvez collecter, stocker et synchroniser les catalogues (et les tables) associés au moteur Presto (C++).

  1. Dans le menu de navigation, sélectionnez Configurations et cliquez sur la tuile Query Optimizer Manager. La page Gestionnaire de l'optimiseur de requêtes s'ouvre.

  2. Cliquez sur l'onglet Catalogues.

  3. L'onglet Statistiques permet de visualiser les catalogues associés, le pourcentage de tables analysées par rapport au nombre total de tables dans chaque catalogue et l'horodatage de l'analyse la plus récente. Vous pouvez filtrer les enregistrements en fonction de l'analyse. Pour ce faire, cliquez sur l'icône Filtre. Sélectionnez les options suivantes et appliquez les conditions de filtrage :

    • Pas d'analyse : Cochez cette case pour filtrer les catalogues qui n'ont pas encore été analysés.

    • Temps écoulé depuis la dernière analyse : Cochez cette case et indiquez la période (en jours ou en mois) pour obtenir la liste des enregistrements traités au cours de la période spécifiée.

  4. Cliquez sur le bouton Collecter les statistiques. La page Collect statistics s'ouvre avec les schémas et les tables associés aux moteurs Presto (C++). Sélectionnez les tables et cliquez sur Créer des tâches pour créer des statistiques pour les tables.

    Vous pouvez également utiliser le menu de débordement situé à côté de chaque catalogue sur la page Query Optimizer Manager pour lancer la collecte de données statistiques pour les tables du catalogue sélectionné.

Visualisation de l'état des travaux statistiques

  1. Dans le menu de navigation, sélectionnez Configurations et cliquez sur la tuile Query Optimizer Manager. La page Gestionnaire de l'optimiseur de requêtes s'ouvre.

  2. Cliquez sur l'onglet Catalogues.

  3. L'onglet Travaux statistiques fournit la liste des travaux statistiques que vous avez créés.

    Actif: Les travaux lancés à partir de la page Collecter des statistiques et qui sont actuellement en cours d'exécution sont répertoriés ici. À tout moment, un seul enregistrement d'emploi apparaît dans l'état actif. Dans le menu de débordement, vous pouvez :

    • Afficher le journal : Sélectionnez cette option pour afficher le journal du travail pour l'enregistrement actif.

    • Ajouter à la file d'attente : sélectionnez cette option si vous souhaitez placer l'enregistrement dans la file d'attente.

    • Supprimer : Sélectionnez cette option pour supprimer l'enregistrement.

    Les informations du journal peuvent inclure l'état suivant du travail :

    NOTRECEIVED : Le système n'a pas reçu d'appel avec un ID de tâche donné.

    NOTRUN : Une erreur a empêché l'ordonnanceur d'invoquer la procédure de la tâche.

    UNKNOWN : La tâche a commencé à s'exécuter, mais l'ordonnanceur n'a pas enregistré le résultat en raison d'une condition inattendue.

    En attente: Si plusieurs travaux sont lancés à partir de la page Collecter des statistiques, un seul restera dans l'état actif à la fois. Tous les autres emplois seront répertoriés et placés dans une file d'attente. Dans le menu de débordement, vous pouvez sélectionner Supprimer de la file d'attente pour supprimer l'enregistrement de la file d'attente.

    Terminé: Les travaux dont l'exécution est terminée sont répertoriés ici. Les options disponibles dans le menu de débordement vous permettent d'afficher le journal, d'ajouter les enregistrements à la file d'attente ou de les supprimer.