Contrôles proactifs

Fin de la commercialisation: à compter du 31 octobre 2025, les nouveaux déploiements des offres « VMware Solutions » ne seront plus disponibles pour les nouveaux clients. Les clients existants peuvent continuer à utiliser et à développer leurs charges de travail VMware® actives sur IBM Cloud®. Pour plus d'informations, voir Fin de la commercialisation pour VMware sur IBM Cloud.

L'objectif de ces contrôles proactifs est de permettre aux administrateurs système de maintenir leur instance VMware Cloud Foundation for Classic - Automated dans un état sain. Lorsqu'ils sont effectués quotidiennement, ils permettent d'éviter que de nombreux problèmes courants liés à l'utilisation, à la capacité et aux performances n'aient une incidence sur vos charges de travail. Ces contrôles proactifs peuvent être classés dans la structure suivante.

  • Intégrité - Contrôles permettant d'identifier des problèmes qui affectent actuellement la santé de votre environnement et qui nécessitent une attention immédiate pour minimiser l'impact, par exemple les pannes matérielles.
  • Risque - Contrôles permettant d'identifier des problèmes qui ne constituent pas des menaces immédiates mais qui doivent être réglés rapidement, comme les problèmes de capacité.
  • Efficacité - Contrôles permettant d'identifier les domaines où il y a lieu d'améliorer les performances ou de récupérer des ressources. Par exemple, en redimensionnant les machines virtuelles et les clusters.

La plupart de ces contrôles proactifs peuvent être simplifiés via la gestion des opérations dans IBM Cloud® afin de réduire le temps de gestion.

Il est important de comprendre votre "ligne de base". Cette ligne de base reflète les opérations normales dans votre environnement. Tous les clients ont une base de référence différente qui est déterminée par leurs pratiques standard, les charges de travail qui s'exécutent sur l'instance VCF for Classic - Automated, etc. Ces contrôles proactifs comparent ensuite la capacité, la performance et l'utilisation récentes par rapport à cette ligne de base. Ces contrôles d'utilisation proactifs répondent aux quatre questions suivantes.

  1. Suis-je actuellement en situation de surutilisation ?
  2. Est-ce que je manquerai bientôt de capacité ?
  3. Mon cluster est-il sous-dimensionnée pour les pics d'utilisation prévus ?
  4. Puis-je récupérer les ressources non utilisées de mon infrastructure virtuelle ?

Instructions

Les lignes directrices suivantes vous aident à être proactif et à maintenir un environnement stable :

  • Planifiez vos déploiements de machines virtuelles en allouant suffisamment de ressources pour toutes les machines virtuelles que vous prévoyez d'exécuter. N'oubliez pas de prévoir des ressources pour vSphere ESXi™.
  • Ajustez la taille de vos machines virtuelles et allouez à chaque machine virtuelle autant de ressources virtuelles que nécessaire. Doter une machine virtuelle de plus de ressources qu'il n'en faut peut réduire les performances de cette machine virtuelle et celle des autres sur un même hôte.
  • En général, 80 % de l'utilisation de l'unité centrale hôte est un plafond raisonnable et 90 % est un avertissement qui indique que les unités centrales sont sur le point d'atteindre un état de surcharge. Si vos hôtes approchent les 80 % d'utilisation de l'unité centrale, provisionnez davantage d'hôtes.
  • En général, 80 % de l'utilisation de la mémoire RAM de l'hôte est un plafond raisonnable et 90 % est un avertissement qui indique que les hôtes sont pleinement utilisés. Si vos hôtes approchent les 80 % d'utilisation de la RAM, provisionnez davantage d'hôtes.
  • Il est important de ne pas sous-allouer la mémoire, donc allouez suffisamment de mémoire pour maintenir l'ensemble des applications que vous prévoyez d'exécuter dans les machines virtuelles, afin de minimiser l'emballement. L'emballement peut avoir un impact considérable sur les performances des applications. Cependant, vous devez également éviter de trop suralimenter la mémoire.
  • N'utilisez les paramètres des ressources, les réservations, les partages et les limites que si cela est nécessaire dans votre environnement. Si vous prévoyez des changements fréquents du total des ressources disponibles, utilisez des partages, et non des réservations, pour répartir les ressources équitablement entre les machines virtuelles. Les partages ne prennent effet que lorsqu'un conflit de ressources existe.
  • Si vous avez besoin d'utiliser des réservations, configurez-les pour spécifier la quantité minimale d'unité centrale ou de mémoire acceptable, et non la quantité que vous souhaitez avoir disponible.
  • Utilisez les pools de ressources pour la gestion déléguée des ressources et pour isoler complètement un pool de ressources, définissez le type de pool de ressources sur Fixe et utilisez Réservation et Limite.
  • Regrouper les machines virtuelles d'un service multi-niveaux dans un pool de ressources, ce qui permet d'affecter des ressources à l'ensemble du service. Sélectionnez soigneusement les paramètres de ressources (c'est-à-dire les réservations, les partages et les limites) pour vos machines virtuelles. Des réservations trop élevées peuvent laisser peu de ressources non réservées dans le cluster et limiter les options dont DRS dispose pour équilibrer la charge.
  • Fixer des limites trop basses pourrait empêcher les machines virtuelles d'utiliser les ressources supplémentaires disponibles dans le cluster pour améliorer leurs performances.
  • Exécutez vos clusters avec un taux d'utilisation maximum de 80 % pour permettre la restauration des hôtes à l'aide de VMware Update Manager. La remédiation de la grappe a plus de chances de réussir lorsque la grappe fonctionne à un maximum de 80 % d'utilisation.
  • L'allocation dynamique de stockage augmente la charge de travail de gestion nécessaire à la maintenance de votre environnement. Soyez donc prudent dans votre processus de gestion des capacités.
  • Analysez la croissance de vos machines virtuelles, comprenez comment votre infrastructure est utilisée pour soutenir cette croissance, et commandez des capacités supplémentaires pour faciliter cette croissance.
  • Utilisez la capacité utilisable, qui tient compte de la haute disponibilité et des tampons, et non la capacité totale disponible.
  • Assurez-vous que vous exécutez la version en cours du BIOS disponible pour votre système.
  • Assurez-vous que vous exécutez les mises à jour en cours de VMware pour les produits installés, y compris le matériel de machine virtuelle et les outils de machine virtuelle.

Liste des tâches

Contrôles proactifs
Titre Description
Etat A l'aide de vCenter, vérifiez l'état de santé de tous les hôtes et de tous les objets de la machine virtuelle. Avancez méthodiquement à travers les clusters, les hôtes, les magasins de données, les machines virtuelles et les réseaux à la recherche d'alarmes.
Vérification des alarmes et des notifications Vérifiez qu'il n'y a pas d'alarmes actives sur vCenter dont vous n'avez pas connaissance. Par défaut, un certain nombre d'alarmes est défini pour vCenter lors de son installation. Ces alarmes peuvent vous alerter en cas de problème. Toutefois, par défaut, elles émettent un avertissement ou une alerte dans VMware vSphere® Web Client seulement. Elles peuvent être configurées pour une notification par courrier électronique par exemple. Lorsque vous vérifiez l'état de santé des hôtes et des objets de la machine virtuelle, passez en revue les alarmes, décidez si une notification est nécessaire et configurez-la en fonction de vos besoins. Vous n'avez besoin d'être averti que pour les problèmes les plus importants ou critiques. Considérez le cas suivant : est-ce que je veux être averti de ce problème à 2 heures du matin ou est-ce que je peux attendre jusqu'à l'horaire de travail normal ? Un trop grand nombre de notifications sont considérées comme "bruit" et la nature humaine consiste à ignorer toutes les alarmes.
Vérification de l'utilisation et de la capacité de la mémoire et de l'unité centrale du cluster Examinez les métriques de capacité et d'utilisation pour l'unité centrale et la mémoire du cluster. Utilisez vCenter pour accéder à chaque cluster, l'un après l'autre, afin de sélectionner Moniteur, puis Performances. Examinez les graphiques et les statistiques pour vous assurer que votre cluster dispose de suffisamment de ressources pour satisfaire la demande. Vous devez baser la demande sur le maintien d'une capacité suffisante pour que les machines virtuelles puissent se développer en cas de besoin, pour qu'un hôte vSphere ESXi puisse tomber en panne et pour que des machines virtuelles puissent être ajoutées en fonction de vos demandes de service connues.
Vérification de la capacité et de l'utilisation du magasin de données Examinez les métriques de capacité et d'utilisation pour le magasin de données. Utilisez vCenter pour accéder à chaque magasin de données, l'un après l'autre, afin de sélectionner Moniteur, Performances, Espace. Examinez les graphiques et les statistiques pour vous assurer que votre magasin de données dispose de suffisamment d'espace pour satisfaire la demande. La demande doit être basée sur le maintien d'une capacité suffisante pour qu'un hôte ESXi vSphere puisse tomber en panne (pour un cluster vSAN™ ) et pour que des VM puissent être ajoutées en fonction de vos demandes de service connues.
Contrôle des performances du magasin de données Examinez les attributs de performance pour les magasins de données. Utilisez vCenter pour accéder à chaque magasin de données, l'un après l'autre, afin de sélectionner Moniteur, Performances, Performances, Temps réel. Passez en revue les graphiques et les statistiques pour vous assurer que la ligne de base de performance de votre magasin de données est attendue et que tout changement peut être pris en compte. Examinez toute anomalie.
Microprogramme de serveur non virtualisé Les meilleures pratiques recommandent d'installer les mises à jour les plus récentes des microprogrammes pour vos serveurs bare metal. Recherchez les mises à jour de microprogramme sur les hôtes du serveur bare metal en utilisant l'option Mettre à jour le microprogramme dans le portail IBM Cloud. Sur la page qui s'affiche, passez en revue la version actuelle et la version mise à jour de la carte système et des unités de disque dur, et vérifiez si des mises à jour sont disponibles. Si c'est le cas, planifiez la mise à jour du microprogramme dans votre prochaine fenêtre de maintenance. Pour plus d'informations, voir FAQ : Serveurs nus.
Correctifs vSphere ESXi Pour plus d'informations sur la vérification de la disponibilité des correctifs vSphere ESXi, voir Création de lignes de base et association à des objets d'inventaire.
Mises à jour matérielles des machines virtuelles Pour plus d'informations sur la vérification de la disponibilité des mises à jour matérielles des machines virtuelles, voir Création de lignes de base et association à des objets d'inventaire.
Mises à jour de VM Tools Pour plus d'informations, voir Création de lignes de base et association à des objets d'inventaire.
Application de correctifs à vSphere vSAN Pour plus d'informations sur la vérification de la disponibilité des correctifs vSphere vSAN et le processus de correction, voir Mise à jour des clusters vSAN.
VMware vCenter® rapiéçage Pour plus d'informations sur la vérification de la disponibilité des correctifs vCenter et l'application de la mise à jour, voir VCSA update and SSO-linked vCenters.
Mise à jour de NSX Pour plus d'informations sur la vérification de la disponibilité des correctifs NSX et l'application de la mise à jour, voir NSX patching.
Recherche de machines virtuelles sans VM Tools Il est recommandé d'installer VM Tools car il permet une plus grande interaction avec le système d'exploitation, par exemple une mise hors tension en douceur de la machine virtuelle. Vous pouvez utiliser vCenter pour identifier les machines virtuelles sur lesquelles VM Tools n'est pas installé. Accédez au cluster, sélectionnez Objets connexes, Machines virtuelles, puis dans le tableau, activez les colonnes VM Tools en cours et Version de VM Tools. Passez la liste en revue et installez VM Tools si nécessaire.
Machines virtuelles avec instantanés Pour plus d'informations sur les meilleures pratiques lorsque vous travaillez avec des instantanés, voir Meilleures pratiques pour l'utilisation d'instantanés dans l'environnement vSphere(1025279). Il est important d'identifier l'existence de machines virtuelles avec instantanés car l'utilisation d'un seul instantané pendant plus de 72 heures crée un fichier instantané dont la taille ne cesse de croître et qui peut entraîner un manque d'espace sur le stockage des instantanés et affecter les performances du système. Pour examiner les VM avec des instantanés, connectez-vous à vCenter à l'aide du Web Client, sélectionnez le site vCenter et allez dans l'onglet Related Objects (Objets liés). Cliquez avec le bouton droit de la souris sur les titres des colonnes et accédez à la liste Afficher/Masquer les colonnes. Dans la liste des colonnes, sélectionnez l'option Consolidation des besoins. Cette colonne affiche un récapitulatif de toutes les machines virtuelles en cours d'exécution.
Correctif de SE AD/DNS Microsoft® Active Directory™ (AD) / Domain Name Server (DNS) est automatiquement configuré pour ne télécharger que les mises à jour. Pour plus d'informations sur les options de mises à jour, voir Limitations et remarques supplémentaires.
Vérification du temps d'attente du stockage Vérifiez la latence du stockage pour comprendre tout changement concernant l'accès des hôtes ESXi vSphere aux magasins de données. Une latence trop élevée ralentit les applications hébergées dans les machines virtuelles. Dans vCenter, accédez à l'onglet Performances. Pour chaque magasin de données, examinez la latence d'écriture moyenne par machine virtuelle.
Vérification des machines virtuelles avec périphériques virtuels Les périphériques virtuels tels que les lecteurs de CD ou de disquettes créent une surcharge, par conséquent, supprimez tous les périphériques qui ne sont pas nécessaires pour une machine virtuelle.
Conseil sur la capacité du réseau vSAN Lorsqu'un dispositif de capacité de votre cluster atteint 80 % de sa capacité, le vSAN rééquilibre automatiquement le cluster, jusqu'à ce que l'espace disponible sur tous les dispositifs de capacité soit inférieur au seuil. Les opérations suivantes peuvent entraîner une augmentation de la capacité du disque jusqu'à 80 % et déclencher un rééquilibrage du cluster : les pannes matérielles, les hôtes vSAN placés en mode maintenance avec l'option Evacuer toutes les données, ou les hôtes vSAN placés en mode maintenance avec la fonction Assurer l'accessibilité des données lorsque des objets PFTT=0 résident sur l'hôte. Afin d'offrir suffisamment d'espace pour la maintenance et la reprotection et de minimiser le rééquilibrage automatique des événements dans le cluster vSAN, pensez à conserver une capacité de 30 % disponible à tout moment.
Vérification de l'utilisation du cluster En utilisant vCenter,, examinez chaque cluster et identifiez les clusters dont l'utilisation du CPU et de la RAM est supérieure ou égale à 50 %. 50% est choisi comme niveau d'alerte pour attirer l'attention sur l'expansion potentielle de ce cluster avec plus d'hôtes ou de clusters. La différence entre une utilisation de 50 % et un maximum de 80 à 90 % est la marge de manœuvre dont vous disposez pour augmenter le nombre de machines virtuelles en raison des demandes de service. Si la limite de 50 % est atteinte, vous devriez examiner les demandes et les prévisions à court terme si des ressources supplémentaires doivent être ajoutées.
Examen de la consolidation des clusters À l'aide de vCenter, consultez chaque cluster et identifiez les clusters qui sont à 30 % d'utilisation d'UC et de mémoire RAM ou moins. 30% est choisi comme niveau d'avertissement pour attirer l'attention sur le dimensionnement potentiel de ce cluster en supprimant les hôtes ou en supprimant ce cluster et en déplaçant les machines virtuelles vers un autre cluster.
Redimensionnement des machines virtuelles surdimensionnées Adoptez une approche simple pour les machines virtuelles surdimensionnées de taille correcte : identifiez, profilez, optimisez et surveillez les tendances de la demande. A l'aide de vCenter, identifiez les grosses machines virtuelles qui ont le potentiel d'une taille adaptée. Accédez à Surveiller, Performances, analysez la demande moyenne en unité centrale et en mémoire RAM de la charge de travail dans le temps et ajustez les ressources virtuelles. Enfin, continuez à surveiller la charge de travail pour vous assurer que la performance est acceptable. Idéalement, la mémoire consommée par la machine virtuelle devrait être proche de la mémoire utilisée par le système d'exploitation invité, plus la charge nécessaire au fonctionnement de la machine virtuelle.
Redimensionnement des machines virtuelles sous-dimensionnées Adoptez une approche simple pour dimensionner correctement les machines virtuelles sous-dimensionnées. Il faut d'abord identifier, puis profiler et ajuster, et enfin suivre les tendances de la demande. Identifiez les petites machines virtuelles qui ont besoin d'être redimensionnées. Analysez la demande moyenne en unité centrale et en mémoire RAM de la charge de travail au fil du temps et ajustez les ressources virtuelles. Enfin, continuez à surveiller la charge de travail pour vous assurer que la performance est acceptable. Idéalement, la mémoire consommée par la machine virtuelle devrait être proche de la mémoire utilisée par le système d'exploitation invité, plus la charge nécessaire au fonctionnement de la machine virtuelle.
Vérification de la compatibilité matérielle des périphériques des machines virtuelles A l'aide de la ressource en ligne de compatibilité matérielle VMware, vérifiez que les ressources matérielles de vos machines virtuelles (réseau, périphériques de stockage) sont prises en charge pour ce système d'exploitation. S'ils ne sont pas pris en charge, remplacez-les par un appareil pris en charge afin d'améliorer la fiabilité et les performances.