Comprendre la haute disponibilité et la reprise après sinistre pour VMware Solutions

Fin de la commercialisation: à compter du 31 octobre 2025, les nouveaux déploiements des offres « VMware Solutions » ne seront plus disponibles pour les nouveaux clients. Les clients existants peuvent continuer à utiliser et à développer leurs charges de travail VMware® actives sur IBM Cloud®. Pour plus d'informations, voir Fin de la commercialisation pour VMware sur IBM Cloud.

La haute disponibilitéLa capacité d'un service ou d'une charge de travail à résister aux défaillances et à continuer à fournir une capacité de traitement selon un niveau de service prédéfini. (HA) est la capacité d'un service à rester opérationnel et accessible en cas de défaillance inattendue. La reprise après sinistreCapacité d'un service ou d'une charge de travail à se remettre d'incidents rares, majeurs et de défaillances à grande échelle, tels que l'interruption d'un service. Il peut s'agir d'un désastre physique qui affecte une région entière, de la corruption d'une base de données ou de la perte d'un service contribuant à une charge de travail. L'impact dépasse la capacité de la conception de haute disponibilité à le gérer. est le processus de rétablissement de l'instance de service dans un état opérationnel.

VMware Solutions est un service mondial hautement disponible, conçu pour être disponible en cas de panne régionale. Cependant, le service VMware Solutions n'est utilisé que pour provisionner les ressources VMware dans votre compte cloud. Il est de votre responsabilité de concevoir et de gérer vos ressources VMware afin d'atteindre vos objectifs de haute disponibilité et de reprise après sinistre.

Architecture à haute disponibilité

Fonctionnalités de haute disponibilité

Lorsqu'il est configuré de manière appropriée, le logiciel VMware permet de créer des solutions hautement disponibles. Certaines de ces fonctions sont disponibles d'emblée avec l'offre VMware Cloud Foundation for Classic - Automated, tandis que d'autres doivent être configurées.

  • vSphere HA peut être utilisé pour récupérer des machines virtuelles (VM) d'un hôte à l'autre en cas de défaillance de l'hôte.
  • vMotion et Distributed Resource Scheduler (DRS) peuvent être utilisés pour déplacer de manière proactive les machines virtuelles d'un hôte à l'autre.
  • vSAN lorsqu'il est associé à une configuration réseau appropriée, le cluster étiré peut être utilisé avec vSphere HA pour récupérer les machines virtuelles d'une zone à l'autre en cas de défaillance de la zone.
  • Les clusters ou instances déployés dans plusieurs zones peuvent héberger des applications et des bases de données qui ont mis en œuvre leur propre réplication synchrone ou asynchrone.
  • Les clusters ou instances déployés dans plusieurs régions peuvent héberger des applications et des bases de données qui ont mis en œuvre leur propre réplication asynchrone.
  • Des solutions ou des logiciels d'équilibrage des charges peuvent être utilisés pour acheminer le trafic vers les régions et les zones appropriées.

Architecture de reprise après sinistre

Fonctionnalités de reprise après sinistre

Lorsqu'il est configuré de manière appropriée, le logiciel VMware permet d'élaborer des solutions de reprise après sinistre. Vous devez configurer ces fonctions.

  • Les logiciels de réplication tels que VMware Cloud Director Availability (VCDA), VMware Live Recovery à l'aide de vSphere la réplication, Veeam CDP et HPE Zerto Software Replication peuvent être utilisés pour répliquer vos charges de travail d'une région à l'autre.
  • Les logiciels de sauvegarde incrémentale tels que Veeam Backup and Replication et Zerto Journaling peuvent être utilisés, éventuellement en combinaison avec IBM Cloud Object Storage (COS) pour créer des sauvegardes locales ou à distance de vos charges de travail.

Planification de la reprise après incident

Établissez un plan de secours détaillé et mettez-le en pratique régulièrement. Vous pouvez avoir différents plans pour différents scénarios. Envisagez d'inclure les cas suivants :

  • Perte d'un point d'accès au réseau.
  • Défaillance d'un seul hôte.
  • Défaillance d'une zone entière.
  • Défaillance d'une région entière.
  • Corruption des données au sein de vos charges de travail virtuelles ou de votre plan de gestion.
  • Les logiciels malveillants et les logiciels rançonneurs dans vos charges de travail virtuelles ou votre plan de gestion.

Vos responsabilités en matière d'HA et de DR

Il est de votre responsabilité de tester en permanence votre plan d'HA et de DR.

Des interruptions de la connectivité du réseau et des pannes de matériel peuvent se produire. Il est de votre responsabilité de vous assurer que vous avez correctement mis en œuvre et testé les solutions de haute disponibilité et de reprise après sinistre que vous avez l'intention d'utiliser.

Pour plus d'informations sur la répartition des responsabilités entre vous et IBM Cloud® for VMware Solutions, voir Comprendre vos responsabilités lorsque vous utilisez VMware Solutions.

Objectif de délai de rétablissement (RTO) et objectif de point de rétablissement (RPO)

Le RTO et le RPO de votre solution de haute disponibilité et de reprise après sinistre dépendent de la solution choisie.

Le seul moyen de parvenir à un RPO nul est d'utiliser une réplication synchrone au niveau de l'application et de la base de données, ou d'utiliser un sous-système de stockage mettant en œuvre une réplication synchrone (par exemple, un stockage NFS dans la même zone, un stockage vSAN dans une seule zone, ou un stockage vSAN étendu entre deux zones). Toutes les autres solutions qui s'intègrent aux API VMware de l'hyperviseur (par exemple, Veeam CDP et HPE Zerto Software Replication) auront un RPO faible mais non nul.

Le RTO le plus bas est obtenu avec des déploiements d'applications actives-actives sur plusieurs hôtes ou zones, avec un équilibreur de charge ou un équilibreur de charge global (GLB) configuré en amont. Les solutions qui reposent sur le redémarrage d'un site VM (par exemple, vSphere HA) ou sur la déclaration d'un sinistre suivie du redémarrage d'une charge de travail complète (par exemple, Veeam CDP ou Zerto Software Replication) auront un RTO plus long.

Gestion des modifications

La plupart des modifications apportées à votre environnement VMware et à vos charges de travail seront effectuées dans le logiciel VMware plutôt que dans la console IBM Cloud. Vous devez configurer un contrôle d'accès et une journalisation d'audit appropriés pour votre plan de gestion VMware. Accordez à vos utilisateurs les privilèges minimaux nécessaires à leur travail. Envisagez de mettre en œuvre un processus ou une solution de gestion du changement pour votre plan de gestion VMware. Pensez également à créer des sauvegardes manuelles de VMware vCenter Server® et VMware NSX® avant de les mettre à niveau vers de nouvelles versions.

Comment IBM maintient les services

IBM® maintient le service VMware Solutions de manière hautement disponible, en répliquant nos données et notre plan de contrôle sur plusieurs régions IBM Cloud pour plus de résilience. Toutes les mises à niveau du service VMware Solution respectent les meilleures pratiques du service IBM, y compris les plans de reprise et les processus de retour en arrière. La maintenance régulière peut provoquer de brèves interruptions, atténuées par la logique de relance de la disponibilité du client. IBM annule les mises à jour au premier signe d'un défaut.

Les changements qui ont un impact sur les charges de travail des clients sont détaillés dans les notifications IBM Cloud. Pour plus d'informations sur la maintenance planifiée, les annonces et les notes de version qui ont un impact sur ce service, voir Consulter l'état du nuage.