FAQ sur la reprise après sinistre

Les FAQ sur la reprise après sinistre peuvent inclure des questions sur ce qui est considéré comme un sinistre et sur la reprise de vos charges de travail dans une autre région. Pour rechercher toutes les FAQ pour IBM Cloud, consultez la bibliothèque de FAQ.

La haute disponibilité est-elle la même chose que la reprise après sinistre ? Les deux sont-ils nécessaires ?

Il est facile de confondre la haute disponibilité (HA) et la reprise après sinistre (DR), alors qu'il s'agit de deux notions bien distinctes.

L'intégration de la haute disponibilité dans une charge de travail est un effort pour éviter qu'une charge de travail ne tombe en panne. Par exemple, la répartition des données sur plusieurs disques dans une matrice RAID vise à prévenir une panne causée par une défaillance du disque. L'installation de plusieurs blocs d'alimentation dans un serveur permet d'éviter une panne causée par une interruption du circuit d'alimentation. L'exécution d'applications sur plusieurs serveurs dans différentes zones permet d'éviter une panne causée par la défaillance d'un serveur et d'une zone.

La reprise après sinistre est la pratique qui consiste à récupérer une charge de travail après qu'elle soit tombée en panne, malgré la disponibilité des ressources. Par exemple, une charge de travail peut être hautement disponible et résistante aux pannes parce qu'elle s'exécute sur plusieurs dispositifs matériels dans plusieurs centres de données, ce qui peut donner au système une disponibilité de 99.999 Cependant, il reste vulnérable aux catastrophes telles que l'effacement accidentel ou malveillant de données, ou une catastrophe naturelle qui détruit une vaste zone comprenant tous les centres de données.

En général, plus une charge de travail doit être hautement disponible, plus elle est précieuse et vitale pour l'entreprise. Une charge de travail étant vitale pour l'entreprise, il est d'autant plus nécessaire de disposer d'un plan de reprise après sinistre rigoureux et bien documenté.

Qu'est-ce qu'une catastrophe ?

Un sinistre informatique est un événement qui perturbe gravement une application ou un environnement, l'empêchant de fonctionner comme prévu. Les catastrophes peuvent être de courte ou de longue durée, mais elles causent généralement un préjudice important à l'entreprise, soit sur le plan financier, soit sur le plan de la réputation, soit les deux.

Les catastrophes peuvent résulter des scénarios suivants :

  • Les catastrophes naturelles telles que les inondations, les incendies et les tremblements de terre.
  • Les problèmes d'infrastructure tels que les coupures de courant ou les pannes de réseau plus importantes.
  • Actions accidentelles ou malveillantes qui suppriment les données, les services ou la configuration.
  • Diffusion d'une mise à jour logicielle contenant un bogue ou une autre erreur qui n'avait pas été prévue.

Dans tous les cas, il est essentiel de disposer d'un plan de reprise qui rétablisse les services dans un délai déterminé et à un moment antérieur au sinistre. Il est également important de prendre en compte les coûts, y compris l'impact du temps d'arrêt sur l'entreprise et les dépenses liées à la solution de récupération.

Le développement rural peut-il avoir lieu dans une seule région ?

Oui, la reprise après sinistre peut avoir lieu dans la même région, et elle peut être plus rapide en raison d'une latence moindre et de l'absence de nécessité de réplication des données entre les régions. Toutefois, il est recommandé d'utiliser une région distincte pour une meilleure résilience. Si la région primaire est gravement touchée, la récupération dans la même région peut s'avérer impossible.

IBM Cloud cherche à récupérer les services dans la région, conformément aux objectifs de niveau de service(SLO) publiés. Le rétablissement peut prendre quelques minutes ou quelques heures, mais dans les pires scénarios, par exemple en cas de destruction physique de biens, il peut prendre des jours, des semaines ou des mois.

Dans IBM Cloud, s'il y a une panne que IBM Cloud qualifie de catastrophe, IBM Cloud peut avoir à récupérer les services avant que vous ne puissiez récupérer vos charges de travail. Si c'est le cas, vous devez ajouter le temps nécessaire à IBM Cloud pour terminer sa récupération au temps nécessaire à la vôtre. Gardez cela à l'esprit lorsque vous décidez de vous appuyer sur une seule région.

Toutes les catastrophes nécessitent-elles un rétablissement dans une deuxième région ?

Toutes les catastrophes ne nécessitent pas une récupération dans une deuxième région. Un administrateur de base de données peut accidentellement supprimer une table de base de données, une mise à jour automatisée peut mal se passer ou un service cloud géré essentiel peut cesser de fonctionner correctement. Dans ce cas, la récupération des données est essentielle. Selon l'ampleur du problème, le degré de préparation de l'organisation et la rapidité de la reprise, un tel désastre peut ne pas nécessiter un basculement vers une autre région. Selon le scénario, la récupération peut se faire dans la même région. Envisagez plusieurs scénarios de catastrophe dans votre plan.

Comment puis-je empêcher la suppression accidentelle de services ?

De nombreux services IBM Cloud sont dotés de protections intégrées contre la suppression accidentelle, mais vous pouvez mettre en place des protections supplémentaires en utilisant des comptes disposant de droits d'accès appropriés. Utilisez Cloud Identity and Access Management (IAM) pour créer des comptes avec différents niveaux d'accès et de permissions. Utilisez ensuite un compte approprié pour les opérations à effectuer et assurez-vous que les autres utilisateurs, tels que les développeurs, n'ont que l'accès et les autorisations dont ils ont besoin.

Si vous utilisez Terraform, utilisez des identifiants de service qui ont un accès à la mise à jour mais pas à la suppression.