FAQs zur Notfallwiederherstellung

Zu den häufig gestellten Fragen zur Wiederherstellung im Katastrophenfall gehören Fragen dazu, was als Katastrophe gilt und wie Sie Ihre Workloads in einer anderen Region wiederherstellen können. Die vollständigen FAQs zu IBM Cloud finden Sie in der Bibliothek mit häufig gestellten Fragen.

Ist Hochverfügbarkeit dasselbe wie Disaster Recovery? Sind beide erforderlich?

Hochverfügbarkeit (HA) und Disaster Recovery (DR) werden leicht verwechselt, aber sie sind sehr unterschiedlich.

Die Entwicklung von Hochverfügbarkeit in einem Workload ist ein Versuch, den Ausfall eines Workloads zu verhindern. Die Verteilung der Daten auf mehrere Festplatten in einem RAID-Array ist beispielsweise ein Versuch, einen Ausfall durch Festplattenfehler zu verhindern. Mehrere Stromversorgungen in einem Server sind ein Versuch, einen durch einen Stromausfall verursachten Ausfall zu verhindern. Die Ausführung von Anwendungen auf mehreren Servern in verschiedenen Zonen ist ein Versuch, einen Ausfall zu verhindern, der durch einen Server- und Zonenausfall verursacht wird.

Unter Disaster Recovery versteht man die Wiederherstellung eines Workloads nach einem Ausfall, auch wenn noch Ressourcen zur Verfügung stehen. So kann eine Arbeitslast beispielsweise hochverfügbar und ausfallsicher sein, weil sie über mehrere Hardwaregeräte in mehreren Rechenzentren läuft, wodurch das System eine Verfügbarkeit 99.999 erreichen kann. Es ist jedoch immer noch anfällig für Katastrophen wie versehentliches oder böswilliges Löschen von Daten oder eine Naturkatastrophe, die ein großes Gebiet, das alle Rechenzentren umfasst, zerstört.

Je höher die Verfügbarkeit eines Workloads sein muss, desto wertvoller und wichtiger ist er für das Unternehmen. Da ein Workload für das Unternehmen lebenswichtig ist, ist es umso wichtiger, dass ein gut dokumentierter, strenger Disaster-Recovery-Plan vorliegt.

Was gilt als Katastrophe?

Eine IT-Katastrophe ist ein Ereignis, das eine Anwendung oder Umgebung so stark beeinträchtigt, dass sie nicht mehr wie vorgesehen funktionieren kann. Katastrophenereignisse können von kurzer oder langer Dauer sein, aber sie verursachen in der Regel einen erheblichen Schaden für das Unternehmen, entweder in finanzieller Hinsicht, für den Ruf oder für beides.

Katastrophenereignisse können das Ergebnis der folgenden Szenarien sein:

  • Naturkatastrophen wie Überschwemmungen, Brände, Erdbeben.
  • Infrastrukturprobleme wie Stromausfälle oder breitere Netzausfälle.
  • Versehentliche oder böswillige Aktionen, die Daten, Dienste oder die Konfiguration löschen.
  • Ausrollen eines Software-Updates, das einen Fehler enthält, der nicht vorhergesehen wurde.

In jedem Fall ist es wichtig, einen Wiederherstellungsplan zu haben, der die Dienste innerhalb eines bestimmten Zeitrahmens und zu einem Zeitpunkt vor der Katastrophe wiederherstellt. Es ist auch wichtig, die Kosten zu berücksichtigen, einschließlich der Auswirkungen von Ausfallzeiten auf das Unternehmen und der Kosten für die Wiederherstellungslösung.

Kann die DR in einer Region stattfinden?

Ja, DR kann in derselben Region stattfinden und ist möglicherweise schneller, weil die Latenzzeit geringer ist und keine regionsübergreifende Datenreplikation erforderlich ist. Es wird jedoch empfohlen, eine separate Region zu verwenden, um eine bessere Ausfallsicherheit zu gewährleisten. Wenn die primäre Region stark betroffen ist, ist eine Erholung in derselben Region möglicherweise nicht möglich.

{Das Ziel ist die Wiederherstellung von Diensten innerhalb der Region im Einklang mit den veröffentlichten Service Level Objectives(SLOsIBM Cloud. Die Wiederherstellung kann Minuten oder Stunden dauern, aber im schlimmsten Fall, z. B. bei physischer Zerstörung von Eigentum, kann es Tage, Wochen oder Monate dauern, bis sie abgeschlossen ist.

Wenn es in IBM Cloud zu einem Ausfall kommt, den IBM Cloud als Katastrophe bezeichnet, muss IBM Cloud möglicherweise Dienste wiederherstellen, bevor Sie Ihre Workloads wiederherstellen können. Wenn dies der Fall ist, müssen Sie die Zeit, die IBM Cloud für die Wiederherstellung benötigt, zu der Zeit addieren, die Sie für Ihre Wiederherstellung benötigen. Denken Sie daran, wenn Sie entscheiden, ob Sie sich nur auf eine einzige Region verlassen wollen.

Müssen alle Katastrophen in einer zweiten Region geborgen werden?

Nicht alle Katastrophen erfordern eine Wiederherstellung in einer zweiten Region. Ein Datenbankadministrator könnte versehentlich eine Datenbanktabelle löschen, eine automatisierte Freigabe könnte schief gehen, oder ein wichtiger verwalteter Cloud-Dienst könnte nicht mehr richtig funktionieren. In diesen Fällen ist die Datenwiederherstellung der Schlüssel. Je nachdem, wie weitreichend das Problem ist, wie gut das Unternehmen vorbereitet ist und wie schnell es wiederhergestellt werden muss, muss eine solche Katastrophe nicht unbedingt zu einem Failover in eine andere Region führen. Je nach Szenario kann die Verwertung in derselben Region erfolgen. Berücksichtigen Sie in Ihrem Plan mehrere Katastrophenszenarien.

Wie kann ich eine versehentliche Löschung von Diensten verhindern?

Viele IBM Cloud-Dienste verfügen über integrierte Sicherheitsvorkehrungen gegen versehentliches Löschen, aber Sie können weitere Schutzvorkehrungen treffen, indem Sie Konten verwenden, die über entsprechende Zugriffsrechte verfügen. Verwenden Sie Cloud Identity and Access Management (IAM), um Konten mit verschiedenen Zugriffsebenen und Berechtigungen zu erstellen. Verwenden Sie dann ein für die jeweilige Aufgabe geeignetes Konto und stellen Sie sicher, dass andere Benutzer, wie z. B. Entwickler, nur den Zugriff und die Berechtigungen erhalten, die sie benötigen.

Wenn Sie Terraform verwenden, verwenden Sie Service-IDs, die Zugriff auf Aktualisierungen, aber nicht auf Löschungen haben.