Hochverfügbarkeit und Disaster-Recovery für Event Streams
HochverfügbarkeitDie Fähigkeit eines Dienstes oder einer Arbeitslast, Ausfällen standzuhalten und die Verarbeitungsfähigkeit gemäß einem vordefinierten Servicelevel weiterhin bereitzustellen. Für Dienstleistungen ist die Verfügbarkeit im Service Level Agreement definiert. Die Verfügbarkeit umfasst sowohl geplante als auch ungeplante Ereignisse wie Wartungsarbeiten, Ausfälle und Katastrophen. (HA) ist die Fähigkeit eines Dienstes, bei unerwarteten Ausfällen betriebsbereit und zugänglich zu bleiben. Bei der NotfallwiederherstellungDie Fähigkeit eines Dienstes oder einer Arbeitslast, sich von seltenen, schwerwiegenden Vorfällen und großflächigen Ausfällen, wie z. B. Dienstunterbrechungen, zu erholen. Dies umfasst eine Naturkatastrophe, die eine ganze Region betrifft, die Beschädigung einer Datenbank oder den Verlust eines Dienstes, der zu einer Arbeitsbelastung beiträgt. Die Auswirkungen übersteigen die Kapazitäten des Hochverfügbarkeitsdesigns. wird die Service-Instanz in einen funktionsfähigen Zustand versetzt.
IBM® Event Streams for IBM Cloud® ist ein globaler Dienst. Die verfügbaren Regionen und Rechenzentrumsstandorte finden Sie in der Dokumentation "Service- und Infrastrukturverfügbarkeit nach Standort ". Als globaler Dienst erfüllt Event Streams } die definierten Service Level Objectives(SLO) mit den Plänen „Standard“ und „Enterprise“. Die SLO ist keine Garantie und IBM® vergibt keine Credits für das Nichterreichen eines Ziels.
Hochverfügbarkeitsarchitektur
Hochverfügbarkeitsfunktionen
Event Streams unterstützt die folgenden Hochverfügbarkeitsfunktionen:
| Feature | Beschreibung | Hinweis |
|---|---|---|
| Umverteilung in einer Region mit mehreren Zonen | Verteilt auf drei Verfügbarkeitszonen für Fehlertoleranz und hohe Verfügbarkeit | In Event Streams werden die Daten jeder Partition auf drei Verfügbarkeitszonen verteilt (für MZR-Bereitstellungen), um die Geschäftskontinuität im Falle des Verlusts von Daten einer Verfügbarkeitszone sicherzustellen. |
| Mindestanzahl der synchronen Replikate | Es sind immer mindestens zwei synchronisierte Replikate erforderlich | Event Streams überwacht und stellt kontinuierlich sicher, dass mindestens zwei Replikate über die Verfügbarkeit hinweg synchronisiert sind, um sicherzustellen, dass Nachrichten im Falle eines Broker- oder Zonenausfalls nicht verloren gehen, und um sicherzustellen, dass kritische Daten dauerhaft erhalten bleiben. |
Architektur zur Wiederherstellung nach Katastrophen
Funktionen zur Notfallwiederherstellung
Event Streams unterstützt die folgenden Funktionen zur Notfallwiederherstellung:
| Feature | Beschreibung | Hinweis |
|---|---|---|
| Spiegeln | Spiegelung für Cluster-Replikation | Event Streams bietet eine Spiegelungsfunktion, mit der Nachrichten in Event Streams kontinuierlich in eine zweite Instanz kopiert werden können. Sie können die Event Streams -Spiegelungsfunktion verwenden oder Ihre eigene Spiegelungslösung verwalten. |
Spiegelung für Event Streams
Durch Spiegelung können Nachrichten in Event Streams kontinuierlich in eine zweite Instanz kopiert werden. Die Ausfallsicherheit von Anwendungen kann durch Spiegelung verbessert werden. Wenn also die erste Dienstinstanz nicht mehr verfügbar ist, können Anwendungen eine Verbindung zur zweiten Instanz herstellen und ihren normalen Betrieb fortsetzen.
Diese Funktion ist Teil des vollständig verwalteten Dienstes und kann nur zwischen Dienstinstanzen verwendet werden, die Event Streams verwenden.
- Merkmale der Spiegelung:
- Spiegeln Sie Themen, Nachrichtendaten und Verbrauchergruppen-Offsets zwischen zwei Event Streams, die in verschiedenen IBM Cloud® bereitgestellt werden können.
- SLA mit einer Verfügbarkeit von 99.99 %, in Übereinstimmung mit Event Streams.
- Kann mit IBM Cloud® Monitoring überwacht werden.
- Einschränkungen der Spiegelung:
- Unidirektional: Daten können nur in eine Richtung gleichzeitig zwischen einem Paar von Dienstinstanzen gespiegelt werden. Das bedeutet, dass die Spiegelung eine "aktiv-passiv"-Hochverfügbarkeit bietet, keine "aktiv-aktiv"-Hochverfügbarkeit.
- Asynchron: Nachrichten müssen erfolgreich an die Quellinstanz übermittelt werden, bevor sie an die Zielinstanz gespiegelt werden können. Das bedeutet, dass bei einem Ausfall einige Nachrichtendaten verloren gehen können.
- Mindestens einmaliger Nachrichtenverbrauch: Wenn ein Verbraucher zwischen Instanzen wechselt, muss er möglicherweise Nachrichten erneut verarbeiten, die er bereits verarbeitet hat.
Disaster-Recovery planen
Die Schritte zur Wiederherstellung nach einer Katastrophe müssen regelmäßig geübt werden. Berücksichtigen Sie bei der Erstellung Ihres Plans die folgenden Fehlerszenarien und Lösungen.
| Fehler | Lösung |
|---|---|
| Hardwarefehler (einzelner Punkt) | Event Streams ist gegenüber einem einzelnen Hardware-Ausfall innerhalb einer Zone robust – keine Konfiguration erforderlich. |
| Zonenfehler | Event Streams, die in einer Region mit mehreren Zonen bereitgestellt wird, ist gegenüber dem Ausfall einer einzelnen Zone robust – eine Konfiguration ist nicht erforderlich. Richten Sie für Einsätze in einer einzelnen Zone einen weiteren Event Streams als gespiegelten Cluster ein, um einem Zonenausfall vorzubeugen. |
| Datenbeschädigung | Event Streams enthält keine integrierten Mechanismen zur Wiederherstellung nach Datenbeschädigung. Sie müssen solche Umstände als Teil eines Notfallwiederherstellungsplans einplanen und müssen möglicherweise die Spiegelungsfunktion verwenden oder eine neue Instanz konfigurieren. |
| Regionalversagen | Wenn Sie Ihre Event Streams-Instanz in einer Region mit mehreren Zonen konfiguriert haben, ist eine regionale Katastrophe unwahrscheinlich. Wenn ein regionaler Fehler auftritt, müssen Sie eine neue Instanz in einer anderen Region konfigurieren. Weitere Informationen finden Sie im Abschnitt Über Ihre Pflichten. |
Ihre Verantwortung für humanitäre Hilfe und Katastrophenhilfe
Die folgenden Informationen können Ihnen dabei helfen, Ihren Plan für HA und DR zu erstellen und kontinuierlich zu üben.
Es ist wichtig, die Management-Verantwortlichkeiten und die Nutzungsbedingungen zu verstehen, die für Sie gelten, wenn Sie Event Streams verwenden. Die Seite mit den Kundenverantwortlichkeiten dient als Ausgangspunkt für die Erstellung eines Plans für Hochverfügbarkeit und Notfallwiederherstellung.
Im Rahmen der Notfallwiederherstellung wird empfohlen, Benutzern und Prozessen die IAM-Rollen und -Aktionen mit den geringsten für ihre Arbeit erforderlichen Berechtigungen zuzuweisen. Weitere Informationen finden Sie unter "Wie kann ich das versehentliche Löschen von Diensten verhindern?".
Alle Event Streams (außer Satellite ) können eine gelöschte Instanz innerhalb einer Wiederherstellungsfrist von drei Tagen wiederherstellen. Danach werden die Daten unwiderruflich zerstört. Sie können den Status einer Rückforderung überprüfen und eine geplante Rückforderung erzwingen oder stornieren, indem Sie IBM Cloud verwenden.
Wenn Event Streams die Service-Instanz nicht wiederherstellen kann, müssen Sie die Wiederherstellung wie unter "Spiegelung in einem Notfallwiederherstellungsszenario" beschrieben durchführen.
Wie IBM Dienste aufrechterhält
Alle Upgrades folgen den Best Practices des IBM-Service und verfügen über einen Wiederherstellungsplan und einen Rollback-Prozess. Regelmäßige Upgrades für neue Funktionen und Wartungsarbeiten sind Teil des normalen Betriebs. Eine solche Wartung kann gelegentlich zu kurzen Unterbrechungsintervallen führen, die durch die Wiederholungslogik der Client-Verfügbarkeit behandelt werden. Änderungen werden nacheinander eingeführt, Region für Region und Zone für Zone innerhalb einer Region. Updates werden beim ersten Anzeichen eines Defekts rückgängig gemacht.
Komplexe Änderungen werden mit Feature-Flags aktiviert und deaktiviert, um die Belichtung zu steuern.
Änderungen, die sich auf die Arbeitsbelastung der Kunden auswirken, werden in Benachrichtigungen detailliert beschrieben. Weitere Informationen finden Sie unter "Überwachungsbenachrichtigungen und -status " für geplante Wartungsarbeiten, Ankündigungen und Versionshinweise, die sich auf Event Streams auswirken.