Risikominimierung und Rollback-Strategien für die Migration zu IBM Cloud VPC

IBM Cloud VPC-Migrationsrisiken – Netzwerkausfälle, Datenbeschädigungen, Leistungsprobleme – minimieren und Rollback-Verfahren implementieren.

Gemeinsame Migrationsrisiken

Die folgenden Informationen betreffen häufige Schwierigkeiten, die nach einer Migration auftreten können.

Risiko: Ausfall der Netzwerkkonnektivität

Symptom: Nach der Migration kann der virtuelle Server nicht mit anderen Systemen kommunizieren.

Erkennung: Konnektivitätstests nach der Migration schlagen fehl.

Korrektur:

  • Zugriff über die Virtual Network Computing (VNC)-Konsole zur Fehlerbehebung
  • Konfiguration der virtuellen Netzwerkschnittstelle (VNI) überprüfen (IP-Adresse, Sicherheitsgruppen)
  • Überprüfen Sie die Routing-Tabellen in VPC und Transit Gateway
  • Überprüfen Sie die Sicherheitsgruppenregeln (verwenden Sie VPC-Flow-Protokolle, um verworfene Pakete zu sehen)

Rollback: Starten Sie die virtuellen Server VMware neu und aktualisieren Sie DNS und Load Balancer, damit sie wieder auf VMware verweisen.

Prävention:

  • Testen Sie die Konnektivität von Transit Gateway vor der Migration gründlich
  • Überprüfen Sie, ob die Sicherheitsgruppenregeln den erforderlichen Datenverkehr zulassen
  • Testen der DNS-Auflösung in der Ziel-VPC

Risiko: Die Anwendung lässt sich nicht starten

Symptom: Der Anwendungsdienst startet nach der Migration nicht, oder er startet, funktioniert aber nicht.

Erkennung: Der Dienst startet nicht, oder er startet, schlägt aber bei der Zustandsprüfung fehl.

Behebung:

  • Überprüfen Sie die Anwendungsprotokolle auf Fehler
  • Überprüfen der Konfigurationsdateien
  • Umgebungsvariablen prüfen
  • Überprüfen der Datenbankkonnektivität
  • Prüfen Sie auf Lizenzierungsprobleme

Rückgängig machen: Stoppen Sie die Anwendung in der VPC, starten Sie sie in einer VMware Umgebung neu.

Prävention:

  • Überprüfen Sie, ob alle Abhängigkeiten migriert oder über Transit Gateway zugänglich sind.
  • Testen Sie die Startprozeduren der Anwendung, die in der Pilotwelle enthalten sind.
  • Dokumentieren Sie anwendungsspezifische Konfigurationen, die Sie möglicherweise anpassen müssen.

Risiko: Datenverfälschung

Symptom: Beschädigte Daten, Dateisystemfehler oder Inkonsistenzen bei den Anwendungsdaten.

Erkennung: Dateisystemprüfungsfehler, die Anwendung meldet Datenfehler, die Datenbank startet nicht

Behebung:

  • Versuchen Sie eine Dateisystemreparatur
  • Wenn die Reparatur fehlschlägt, wiederholen Sie die Migration vom virtuellen Quellserver
  • Überprüfen Sie, ob der virtuelle Ausgangsserver ordnungsgemäß heruntergefahren wurde

Rollback: Verwerfen Sie den beschädigten virtuellen VPC-Server, starten Sie den virtuellen Quellserver neu und untersuchen Sie die Grundursache, bevor Sie die Migration erneut versuchen.

Prävention:

  • Sauberes Herunterfahren virtueller Server vor der Migration
  • Überprüfungen von Übertragungen mit Prüfsummen, soweit möglich
  • Verwenden Sie blockdev --flushbufs, bevor Sie Volumes abziehen

Risiko: Verschlechterung der Leistung

Symptom: Die Anwendung funktioniert in VPC schlechter als in VMware.

Erkennung: Längere Reaktionszeiten und geringerer Durchsatz

Behebung:

  • Überprüfung der Metriken für CPU, Arbeitsspeicher, Festplatten-E/A und Netzwerkbandbreite
  • Überprüfen Sie, ob das Speicherprofil über ausreichende IOPS verfügt
  • Überprüfen Sie, ob das Instanzprofil über eine ausreichende Netzwerkbandbreite verfügt
  • Prüfen Sie die Anwendungskonfiguration auf Probleme
  • Erwägen Sie ein Upgrade von Instanz- oder Speicherprofilen

Rollback: Falls kritisch, Failback auf VMware, während Sie die Leistung untersuchen.

Prävention:

  • Grundlegende Leistung in VMware vor der Migration
  • Auswahl geeigneter Instanz- und Speicherprofile, die auf Baselines beruhen
  • Aktivieren Sie die Zuweisung von gepoolter Speicherbandbreite

Entwurf einer Rollback-Strategie

Bestimmen Sie anhand der folgenden Kriterien, ob Sie ein Rollback durchführen müssen.

  • Mehr als 20 % der virtuellen Server in einer Welle werden nicht gestartet
  • Kritische Anwendungen bestehen Funktionstests nicht
  • Beschädigte Daten werden auf migrierten virtuellen Servern gefunden
  • Leistungsverschlechterung um mehr als 50 % gegenüber dem Ausgangswert ohne schnelle Lösung
  • Fehler in der Sicherheitsgruppenkonfiguration machen sensible Dienste ungeschützt

Rollback-Entscheidungsbefugnis:

  • Definieren Sie, wer die Rollback-Entscheidung treffen kann
  • Eskalationspfad für den Fall definieren, dass die Entscheidungsträger nicht einverstanden sind
  • Entscheidung über Timebox-Rollback

Rollback-Verfahren

Im folgenden Abschnitt werden die Phasen des Rollback-Verfahrens erläutert.

Anwendung des Rollback-Verfahrens der Phase 1

Bevor die virtuellen Server während der Migration erstellt werden, führen Sie die folgenden Schritte aus, um das Rollback-Verfahren der Phase 1 anzuwenden. Dieser Vorgang dauert etwa 30 Minuten.

  1. Stoppen Sie die Migration.
  2. Verwerfen Sie virtuelle Arbeitsserver und Volumes.
  3. Starten Sie die virtuellen Server unter „ VMware “ neu.
  4. Statusmeldungen aktualisieren.

Verwendung des Phase-2-Rollback-Verfahrens

Führen Sie nach der Erstellung virtueller Server während der Migration, aber vor dem DNS-Cutover, die folgenden Schritte aus, um das Rollback-Verfahren der Phase 2 zu verwenden. Dieser Vorgang dauert etwa 1 Stunde.

  1. Stoppen und löschen Sie migrierte virtuelle Server.
  2. Starten Sie die virtuellen Server unter „ VMware “ neu.
  3. Überprüfen Sie, ob die virtuellen Server von VMware funktionsfähig sind.
  4. Statusmeldungen aktualisieren.

Anwendung des Phase-3-Rollback-Verfahrens

Nach der DNS-Umstellung während der Migration können sich Daten ändern. Gehen Sie wie folgt vor, um das Rollback-Verfahren der Phase 3 anzuwenden. Je nach Datenumfang dauert dieser Vorgang 2-4 Stunden.

  1. Stoppen Sie virtuelle Server, aber löschen Sie sie nicht.
  2. Aktualisieren Sie DNS und Lastverteiler so, dass sie wieder auf VMware verweisen.
  3. Starten Sie die virtuellen Server unter „ VMware “ neu.
  4. Entscheidung über die Daten:
    • Wenn keine Daten geändert wurden, fahren Sie mit dem Rollback fort.
    • Wenn sich Daten in VPC geändert haben, müssen Sie die Daten zunächst mit VMware synchronisieren, bevor Sie ein Rollback durchführen können.
  5. Daten synchronisieren, falls erforderlich.
  6. Überprüfen Sie, ob die virtuellen Server von VMware funktionsfähig sind.
  7. Nach dem Prüfzeitraum die virtuellen VPC-Server löschen

Erhaltung des virtuellen Ausgangsservers

Um sicherzustellen, dass die virtuellen Quellserver erhalten bleiben, verwenden Sie die folgenden Informationen.

  • Löschen Sie die virtuellen Server VMware nicht sofort nach der Migration.
  • Die Aufbewahrungsfrist beträgt 7-30 Tage, je nach Ihrer Risikobereitschaft.
  • Erstellen Sie VMware Schnappschüsse.
  • Dokumentieren Sie die Speicherorte der Schnappschüsse und Ihre Aufbewahrungsrichtlinien.