への移行におけるリスクの軽減およびロールバック戦略 IBM Cloud VPC

IBM Cloud VPC への移行に伴うリスク(ネットワーク障害、データの破損、パフォーマンスの問題など)を軽減し、ロールバック手順を導入します。

一般的な移住リスク

以下の情報は、移行後に遭遇する可能性のある一般的な問題をカバーしています。

リスク:ネットワーク接続障害

症状:移行後、仮想サーバーが他のシステムと通信できない。

検出:移行後の接続性テストが失敗する

修正する:

  • トラブルシューティングのために、Virtual Network Computing(VNC)コンソール経由でアクセスする
  • 仮想ネットワークインターフェース(VNI)の設定(IPアドレス、セキュリティグループ)を確認する
  • VPCのルーティングテーブルをチェックし Transit Gateway
  • セキュリティグループのルールを見直す(VPCのフローログを使って、ドロップされたパケットを確認する)

ロールバック: VMware 仮想サーバーを再起動し、DNS とロードバランサーを更新して VMware を指すようにします。

予防だ:

  • 移行前に Transit Gateway の接続性を徹底的にテストする
  • セキュリティグループルールが必要なトラフィックを許可していることを確認する
  • ターゲットVPCのDNS解決をテストする

リスク:アプリケーションが起動しない

症状 :移行後にアプリケーションサービスが起動しない、または起動しても機能しない。

検出 :サービスが起動しないか、起動してもヘルスチェックに失敗する。

修正 :

  • アプリケーションのログを確認してエラーがないか確認してください
  • 設定ファイルの検証
  • 環境変数のチェック
  • データベース接続の確認
  • ライセンスの問題をチェックする

ロールバック :VPCでアプリケーションを停止し、 VMware 環境で再起動する。

予防 :

  • すべての依存関係が移行されていること、または Transit Gateway からアクセスできることを確認する。
  • パイロット波にあるアプリケーションの起動手順をテストする。
  • 調整が必要と思われるアプリケーション固有の設定を文書化する。

リスク:データ破損

症状 :破損したデータ、ファイルシステムのエラー、またはアプリケーションデータの不整合。

検出ファイルシステムチェックエラー、アプリケーションがデータエラーを報告、データベースが起動しない

修正 :

  • ファイルシステムの修復を試みる
  • 修復に失敗した場合は、移行元の仮想サーバーからの移行を再試行します
  • ソース仮想サーバーがクリーンにシャットダウンされたことを確認します

ロールバックします:移行を再試行する前に、破損したVPC仮想サーバーを破棄して移行元の仮想サーバーを再起動し、根本的な原因を調査します。

予防 :

  • 移行前に仮想サーバーをクリーンにシャットダウン
  • 可能であれば、チェックサムで転送を検証する
  • ボリュームをデタッチする前に blockdev --flushbufs を使用する

リスク:パフォーマンス低下

症状 :アプリケーションのパフォーマンスがVPCの方が VMware より悪い。

検出 :応答時間の増加とスループットの低下

修正 :

  • CPU、メモリ、ディスクI/O、ネットワーク帯域幅メトリクスのチェック
  • ストレージプロファイルに十分なIOPSがあることを確認する
  • インスタンスプロファイルに十分なネットワーク帯域幅があることを確認する
  • アプリケーション設定の問題をチェックする
  • インスタンスまたはストレージプロファイルのアップグレードを検討する

ロールバック :クリティカルな場合は、パフォーマンスを調査する間、 VMware にフェイルバックする。

予防 :

  • VMware、移行前のベースライン・パフォーマンス
  • ベースラインに基づいて、適切なインスタンスとストレージのプロファイルを選択する
  • プールされたストレージ帯域幅の割り当てを有効にする

ロールバック戦略設計

ロールバックが必要かどうかは、以下の基準で判断する。

  • ウェーブ内の20%以上の仮想サーバーが起動しない
  • 重要なアプリケーションが機能テストに失敗
  • 移行した仮想サーバーで破損したデータが見つかる
  • ベースラインから50%以上のパフォーマンス低下
  • セキュリティグループの設定ミスで機密サービスが漏洩

ロールバックの決定権

  • ロールバックを決定できる人を定義する
  • 意思決定者の意見が一致しない場合のエスカレーション・パスの定義
  • タイムボックス・ロールバックの決定

ロールバック手順

以下のセクションでは、ロールバック手順のフェーズについて説明する。

フェーズ 1 ロールバック手順の使用

移行中に仮想サーバーが作成される前に、以下の手順に従ってフェーズ 1 のロールバック手順を使用してください。 この作業には30分ほどかかる。

  1. 移住を止める。
  2. ワーカー仮想サーバーとボリュームを破棄する。
  3. VMware の仮想サーバーを再起動します。
  4. 更新状況の連絡。

フェーズ 2 ロールバック手順の使用

移行中に作成された仮想サーバーがDNSカットオーバーされる前に、以下の手順に従ってフェーズ2のロールバック手順を実行します。 この作業には1時間ほどかかる。

  1. 移行した仮想サーバーを停止して削除します。
  2. VMware の仮想サーバーを再起動します。
  3. VMware 仮想サーバーが機能していることを確認する。
  4. 更新状況の連絡。

フェーズ 3 ロールバック手順の使用

移行中にDNSが切り替わると、データが変更される可能性があります。 フェーズ3のロールバック手順を使用するには、以下の手順を実行する。 データサイズにもよるが、この処理には2〜4時間かかる。

  1. 仮想サーバーを停止するが、削除はしない。
  2. DNSとロードバランサーを更新し、 VMware を指すようにする。
  3. VMware の仮想サーバーを再起動します。
  4. データ決定:
    • データに変更がなければ、ロールバックを続行する。
    • VPCでデータが変更された場合、ロールバックする前に VMware。
  5. 必要に応じてデータを同期する。
  6. VMware 仮想サーバーが機能していることを確認する。
  7. 検証期間終了後、VPC仮想サーバーを削除する

ソース仮想サーバーの保存

ソース仮想サーバーが保存されていることを確認するには、以下の情報を使用します。

  • 移行後すぐに VMware 仮想サーバーを削除しないでください。
  • 保有期間はリスク許容度に応じて7~30日。
  • VMware スナップショットを作成する。
  • スナップショットの場所と保存ポリシーを文書化する。