への移行におけるリスクの軽減およびロールバック戦略 IBM Cloud VPC
IBM Cloud VPC への移行に伴うリスク(ネットワーク障害、データの破損、パフォーマンスの問題など)を軽減し、ロールバック手順を導入します。
一般的な移住リスク
以下の情報は、移行後に遭遇する可能性のある一般的な問題をカバーしています。
リスク:ネットワーク接続障害
症状:移行後、仮想サーバーが他のシステムと通信できない。
検出:移行後の接続性テストが失敗する
修正する:
- トラブルシューティングのために、Virtual Network Computing(VNC)コンソール経由でアクセスする
- 仮想ネットワークインターフェース(VNI)の設定(IPアドレス、セキュリティグループ)を確認する
- VPCのルーティングテーブルをチェックし Transit Gateway
- セキュリティグループのルールを見直す(VPCのフローログを使って、ドロップされたパケットを確認する)
ロールバック: VMware 仮想サーバーを再起動し、DNS とロードバランサーを更新して VMware を指すようにします。
予防だ:
- 移行前に Transit Gateway の接続性を徹底的にテストする
- セキュリティグループルールが必要なトラフィックを許可していることを確認する
- ターゲットVPCのDNS解決をテストする
リスク:アプリケーションが起動しない
症状 :移行後にアプリケーションサービスが起動しない、または起動しても機能しない。
検出 :サービスが起動しないか、起動してもヘルスチェックに失敗する。
修正 :
- アプリケーションのログを確認してエラーがないか確認してください
- 設定ファイルの検証
- 環境変数のチェック
- データベース接続の確認
- ライセンスの問題をチェックする
ロールバック :VPCでアプリケーションを停止し、 VMware 環境で再起動する。
予防 :
- すべての依存関係が移行されていること、または Transit Gateway からアクセスできることを確認する。
- パイロット波にあるアプリケーションの起動手順をテストする。
- 調整が必要と思われるアプリケーション固有の設定を文書化する。
リスク:データ破損
症状 :破損したデータ、ファイルシステムのエラー、またはアプリケーションデータの不整合。
検出ファイルシステムチェックエラー、アプリケーションがデータエラーを報告、データベースが起動しない
修正 :
- ファイルシステムの修復を試みる
- 修復に失敗した場合は、移行元の仮想サーバーからの移行を再試行します
- ソース仮想サーバーがクリーンにシャットダウンされたことを確認します
ロールバックします:移行を再試行する前に、破損したVPC仮想サーバーを破棄して移行元の仮想サーバーを再起動し、根本的な原因を調査します。
予防 :
- 移行前に仮想サーバーをクリーンにシャットダウン
- 可能であれば、チェックサムで転送を検証する
- ボリュームをデタッチする前に
blockdev --flushbufsを使用する
リスク:パフォーマンス低下
症状 :アプリケーションのパフォーマンスがVPCの方が VMware より悪い。
検出 :応答時間の増加とスループットの低下
修正 :
- CPU、メモリ、ディスクI/O、ネットワーク帯域幅メトリクスのチェック
- ストレージプロファイルに十分なIOPSがあることを確認する
- インスタンスプロファイルに十分なネットワーク帯域幅があることを確認する
- アプリケーション設定の問題をチェックする
- インスタンスまたはストレージプロファイルのアップグレードを検討する
ロールバック :クリティカルな場合は、パフォーマンスを調査する間、 VMware にフェイルバックする。
予防 :
- VMware、移行前のベースライン・パフォーマンス
- ベースラインに基づいて、適切なインスタンスとストレージのプロファイルを選択する
- プールされたストレージ帯域幅の割り当てを有効にする
ロールバック戦略設計
ロールバックが必要かどうかは、以下の基準で判断する。
- ウェーブ内の20%以上の仮想サーバーが起動しない
- 重要なアプリケーションが機能テストに失敗
- 移行した仮想サーバーで破損したデータが見つかる
- ベースラインから50%以上のパフォーマンス低下
- セキュリティグループの設定ミスで機密サービスが漏洩
ロールバックの決定権
- ロールバックを決定できる人を定義する
- 意思決定者の意見が一致しない場合のエスカレーション・パスの定義
- タイムボックス・ロールバックの決定
ロールバック手順
以下のセクションでは、ロールバック手順のフェーズについて説明する。
フェーズ 1 ロールバック手順の使用
移行中に仮想サーバーが作成される前に、以下の手順に従ってフェーズ 1 のロールバック手順を使用してください。 この作業には30分ほどかかる。
- 移住を止める。
- ワーカー仮想サーバーとボリュームを破棄する。
- VMware の仮想サーバーを再起動します。
- 更新状況の連絡。
フェーズ 2 ロールバック手順の使用
移行中に作成された仮想サーバーがDNSカットオーバーされる前に、以下の手順に従ってフェーズ2のロールバック手順を実行します。 この作業には1時間ほどかかる。
- 移行した仮想サーバーを停止して削除します。
- VMware の仮想サーバーを再起動します。
- VMware 仮想サーバーが機能していることを確認する。
- 更新状況の連絡。
フェーズ 3 ロールバック手順の使用
移行中にDNSが切り替わると、データが変更される可能性があります。 フェーズ3のロールバック手順を使用するには、以下の手順を実行する。 データサイズにもよるが、この処理には2〜4時間かかる。
- 仮想サーバーを停止するが、削除はしない。
- DNSとロードバランサーを更新し、 VMware を指すようにする。
- VMware の仮想サーバーを再起動します。
- データ決定:
- データに変更がなければ、ロールバックを続行する。
- VPCでデータが変更された場合、ロールバックする前に VMware。
- 必要に応じてデータを同期する。
- VMware 仮想サーバーが機能していることを確認する。
- 検証期間終了後、VPC仮想サーバーを削除する
ソース仮想サーバーの保存
ソース仮想サーバーが保存されていることを確認するには、以下の情報を使用します。
- 移行後すぐに VMware 仮想サーバーを削除しないでください。
- 保有期間はリスク許容度に応じて7~30日。
- VMware スナップショットを作成する。
- スナップショットの場所と保存ポリシーを文書化する。