災害復旧とバックアップ
XenServerの災害復旧 (DR) 機能を使用すると、プール全体またはサイト全体を破壊するハードウェア障害から仮想マシン (VM) およびvAppを復旧できます。単一ホストの障害に対する保護については、高可用性を参照してください。
注:
DR機能を使用するには、rootアカウントでログインするか、Pool Operator以上の役割を持っている必要があります。
XenServer® DRについて
注:
DRは、サイトが地理的に分散している場合に適切な回復メカニズムです。データセンターが5ミリ秒未満の往復遅延と少なくとも10 Gbpsのネットワークスループットで接続されている場合(近接定義を満たす場合)、DRを必要とせずに単一のリソースプールとして運用できます。ただし、共有プールだけでは、データセンター全体の障害に対する回復性を提供するわけではありません。DRが必要かどうかは、プールのトポロジ、ストレージ構成、および回復目標によって異なります。
XenServer DRは、ビジネスに不可欠なVMおよびvAppを復旧するために必要なすべての情報をストレージリポジトリ (SR) に保存することで機能します。SRは、プライマリ (本番) 環境からバックアップ環境にレプリケートされます。プライマリサイトの保護されたプールがダウンした場合、セカンダリ (DR) サイトで再作成されたレプリケートされたストレージから、そのプール内のVMおよびvAppを、アプリケーションまたはユーザーのダウンタイムを最小限に抑えて復旧できます。
XenCenter®の災害復旧設定を使用して、災害時にストレージをクエリし、選択したVMおよびvAppを回復プールにインポートできます。VMが回復プールで実行されている場合、回復プールのメタデータもレプリケートされます。プールメタデータのレプリケーションにより、プライマリプールが回復したときに、VM設定の変更がプライマリプールに反映されます。場合によっては、同じVMの情報が複数の場所にあることがあります。たとえば、プライマリサイトからのストレージ、災害復旧サイトからのストレージ、およびデータがインポートされるプールなどです。XenCenterがVM情報が2つ以上の場所に存在することを発見した場合、最新の情報のみを使用するようにします。
災害復旧機能は、XenCenterおよびxe CLIで使用できます。CLIコマンドについては、災害復旧コマンドを参照してください。
ヒント:
災害復旧設定を使用して、災害復旧システムの非破壊テストのためにテストフェイルオーバーを実行することもできます。テストフェイルオーバーでは、すべての手順はフェイルオーバーと同じです。ただし、VMおよびvAppは、災害復旧サイトに復旧された後も起動されません。テストが完了すると、DRサイトで再作成されたすべてのVM、vApp、およびストレージを削除するためのクリーンアップが実行されます。
XenServer VMは2つのコンポーネントで構成されています。
-
VMによって使用される仮想ディスク。VMが配置されているプール内の構成済みストレージリポジトリ (SR) に保存されます。
-
VM環境を記述するメタデータ。この情報は、元のVMが利用できないか破損している場合にVMを再作成するために必要です。ほとんどのメタデータ構成データはVMの作成時に書き込まれ、VM構成を変更した場合にのみ更新されます。プール内のVMの場合、このメタデータのコピーはプール内のすべてのホストに保存されます。
DR環境では、プール内のすべてのVMおよびvAppに関するプールメタデータと構成情報を使用して、セカンダリサイトでVMが再作成されます。各VMのメタデータには、その名前、説明、ユニバーサル一意識別子 (UUID)、およびそのメモリ、仮想CPU、ネットワークおよびストレージ構成が含まれます。また、VM起動オプション(起動順序、遅延間隔、高可用性、再起動優先度)も含まれます。VM起動オプションは、高可用性またはDR環境でVMを再起動する際に使用されます。たとえば、ディザスタリカバリ中にVMを復旧する場合、vApp内のVMは、VMメタデータで指定された順序で、指定された遅延間隔を使用してDRプールで再起動されます。
DRインフラストラクチャの要件
XenServer DRを使用するには、プライマリサイトとセカンダリサイトの両方に適切なDRインフラストラクチャを設定します。
-
プールメタデータおよびVMが使用する仮想ディスクに使用されるストレージは、プライマリ(本番)環境からバックアップ環境にレプリケートする必要があります。ミラーリングの使用など、ストレージレプリケーションはデバイスによって異なります。したがって、ストレージレプリケーションの処理については、ストレージソリューションベンダーにご相談ください。
-
DRサイトのプールに復旧したVMとvAppが稼働した後、DRプールメタデータと仮想ディスクを含むSRをレプリケートする必要があります。レプリケーションにより、プライマリサイトがオンラインに戻ったときに、復旧したVMとvAppをプライマリサイトに復元(フェイルバック)できます。
-
DRサイトのハードウェアインフラストラクチャは、プライマリサイトと一致する必要はありません。ただし、XenServer環境は同じリリースおよびパッチレベルである必要があります。
-
セカンダリサイトのホストとプールは、プライマリサイトのホストと同じライセンスエディションである必要があります。これらのXenServerライセンスは、プライマリサイトのホストに割り当てられているライセンスに追加されます。
-
フェイルオーバーされたすべてのVMを再作成して起動できるように、ターゲットプールに十分なリソースが構成されている必要があります。
警告:
ディザスタリカバリ設定は、ストレージアレイの機能を制御しません。
ディザスタリカバリ機能のユーザーは、メタデータストレージが何らかの方法で2つのサイト間でレプリケートされていることを確認する必要があります。一部のストレージアレイには、レプリケーションを自動的に実現するための「ミラーリング」機能が含まれています。これらの機能を使用する場合、リカバリサイトでVMを再起動する前に、ミラー機能(「ミラーが破損している」)を無効にする必要があります。
展開に関する考慮事項
ディザスタリカバリを有効にする前に、次の手順を確認してください。
災害発生前に実行する手順
次のセクションでは、災害発生前に実行する手順について説明します。
-
VMとvAppを設定します。
-
VMとvAppがSRに、SRがLUNにどのようにマッピングされているかに注意してください。
name_labelとname_descriptionパラメーターの命名には特に注意してください。SRの名前がVMとvAppがSRに、SRがLUNにどのようにマッピングされているかを反映していれば、レプリケートされたストレージからVMとvAppを回復するのが容易になります。 -
LUNのレプリケーションを準備します。
-
これらのLUN上の1つ以上のSRに対して、プールメタデータのレプリケーションを有効にします。
-
プライマリプールメタデータをレプリケートするSRが、1つのプールにのみアタッチされていることを確認してください。
災害発生後の手順
以下のセクションでは、災害発生後に実行する手順について説明します。
-
既存のストレージミラーを解除して、リカバリサイトが共有ストレージへの読み取り/書き込みアクセス権を持つようにします。
-
VMデータを回復したいLUNが他のプールにアタッチされていないことを確認してください。そうしないと、破損が発生する可能性があります。
-
災害からリカバリサイトを保護したい場合は、リカバリサイト上の1つ以上のSRに対してプールメタデータのレプリケーションを有効にする必要があります。
回復後の手順
以下のセクションでは、データの回復が成功した後に実行する手順について説明します。
-
ストレージミラーを再同期します。
-
リカバリサイトで、プライマリサイトに戻したいVMまたはvAppを正常にシャットダウンします。
-
プライマリサイトで、前のセクションのフェイルオーバーと同じ手順に従って、選択したVMまたはvAppをプライマリにフェイルバックします。
-
将来の災害からプライマリサイトを保護するために、レプリケートされたLUN上の1つ以上のSRへのプールメタデータレプリケーションを再度有効にする必要があります。