Recuperación ante desastres (DR)
La función de recuperación ante desastres (DR) le permite recuperar máquinas virtuales y vApps de un fallo catastrófico de hardware que inhabilita o destruye un grupo o sitio completo.
Para protegerse contra fallos de un solo servidor, puede usar Alta disponibilidad. La alta disponibilidad reinicia las máquinas virtuales en un servidor alternativo en el mismo grupo.
Comprender la DR
La recuperación ante desastres almacena toda la información necesaria para recuperar sus máquinas virtuales y vApps críticas para el negocio en repositorios de almacenamiento (SR). Estos repositorios de almacenamiento se replican luego desde su entorno principal (producción) a un entorno de respaldo. Cuando falla un grupo protegido en su sitio principal, las máquinas virtuales y vApps de ese grupo se pueden recuperar del almacenamiento replicado y recrear en un sitio secundario (DR). El resultado es un tiempo de inactividad mínimo de la aplicación o del usuario.
Una vez que las máquinas virtuales recuperadas están en funcionamiento en el grupo de DR, los metadatos del grupo de DR también deben guardarse en un almacenamiento replicado. Esta acción permite restaurar las máquinas virtuales y vApps recuperadas al sitio principal cuando este vuelve a estar en línea.
Nota:
La recuperación ante desastres solo se puede usar con tipos de almacenamiento LVM sobre HBA o LVM sobre iSCSI.
Las máquinas virtuales de XenServer® constan de dos componentes:
- Discos virtuales que están siendo utilizados por la máquina virtual, almacenados en repositorios de almacenamiento (SR) configurados en el grupo donde se encuentran las máquinas virtuales.
- Metadatos que describen el entorno de la máquina virtual. Los metadatos contienen toda la información necesaria para recrear la máquina virtual si la máquina virtual original no está disponible o está dañada. La mayoría de los metadatos se escriben cuando se crea la máquina virtual y solo se actualizan cuando se cambia la configuración de la máquina virtual. Para las máquinas virtuales en un grupo, se almacena una copia de estos metadatos en cada servidor del grupo.
En un entorno de DR, las máquinas virtuales se recrean en un sitio secundario (DR) a partir de los metadatos del grupo: información de configuración sobre todas las máquinas virtuales y vApps del grupo. Los metadatos de cada máquina virtual incluyen su nombre, descripción e identificador único universal (UUID), y su configuración de memoria, CPU virtual, red y almacenamiento. También incluye las opciones de inicio de la máquina virtual utilizadas al reiniciar la máquina virtual en un entorno de alta disponibilidad o DR: orden de inicio, intervalo de retardo y prioridad de reinicio. Por ejemplo, al recuperar máquinas virtuales, las máquinas virtuales dentro de una vApp se reinician en el grupo de DR en el orden y con los intervalos de retardo especificados en los metadatos.
Nota:
Para usar la recuperación ante desastres, debe haber iniciado sesión como root o tener un rol de Operador de grupo o superior.
Terminología de recuperación ante desastres
vApp: Un grupo lógico de máquinas virtuales relacionadas que se gestionan como una única entidad.
Sitio: Un grupo físico de pools de recursos de XenServer, almacenamiento y equipos de hardware.
Sitio principal: Un sitio físico que ejecuta máquinas virtuales o vApps que deben protegerse en caso de desastre.
Sitio secundario, sitio de DR: Un sitio físico cuyo propósito es servir como ubicación de recuperación para el sitio principal, en caso de desastre.
Conmutación por error (Failover): Recuperación de máquinas virtuales y vApps en un sitio secundario (de recuperación) en caso de desastre en el sitio principal.
Restauración (Failback): Restauración de máquinas virtuales y vApps de vuelta al sitio principal desde un sitio secundario (de recuperación).
Conmutación por error de prueba: Una conmutación por error “en seco” donde las máquinas virtuales y las vApps se recuperan del almacenamiento replicado a un pool en un sitio secundario (de recuperación) pero no se inician. Las conmutaciones por error de prueba se pueden ejecutar para verificar que la DR esté configurada correctamente y que sus procesos sean efectivos.
Metadatos del pool: Información sobre las máquinas virtuales y las vApps en el pool, como su nombre y descripción. Para las máquinas virtuales, la información de configuración incluye UUID, memoria, CPU virtual, configuración de red y almacenamiento, y opciones de inicio. Los metadatos del pool se utilizan en la DR para recrear las máquinas virtuales y las vApps del sitio principal en un pool de recuperación en el sitio secundario.
Infraestructura de recuperación ante desastres
Para usar la recuperación ante desastres, configure la infraestructura de DR adecuada tanto en el sitio principal como en el secundario:
- El almacenamiento utilizado tanto para los metadatos del pool como para los discos virtuales utilizados por las máquinas virtuales debe replicarse desde su entorno principal (de producción) a un entorno de copia de seguridad. La replicación de almacenamiento, por ejemplo, mediante la duplicación, varía de un dispositivo a otro. Le recomendamos que utilice su solución de almacenamiento para gestionar la replicación del almacenamiento.
- Una vez que las máquinas virtuales y las vApps recuperadas estén en funcionamiento en un pool de su sitio de DR, replique los SR que contienen los metadatos del pool de DR y los discos virtuales. Esta acción permite que las máquinas virtuales y las vApps recuperadas se restauren de nuevo al sitio principal (restauradas) una vez que el sitio principal vuelva a estar en línea.
- La infraestructura de hardware de su sitio de DR no tiene por qué coincidir con la del sitio principal. Sin embargo, el entorno de XenServer debe tener el mismo nivel de versión y parche. Además, se deben configurar recursos suficientes en el pool de destino para permitir que todas las máquinas virtuales conmutadas por error se vuelvan a crear e iniciar.
Importante:
XenCenter® y el asistente de Recuperación ante desastres no controlan ninguna funcionalidad de la matriz de almacenamiento. Asegúrese de que los metadatos del pool y el almacenamiento utilizado por las máquinas virtuales que se van a reiniciar en caso de desastre se repliquen en un sitio de copia de seguridad. Algunas matrices de almacenamiento contienen funciones de duplicación para lograr la copia automáticamente. Si se utilizan estas funciones, deshabilite la funcionalidad de duplicación antes de que las máquinas virtuales se reinicien en el sitio de recuperación.
Conmutación por error, recuperación tras conmutación por error y prueba de conmutación por error con el asistente de Recuperación ante desastres
El asistente de Recuperación ante desastres simplifica la conmutación por error y la recuperación tras conmutación por error. Los pasos implicados en estos procesos se describen a continuación:
Failover
-
Elija un grupo de destino en su sitio de DR secundario al que desea recuperar sus máquinas virtuales y vApps.
-
Proporcione los detalles de los destinos de almacenamiento que contienen los SR replicados de su sitio principal. El asistente escanea los destinos y enumera todos los SR encontrados allí.
-
Seleccione los SR que contienen los metadatos y los discos virtuales para las máquinas virtuales y vApps que desea recuperar. El asistente escanea los SR y enumera todas las máquinas virtuales y vApps encontradas.
-
Seleccione qué máquinas virtuales y vApps desea recuperar en el sitio de DR. Especifique si desea que el asistente las inicie automáticamente una vez recuperadas, o si prefiere esperar e iniciarlas manualmente usted mismo.
El asistente realiza comprobaciones previas para asegurarse de que las máquinas virtuales y vApps seleccionadas se puedan recuperar en el grupo de DR de destino. Por ejemplo, el asistente comprueba que todo el almacenamiento requerido por las máquinas virtuales y vApps seleccionadas esté disponible.
Cuando las comprobaciones previas se completan y se resuelven los problemas, comienza el proceso de conmutación por error. Las máquinas virtuales y vApps seleccionadas se exportan del almacenamiento replicado al grupo de DR. La conmutación por error ha finalizado.
Failback
-
Elija el grupo de destino en su sitio principal al que desea restaurar las máquinas virtuales y vApps que se están ejecutando actualmente en el sitio de DR.
-
Proporcione los detalles de los destinos de almacenamiento que contienen los SR replicados de su sitio de DR. El asistente escanea los destinos y enumera todos los SR encontrados.
-
Seleccione los SR que contienen los metadatos y los discos virtuales para las máquinas virtuales y vApps que desea restaurar. El asistente escanea los SR y enumera todas las máquinas virtuales y vApps encontradas.
-
Seleccione qué máquinas virtuales y vApps desea restaurar en el sitio principal. Especifique si desea que el asistente las inicie automáticamente una vez recuperadas, o si prefiere esperar e iniciarlas manualmente usted mismo.
El asistente realiza entonces comprobaciones previas para asegurarse de que las máquinas virtuales y vApps seleccionadas se puedan recuperar en el grupo de destino del sitio principal. Por ejemplo, el asistente comprueba que todo el almacenamiento requerido por las máquinas virtuales y vApps seleccionadas esté disponible.
Cuando las comprobaciones previas se completan y se resuelven los problemas, comienza el proceso de recuperación. Las VM y vApp seleccionadas que se ejecutan en su sitio de DR se exportan desde el almacenamiento replicado de nuevo al grupo seleccionado en su sitio principal.
La recuperación ha finalizado.
Si el asistente de Disaster Recovery encuentra información para la misma VM en dos o más lugares, utiliza solo la información más reciente por VM. Por ejemplo, la información podría almacenarse en el almacenamiento del sitio principal, el almacenamiento del sitio de DR y en el grupo en el que se importan los datos.
Sugerencia:
Para facilitar la recuperación de VM y vApp, asigne un nombre a sus SR para indicar cómo se asignan sus VM y vApp a los SR, y los SR a las LUN.
También puede usar el asistente de Disaster Recovery para ejecutar conmutaciones por error de prueba para realizar pruebas no disruptivas de su sistema de recuperación ante desastres. En una conmutación por error de prueba, los pasos son los mismos que para una conmutación por error, pero las VM y vApp recuperadas se inician en un estado de pausa en el sitio de DR. Se realiza una limpieza cuando finaliza la prueba para eliminar todas las VM, vApp y el almacenamiento recreados en el sitio de DR. Para obtener más información, consulte Conmutación por error de prueba.