Переключение и возврат к исходному состоянию физических серверов, реплицированных в Azure

В этом руководстве описывается, как выполнить переключение на резервный сервер для локальных физических серверов, которые реплицируются в Azure с помощью Azure Site Recovery. После выполнения отказа вы вернетесь из Azure на локальную площадку, когда она будет доступна.

Перед началом работы

  • Узнайте о процессе переключения при аварийном восстановлении.
  • Если вы хотите переключить несколько машин, узнайте, как объединить машины в план восстановления.
  • Перед выполнением полного переключения на резервный сервер запустите тренировку по восстановлению после аварии , чтобы убедиться, что все работает должным образом.
  • Следуйте этим инструкциям, чтобы подготовиться к подключению к виртуальным машинам Azure после отработки отказа.

Запуск отработки отказа

Проверка свойств сервера

Проверьте свойства сервера и убедитесь, что он соответствует требованиям Azure для виртуальных машин Azure.

  1. В разделе Защищенные элементы щелкните Реплицированные элементы и выберите виртуальную машину.
  2. В области Реплицированный элемент находятся сводные данные о компьютере, в том числе состояние работоспособности и последние доступные точки восстановления. Щелкните Свойства, чтобы просмотреть дополнительные сведения.
  3. В Compute and Network можно изменить имя Azure, группу ресурсов, целевой размер, набор доступности и параметры управляемого диска.
  4. Вы можете просматривать и изменять параметры сети, включая сеть/подсеть, в которой будет находиться виртуальная машина Azure после отработки отказа, и IP-адрес, который будет назначен ей.
  5. В разделе Диски отображаются сведения об операционной системе и дисках данных на компьютере.

Переключение в случае отказа на Azure

  1. В разделе Параметры>Реплицированные элементы выберите компьютер и щелкните >Отработка отказа.

  2. В разделе Отработка отказа выберите точку восстановления, в которую будет выполнена отработка отказа. Можно выбрать один из следующих вариантов:

    • Latest: этот параметр сначала обрабатывает все данные, отправленные в Site Recovery. Он предоставляет самый низкий RPO (ЦТВ), так как виртуальная машина Azure, созданная после переключения, содержит все данные, реплицированные в Site Recovery при запуске переключения.
    • Последнее обработанное: этот параметр выполняет переключение на резервный компьютер на последнюю точку восстановления, обработанную Site Recovery. Этот вариант обеспечивает низкий показатель целевого времени восстановления, так как не требует времени на обработку данных.
    • Последняя точка восстановления, согласованная с приложением: эта опция позволяет переключить компьютер до последней обработанной Службой восстановления точки восстановления, согласованной с приложением.
    • Настраиваемая. Следует указать точку восстановления.
  3. Выберите Завершить работу машины перед началом переключения на резерв, если вы хотите, чтобы Site Recovery попыталась завершить работу исходного компьютера перед запуском переключения на резерв. Отказоустойчивость продолжается, даже если завершение работы не удастся. На странице Задания можно следить за процессом переключения.

  4. Если вы подготовились к подключению к виртуальной машине Azure, подключитесь к ней для проверки после аварийного переключения.

  5. После проверки подтвердите переключение. При этом будут удалены все доступные точки восстановления.

Предупреждение

Не отменяйте переключение в случае отказа во время выполнения. Перед началом переключения на резервную систему репликация машины останавливается. Если отменить переключение на резервный канал, оно останавливается, но машина больше не будет реплицировать данные. Дополнительная обработка отказа физических серверов может длиться 8–10 минут.

Автоматизировать действия во время аварийного переключения

Возможно, вы захотите автоматизировать действия во время аварийного переключения. Для этого можно использовать сценарии или модули Runbook службы автоматизации Azure в планах восстановления.

  • Узнайте о создании и настройке планов восстановления, включая добавление сценариев.
  • Узнайте о добавлении наборов заданий Cлужба автоматизации Azure в планы восстановления.

Настройка параметров после переключения на резерв

После отработки отказа необходимо настроить параметры Azure для подключения к реплицированным виртуальным машинам Azure. Кроме того, настройте внутренние и общедоступные IP-адреса.

Подготовка к повторной защите и откату

Примечание.

Windows Server 2008, 2008 R2, 2012 и 2012 R2 достигли окончания поддержки (EOS). Просмотрите, как вы используете операционную систему, и планируйте её обновления и миграции соответственно. Дополнительные сведения см. в разделе "Окончание поддержки"

После отработки отказа на Azure необходимо повторно защитить виртуальные машины Azure путем репликации их на локальный сайт. Затем, после репликации, вы можете вернуть их на локальный сайт, выполнив переключение с Azure на вашу локальную инфраструктуру.

  1. Физические серверы, реплицированные в Azure с помощью Site Recovery, могут возвращаться в рабочее состояние только как виртуальные машины VMware. Для возврата к исходной системе вам требуется инфраструктура VMware. Выполните действия, описанные в этой статье , для подготовки к повторной защите и откату, включая настройку сервера процесса в Azure, а также главный целевой сервер на месте и настройку VPN типа "сеть — сеть" или частного пиринга ExpressRoute для отката.
  2. Убедитесь, что локальный сервер конфигурации запущен и подключен к Azure. Во время переключения при отказе на Azure локальный сайт может быть недоступен, а сервер конфигурации может быть недоступен или отключен. Во время возврата к штатной работе виртуальная машина должна существовать в базе данных сервера конфигурации. В противном случае откат системы неудачен.
  3. Удалите все моментальные снимки на локальном главном целевом сервере. Репротекция не будет работать, если существуют снимки. Во время выполнения задания повторной защиты моментальные снимки на виртуальной машине автоматически объединяются.
  4. Если вы повторно защищаете виртуальные машины, собранные в группу репликации для согласованности нескольких виртуальных машин, убедитесь, что все они имеют одну и ту же операционную систему (Windows или Linux) и убедитесь, что развернутый главный целевой сервер имеет тот же тип операционной системы. Все виртуальные машины в группе репликации должны использовать тот же главный целевой сервер.
  5. Откройте необходимые порты для возврата после отказа.
  6. Перед восстановлением убедитесь, что подключен сервер vCenter. В противном случае отключение дисков и их присоединение к виртуальной машине завершится сбоем.
  7. Если сервер vCenter управляет виртуальными машинами, для которых вы будете выполнять возврат, убедитесь в наличии требуемых разрешений. Если вы выполняете обнаружение только для чтения в vCenter и защищаете виртуальные машины, защита завершается успешно, и функция аварийного переключения работает. Однако во время повторного включения защиты происходит сбой отработки отказа, так как невозможно обнаружить хранилища данных, и они не указаны во время повторной защиты. Чтобы устранить эту проблему, можно обновить учетные данные vCenter с помощью подходящего аккаунта/разрешений, а затем повторить задание.
  8. Если вы использовали шаблон для создания virtual machines, убедитесь, что каждая виртуальная машина имеет собственный идентификатор UUID для дисков. Если UUID локальной виртуальной машины совпадает с UUID главного целевого сервера, поскольку оба созданы из одного и того же шаблона, повторная защита не удаётся. Выполните развертывание из другого шаблона.
  9. Если вы переключаетесь на альтернативный сервер vCenter Server, убедитесь, что новый сервер vCenter и главный целевой сервер обнаружены. Как правило, если они не являются хранилищами данных, они недоступны или не отображаются в списке повторной защиты.
  10. Убедитесь в следующих сценариях, в которых невозможно выполнить восстановление после сбоя:
    • Если вы используете бесплатный выпуск ESXi 5.5 или бесплатный выпуск vSphere 6 Hypervisor. Выполните обновление до другой версии.
    • Если у вас есть физический сервер Windows Server 2008 R2 с пакетом обновления 1 (SP1).
    • Виртуальные машины, которые были перенесены.
    • Виртуальная машина, которая была перемещена в другую группу ресурсов.
    • Копия виртуальной машины Azure, которая была удалена.
    • Реплика виртуальной машины Azure, которая не защищена (репликация на локальной площадке).
  11. Изучите типы откатов, которые можно использовать, — возврат к изначальному расположению и возврат к альтернативному расположению.

Повторная защита виртуальных машин Azure в альтернативное расположение

Эта процедура предполагает, что локальная виртуальная машина недоступна.

  1. В хранилище, в разделе >Параметры — >Реплицированные элементы, щелкните правой кнопкой мыши на машине, на которой произошел отказ, и выберите >Восстановление защиты.
  2. В Re-protect убедитесь, что выбран параметр Azure на локальный сервер.
  3. Укажите локальный главный целевой сервер и сервер обработки.
  4. В поле Хранилище данных выберите главное целевое хранилище данных, для которого нужно восстановить диски локальной среды. Используйте этот параметр, если локальная виртуальная машина удалена или не существует, и вам нужно создать новые диски. — Этот параметр игнорируется, если диски уже существуют, но необходимо указать значение.
  5. Выберите основной целевой диск для резервного копирования. Политика аварийного восстановления выбирается автоматически.
  6. Нажмите кнопку ОК, чтобы начать процесс повторной защиты. Задание начинает реплицировать виртуальную машину Azure на локальный сайт. Ход выполнения операции можно отслеживать на вкладке Задания .

Примечание.

Если вы хотите восстановить виртуальную машину Azure на существующую локальную виртуальную машину, подключите хранилище данных локальной виртуальной машины с доступом на чтение и запись на хосте ESXi основного целевого сервера.

Возврат после отказа из Azure

Выполните отработку отказа следующим образом:

  1. На странице Реплицированные элементы щелкните правой кнопкой мыши по машине и выберите пункт >Незапланированное переключение.
  2. В Подтверждении переключения убедитесь, что направление переключения осуществляется из Azure. 3. Выберите точку восстановления, которую хотите использовать для отказоустойчивости.
    • Рекомендуется использовать последнюю точку восстановления. Точка согласованности с приложением находится позади последней точки во времени, что вызывает потерю некоторых данных.
    • Последняя точка восстановления является отказоустойчивой точкой восстановления.
    • При выполнении отработки отказа Site Recovery выключает виртуальные машины Azure и включает локальную виртуальную машину. Будет некоторое время простоя, поэтому выберите подходящее время.
  3. Щелкните машину правой кнопкой мыши, а затем выберите пункт Зафиксировать. Это запускает задание, которое удаляет виртуальные машины Azure.
  4. Убедитесь, что виртуальные машины Azure были выключены, как ожидалось.

Повторная защита локальных машин в Azure

Теперь данные должны быть восстановлены на локальном сайте, но они не реплицируются в Azure. Вы можете снова начать репликацию в Azure следующим образом:

  1. В хранилище в разделе >Параметры>Реплицированные элементы выберите откатившиеся виртуальные машины и нажмите Повторная защита.
  2. Выберите сервер обработки, используемый для отправки реплицированных данных в Azure, и щелкните OK.

Следующие шаги

После завершения задания повторной защиты локальная виртуальная машина реплицируется в Azure. По мере необходимости можно запустить очередное переключение на резерв для Azure.