Preloader
Производитель
Решение
новости
Дистрибуция решений по кибер-безопасности, развитию и оптимизации ИТ-технологий для организаций любого масштаба
Oberig IT держит руку на пульсе ИТ-мира и предлагает самые актуальные новости по кибер-безопасности
11 сентября, 2024

Пошаговое руководство по созданию плана аварийного восстановления

Подробности

В наше время, когда не самые приятные новости стали нормой, трудно удивляться, когда надвигается кризис. Хотя мы продолжаем надеяться на лучшее, мы все привыкли ожидать худшего. Именно поэтому наличие готового плана аварийного восстановления крайне важно.

Комплексный план восстановления позволит свести к минимуму влияние стихийного бедствия на непрерывность бизнеса, соблюдение нормативных требований и потерю данных. Хороший план также поможет ускорить восстановление после кибератак, подобных тем, что недавно обрушились на Ticketmaster, AT&T и Dell.

Если план аварийного восстановления вашей организации устарел, недостаточен или, что еще хуже, не существует, пусть эти события побудят вас пересмотреть или создать стратегию аварийного восстановления сейчас, пока она вам не понадобилась.

Итак, что такое план аварийного восстановления и что он должен включать?

Вот восемь шагов по созданию плана аварийного восстановления, который поможет предотвратить потерю данных, обеспечить непрерывность бизнеса, а также гарантировать соответствие требованиям конфиденциальности данных и SLA.

Шаг 1: Создайте группу реагирования на стихийные бедствия и задокументируйте обязанности

Во время кризиса ваша группа реагирования на стихийные бедствия будет возглавлять работу по восстановлению и распространять информацию среди сотрудников, клиентов и заинтересованных сторон.

Назначьте каждому члену команды конкретные задачи по реагированию и задокументируйте их, чтобы все знали, кто за что отвечает. Вам также понадобится резервный персонал для ключевых членов команды, если назначенный руководитель не будет доступен во время кризиса.

Шаг 2: Установите четкие RTO и RPO

Одним из наиболее важных компонентов плана аварийного восстановления данных является определение целей по времени восстановления (RTO) и точке восстановления (RPO).

RTO – это время, в течение которого приложение может не работать, прежде чем это негативно скажется на вашем бизнесе. RTO сильно варьируется между приложениями, поскольку некоторые из них могут не работать всего несколько секунд, прежде чем это скажется на бизнесе, клиентах или пользователях. Другие, напротив, могут простаивать часами, днями или неделями.

RTO рассчитывается в зависимости от важности приложения:

  • RTO около нуля: Критически важные приложения, которые должны быть отказоустойчивыми
  • RTO от четырех часов: Менее критичные, поэтому есть время для восстановления на месте с «голого железа»
  • RTO от восьми и более часов: Несущественные приложения, которые могут простаивать неопределенное время

Цель точки восстановления (RPO) – это наибольшее количество данных, которое может быть потеряно до того, как вашему бизнесу будет нанесен значительный ущерб. Этот компонент плана аварийного восстановления ИТ-системы определяет, как часто вам нужно будет создавать резервные копии данных.

Сумма, которую вы готовы потратить на резервное копирование того или иного приложения, также играет важную роль, поскольку вы стремитесь контролировать расходы на ИТ:

  • RPO около нуля: Использование непрерывной репликации (критически важные данные). Это требование требует эффективных решений по обеспечению непрерывности бизнеса, которые практически исключают простои.
  • RPO от четырех часов: Используйте репликацию моментальных снимков по расписанию.
  • RPO от 8 до 24 часов: Использование существующего решения для резервного копирования (данные, которые потенциально могут быть воссозданы из других хранилищ).

Шаг 3: Составьте чертеж сетевой инфраструктуры

Создание подробной документации сетевой инфраструктуры значительно облегчит восстановление системы после катастрофы, особенно если сеть была повреждена кибератакой.

Различные компоненты системы имеют разный уровень важности для обеспечения непрерывности бизнеса, поэтому обязательно укажите приоритет каждой службы как критически важной, важной или несущественной, чтобы их можно было восстановить в соответствующем порядке. Не забудьте включить в план системные зависимости, поскольку они могут повлиять на приоритетность восстановления.

Шаг 4: Выбор решения для аварийного восстановления

Емкость хранилища, сроки восстановления и сложность конфигурации влияют на стоимость решения для аварийного восстановления. Во многих случаях вы выбираете между решением, которое обеспечивает быстрое восстановление данных, но может потерять несколько дней, и решением, которое поддерживает доступность системы, но убивает вас высокой сложностью и затратами.

Обратите внимание на решение для аварийного восстановления, такое как Arcserve Unified Data Protection (UDP), которое позволяет недорого защитить ваши системы и приложения от потери данных. Arcserve также минимизирует сложности, упрощая управление резервным копированием, аварийным восстановлением и восстановлением соглашений об уровне обслуживания.

Шаг 5: Создайте контрольный список критериев для запуска плана реагирования на стихийные бедствия

Только некоторые инциденты требуют полномасштабного развертывания плана реагирования на катастрофы. Создание контрольного списка критериев для определения того, что является катастрофой, поможет вашей команде восстановления понять, когда пора приступать к действиям, не тратя ресурсы и деньги впустую, реагируя на незначительную угрозу.

Например, временное отключение электричества и прямое попадание урагана четвертой категории требуют совершенно разных мер реагирования.

Шаг 6: Документируйте процесс аварийного восстановления

Чтобы обеспечить быстрое восстановление данных и операций после катастрофы, создайте пошаговые инструкции на доступном языке, чтобы ваша команда могла приступить к восстановлению после катастрофы сразу же, как только станет безопасно.

Храните копию плана аварийного восстановления вдали от сети или в неизменяемом хранилище, чтобы защитить ее от повреждения во время атаки вымогательства или физической потери в результате стихийного бедствия.

Шаг 7: Тестирование плана аварийного восстановления

Регулярно тестируйте план аварийного восстановления, чтобы убедиться в его работоспособности в случае необходимости. Два раза в год проводите тест частичного восстановления и ежегодно – симуляцию полного восстановления.

Также не помешает периодически устраивать внезапные учения, чтобы вы могли точно оценить, насколько хорошо будут работать процессы в реальной чрезвычайной ситуации.

Шаг 8: Регулярно пересматривайте и обновляйте планы обеспечения непрерывности бизнеса и аварийного восстановления

Ваш план аварийного восстановления бизнеса – это лишь часть общей стратегии обеспечения непрерывности бизнеса. Необходимо регулярно пересматривать и обновлять его, чтобы отразить организационные изменения и то, как они влияют на процесс восстановления.

Источник: Step-by-Step Guide to Creating a Disaster Recovery Plan

Свяжитесь с нами
Обратная связь со спикером