В ходе независимого глобального исследования, проведенного по заказу компании Arcserve, 95 % опрошенных лиц, принимающих решения в сфере ИТ (ITDM), заявили, что в их компании есть план аварийного восстановления. Это хорошая новость. Плохая новость заключается в том, что только 24 % заявили, что у них есть готовый, хорошо документированный, протестированный и обновленный план.
Arcserve интерпретирует эти показатели так, что почти все преследуют правильные цели. Проблема сводится к исполнению. Время, деньги и непонимание масштабов угроз, с которыми сегодня сталкиваются организации, также могут сыграть свою роль. Но эти угрозы реальны. В том же исследовании, проведенном по заказу Arcserve, 76 процентов ИТ-директоров сообщили, что их организация столкнулась с серьезной потерей критически важных данных.
Избежать потери данных и простоев в связи с вымогательством, утечкой данных и другими катастрофами сегодня необходимо каждому ИТ-специалисту. Это начинается с эффективного плана аварийного восстановления. Вот восемь основных элементов плана аварийного восстановления:
1. Инвентаризация всех активов
Подробная инвентаризация всех ИТ-активов – аппаратного и программного обеспечения, данных и сетевых ресурсов – является важнейшей отправной точкой для разработки эффективного плана аварийного восстановления. Проранжируйте активы по степени их важности для выполнения бизнес-функций. Это заложит основу для всесторонней оценки рисков.
2. Выполните комплексную оценку рисков
Прежде чем устранять угрозы, необходимо их выявить. Это начинается с тщательной оценки рисков, в ходе которой изучаются последствия инцидента для вашей организации. Важно отметить, что это итеративный и непрерывный процесс, учитывающий новые угрозы, изменения в вашей организации и новые технологии.
Вот шаги, которые необходимо предпринять для проведения комплексной оценки рисков:
- Оцените критические активы, включая физические активы, такие как оборудование центра обработки данных, и цифровые активы, включая данные, программные приложения и интеллектуальную собственность, чтобы определить приоритетность их восстановления.
- Определите все потенциальные угрозы, от землетрясений и наводнений до атак вымогателей и утечек данных, и оцените потенциальное воздействие каждой угрозы на вашу организацию.
- Оцените уровень риска и отнесите каждую угрозу к категории высокого, низкого или среднего воздействия, исходя из вероятности возникновения инцидента и потенциальных последствий.
- Проанализируйте существующие меры безопасности и стратегии аварийного восстановления, чтобы оценить их эффективность для смягчения последствий и определить необходимые улучшения.
- Определите роли и обязанности сотрудников при реагировании на стихийные бедствия и риск внутренних угроз.
3. Установите четкие цели восстановления
Цели по времени восстановления и цели по точкам восстановления (RTOs/RPOs) являются основными элементами вашего плана DR.
RTO – это максимальное время, в течение которого ваш бизнес может не работать, прежде чем последствия станут значительными. Вот области, которые следует учитывать при определении RTO:
- Проведите анализ воздействия на бизнес (BIA), чтобы понять операционные, финансовые и репутационные последствия простоя для каждого из ваших бизнес-процессов и определить приоритетность усилий по восстановлению.
- Проанализируйте нормативные и правовые требования, чтобы убедиться, что ваш RTO соответствует им.
- Оцените взаимозависимость бизнес-процессов и ИТ-систем, чтобы определить приоритетность наиболее важных для вашей деятельности.
- Оцените операционные возможности и доступность ресурсов, необходимых для выполнения RTO, включая резервное копирование данных, решения для восстановления и доступность персонала.
RPO – это максимально допустимый объем потери данных, который может понести ваша организация. Это определяет частоту резервного копирования, чтобы вы могли получить данные из самой последней точки восстановления резервной копии до инцидента. Вот области, которые следует учитывать при определении RPO:
- Определите критические данные, такие как финансовые и нормативные, которые могут потребовать более короткого RPO для минимизации потери данных.
- Поймите динамику изменения данных, чтобы создать резервную копию данных, которые меняются чаще, для соблюдения более короткого RPO, в то время как резервные копии относительно статичных данных создаются реже.
- Оцените решения для резервного копирования и восстановления данных, которые могут удовлетворить вашим RPO, и рассмотрите передовые решения, такие как Arcserve Unified Data Protection (UDP), которые могут сократить время простоя с нескольких дней до нескольких минут.
- Проведите анализ затрат и выгод, сопоставляя RPO и расходы, чтобы сбалансировать потребность в минимизации потери данных и финансовые последствия ее отсутствия.
- Проанализируйте юридические и нормативные требования, как и в случае с RTO, чтобы обеспечить их соблюдение.
4. Постройте эффективный план коммуникации
Эффективный план коммуникации гарантирует, что все заинтересованные стороны будут информированы, скоординированы и смогут правильно отреагировать после бедствия. Важнейшие компоненты вашего плана должны включать:
- Назначьте команду по кризисным коммуникациям, ответственную за управление всеми коммуникациями во время бедствия, включая людей, прошедших обучение кризисным коммуникациям и связям с общественностью, и пресс-секретаря, который будет выступать от имени организации.
- Установите цели коммуникации, определяющие порядок информирования заинтересованных сторон, координации усилий по реагированию и предоставления обновленной информации о ходе восстановления.
- Определите внутренние и внешние заинтересованные стороны и разработайте коммуникационные стратегии для каждой аудитории.
- Установите каналы связи, такие как текстовые сообщения, электронная почта, социальные сети, интранет компании и системы аварийного оповещения, которые вы будете использовать во время бедствия, и учтите, те, у которых может не быть доступа к сетям компании.
- Создайте заранее определенные ключевые сообщения и шаблоны для различных сценариев, чтобы ускорить реагирование на бедствие. Они должны охватывать первоначальные уведомления, обновления и решение проблем.
- Составьте полные списки контактов всех заинтересованных сторон, регулярно проверяйте и обновляйте их, а также обеспечьте их надежное хранение и доступность в случае бедствия.
- Регулярно проверяйте и тестируйте свой план с помощью учений по восстановлению после катастрофы, чтобы убедиться в его эффективности в случае необходимости.
5. Установите правила координации работы с партнерами и поставщиками
Когда случается катастрофа, последствия выходят за рамки вашей организации. Вы также должны координировать свои действия с партнерами и поставщиками, чтобы обеспечить бесперебойный процесс восстановления. К числу таких шагов относятся:
- Определите критически важных поставщиков и партнеров, таких как поставщики облачных сервисов, программного обеспечения, оборудования и сторонних услуг, необходимых для ведения бизнеса.
- Определите обязанности и роль каждого поставщика в вашем плане DR, включая конкретные услуги по восстановлению, которые они предоставляют, соглашения об уровне обслуживания (SLA), которые они поддерживают в отношении времени восстановления, и любые услуги поддержки, которые они предлагают во время катастрофы.
- Изучите контракты на предмет наличия в них пунктов о DR, чтобы понимать обязательства, гарантии бесперебойной работы и компенсации в случае невыполнения оговоренных SLA.
6. Внедрите комплексную стратегию резервного копирования
Для обеспечения эффективного аварийного восстановления необходим безотказный подход к резервному копированию данных. Стратегия резервного копирования 3-2-1-1 – это проверенное решение. Эта стратегия основана на хранении нескольких копий данных в разных местах и хранении как минимум одной версии резервных копий в неизменяемом формате, когда данные записываются только один раз и не могут быть изменены или удалены.
7. Определите роли и обязанности
Ваш план также должен включать четко определенные роли и обязанности для команды кризисных коммуникаций, команды аварийного восстановления и других ключевых сотрудников. Каждый должен знать свои обязанности до, во время и после катастрофы, чтобы исключить путаницу и обеспечить эффективное восстановление. Регулярные тренировки и учения необходимы для того, чтобы все были подготовлены, четко знали свои роли и были готовы действовать в случае необходимости.
8. Регулярно тестируйте и обновляйте свой план
Единственный способ убедиться в эффективности плана аварийного восстановления – регулярное тестирование. Как показало исследование, проведенное при поддержке Arcserve, именно в этом направлении большинству организаций необходимо совершенствоваться. Тестирование должно имитировать различные сценарии, после чего следует оценка готовности команды и внесение изменений в план.
Источник: 8 Must-Have Components of an Effective Disaster Recovery Plan
