Обеспечение непрерывности бизнес-процессов и управление кризисными ситуациями
Бизнес в XXI веке немыслим без информационных технологий. Это мощный двигатель экономики, но в то же время и источник рисков. Непрерывность бизнес-процессов «завязана» на бесперебойности работы ИТ-сервисов. Их отказ грозит в лучшем случае простоями и финансовыми потерями, в худшем — катастрофическими последствиями. Какими средствами обеспечивается информационная безопасность и непрерывность бизнеса, читайте в нашем материале.
Составные элементы кризис-менеджмента: BCM, BCP, DRP
Чем больше используются в бизнесе информационные технологии, тем серьезнее он нуждается в обеспечении бесперебойности процессов. Это касается кредитно-финансовых, телекоммуникационных компаний, высокотехнологичных предприятий непрерывного производственного цикла, например атомных электростанций. Продуманная система кризис-менеджмента востребована в ритейле, электронной коммерции, государственном секторе — словом, практически везде, где критически важна непрерывность деловой активности.
Для ряда отраслей существуют специальные регламенты в отношении непрерывности бизнеса, которые должны соблюдаться для лицензирования деятельности.
Степень риска определяется теми последствиями, которыми грозит сбой в работе ИТ-сервисов. Например, для банков даже непродолжительный перерыв в деятельности чреват колоссальными материальными потерями. А если инцидент произойдет в авиакомпании или на предприятии ТЭК? Здесь уже под угрозой не только деньги — опасности подвергаются жизни людей.
Причины возникновения бизнес-рисков различны. Это и природные бедствия (вспомним ледяной дождь в Москве в 2010 году, экономический ущерб от которого для ОАО «МОЭСК» составил порядка 1,3 млрд рублей [1] ), и аварии в энергосистемах, не говоря уже о киберпреступлениях (их количество только в России ежегодно возрастает в три–четыре раза) [2] . В связи с многообразием рисков актуальность обеспечения информационной безопасности (ИБ) не вызывает сомнений.
Опрос, проведенный компанией DEAC в 2019 году, продемонстрировал ситуацию относительно рисков непрерывности бизнеса в российской деловой среде. Согласно результатам решения по обеспечению бесперебойности процессов наиболее востребованы в двух сферах — финансовой и информационной. В случае недоступности ИТ-систем 40% опрошенных смогут продолжать работу не более часа, 24% — не более минуты. Максимальную угрозу непрерывности бизнеса несут риски, связанные с информационной безопасностью и изменениями в законодательстве страны. Причем почти половина респондентов считает, что в ближайшее время эти риски будут только расти.
Существуют инструменты кризис-менеджмента, через которые реализуется общая информационная безопасность предприятия. Это специальные технологические дисциплины — BCM (BCP & DRP). Они «вытекают» из системы ИБ, наследуя ее методологию и следующие основные принципы:
- анализ рисков появления и влияния чрезвычайных ситуаций на деловые процессы и функции;
- контроль и управление инцидентами;
- стратегическое и тактическое планирование непрерывности информационно-коммуникационных технологий (ИКТ).
BCM (BCP & DRP) обеспечивают безопасность бизнеса в целом, что обозначено во многих международных, национальных и отраслевых стандартах. В частности, в ISO/IEC 27001, ISO 22301:2012. Первый международный стандарт посвящен вопросам ИБ в общем, второй касается конкретно применения BCM. Соответствие их требованиям следует учитывать при выборе дата-центра для хранения информации. Если же предполагается задействовать собственные ресурсы предприятия, стоит задуматься о внедрении данных стандартов — это станет залогом безопасности данных и непрерывности бизнес-процессов.
Однако рассматриваемые дисциплины не тождественны управлению ИБ, которое является для них лишь основой. Исторически начавшись с банального резервного копирования информации, система BCM постепенно охватила помимо вопросов ИБ практически все аспекты деловой активности, превратившись в целостную структуру взглядов на методы обеспечения непрерывности бизнеса — устойчивости организации к всевозможным сбоям, разрушениям и потерям, в первую очередь — финансовым.
Для справки
- BCM (Business Continuity Management) — управление непрерывностью бизнеса.
- BCP (Business Continuity Planning) — планирование непрерывности бизнеса.
- DRP (Disaster Recovery Planning) — план восстановления после сбоев.
Основные понятия, цели и задачи управления непрерывностью бизнеса
Приоритетные цели и задачи BCM зависят от масштаба и сферы деятельности. Во главу угла ставится управление определенным типом или классом взаимосвязанных инцидентов.
- Incident management (IM), или управление инцидентами, охватывает целый комплекс происшествий высокой и средней вероятности возникновения — человеческий фактор, сбой в работе оборудования и прочее. На этом уровне ущерб бизнесу сравнительно невелик. Задачи и цели IM — обеспечить сохранность, доступность, целостность информации, отказоустойчивость оборудования.
- Business continuity & disaster recovery management, или управление непрерывностью бизнеса и аварийным восстановлением, нацелено на предотвращение инцидентов, которые могут привести к приостановке работы всей организации или ее важнейших бизнес-процессов. Вероятность их невелика, но ущерб может оказаться внушительным, вплоть до банкротства. По данным исследования, проведенного компанией Veeam Software в 2019 году, ежегодные мировые потери от простоев приложений превышают 20 млн долларов, по России эта цифра немного ниже — 19,8 млн долларов [3] .
- Crisis & emergency management, или управление чрезвычайными (кризисными) ситуациями, ставит своей задачей предупреждение крайне редких, но катастрофических по последствиям инцидентов. Возможны экологические и гуманитарные катаклизмы, инфраструктурные разрушения в границах целого региона. Например, высокий уровень обеспечения непрерывности деятельности предприятий необходим в ТЭК (разведка, добыча, переработка углеводородов, производство электроэнергии).
На заметку
Ключевым понятием в управлении непрерывностью бизнеса (BCM) выступает «инцидент», под которым понимается любое незапланированное, внезапное происшествие, событие, ведущее к остановке ключевых, критичных процессов и функций, полной потере контроля над оборудованием.
О том, к каким драматическим последствиям для бизнеса может привести недооценка влияния инцидентов на непрерывность, красноречиво свидетельствуют следующие примеры.
12 мая 2017 года компьютеры по всему миру подверглись атаке вируса-вымогателя WannaCry. Он шифровал файлы на устройстве, а для восстановления доступа к ним требовал выкуп, причем неуплата в течение семи дней приводила к необратимой блокировке. Вредоносная программа атаковала более 200 стран, сильнее всего пострадали Россия, Украина, Индия и Тайвань. WannaCry парализовал работу больниц, аэропортов, заводов, банков, правительственных учреждений. Экономические потери от кибератаки составили около 4 млрд долларов [4] . Есть мнение, что в Агентстве Национальной Безопасности США были данные об уязвимости Windows, которые похитили и использовали злоумышленники. Таким образом, при надлежащем уровне предусмотрительности ущерб можно было предотвратить.
Полтора месяца спустя инцидент повторился, но уже с другой вредоносной программой: печально известный вирус Petya действовал аналогичным образом. Самые масштабные потери от него понесли российские и украинские компании [5] .
Внедрение и применение программ BCM позволило бы значительно сократить размеры потерь, а возможно, и вовсе избежать катастрофических происшествий. Управление непрерывностью бизнеса — залог сохранности вложенных владельцами и акционерами средств. Если основная площадка дата-центра в результате сбоя или по другой причине временно выйдет из строя, работа будет в кратчайшие сроки продолжена на резервной площадке.
Статистика
По данным The Impact of Catastrophes on Shareholder Value (Rory J. Knight и Deborah J. Pretty), кумулятивный доход сверх нормы (разница между ожидаемой и реальной стоимостью акций) компаний, успешно восстановивших деятельность после крупномасштабной аварии, через год составляет в среднем 10%. В то же время корпорации, не внедрившие BCM, получают те же 10% и даже 15%, но со знаком минус.
Этапы внедрения BCM
Управление непрерывностью бизнеса (BCM) начинается с определения стратегии и планирования. Одновременно используются инструменты риск-менеджмента (Risk Management, RM). Таким образом, внедрение системы BCM в организации означает комплексный и многоэтапный подход, подразумевающий освоение технических и программных средств, регламентацию действий, распределение ответственности, обучение персонала. Осуществить все это силами самой компании, мягко говоря, проблематично. Выход — обратиться за помощью к ИТ-экспертам. Они не только грамотно разработают план мероприятий и подберут оптимальные для компании решения, но и помогут воплотить проект системы в жизнь.
Анализ и оценка рисков
- Анализ бизнес-процессов (Business Environment Analysis, BEA). Характер рисков для различных организаций зависит от сферы и масштаба их деятельности. Например, в медицинском учреждении отказ системы учета пациентов не будет критичным, чего нельзя сказать о сбое в работе высокотехнологичного реанимационного оборудования. Отказ приложения для автоматизации совместной деятельности рабочих групп в телекоммуникационной компании, вероятно, к кризису не приведет, но вот сбой в системе биллинга, несомненно, обернется существенными финансовыми потерями. Эти примеры демонстрируют, что в разном бизнесе существуют специфичные точки критичности. Анализ бизнес-процессов позволяет выделить эти точки и ранжировать по степени влияния на непрерывность деловой активности компании.
- Анализ рисков (Risk Analysis, RA). Сами риски можно разделить на две группы: зависимые и независимые от ИТ (ИКТ). После того, как были проведены выделение и градация бизнес-процессов по важности влияния на бизнес, из этой иерархии необходимо выделить группу ИТ-зависимых бизнес-процессов. Но что может повлиять на их бесперебойность? Для ответа на этот вопрос следует проверить достаточность и действенность технических и организационных механизмов, направленных на предупреждение прерываний бизнес-процессов, выделить и оценить наиболее уязвимые точки и значимые угрозы. В итоге формируются группы рисков, влияющих на ИТ, разделенные по степени важности.
- Оценка воздействия на бизнес (Business Impact Analysis, BIA). На основе полученных данных составляется карта ключевых бизнес-процессов с указанием нарушений, способных привести к убыткам. Далее строится модель, иллюстрирующая связь между этими нарушениями и категориями (масштабами) возможных потерь, которые могут быть зафиксированы как количественно, так и качественно. К группам потерь могут относиться: деловая репутация, рыночная стоимость, уровень операционных издержек, возврат на инвестиции, штрафные санкции из-за нарушения контрактных обязательств и так далее. Для аналитиков крайне важно получить достоверную информацию о бизнесе организации, в особенности финансовую, узнать о текущем положении дел в ИТ-комплексе и планах его развития. Аналогичным образом следует провести детальный анализ информационных сервисов с привязкой к бизнес-процессам и информационным потокам. Результатом оценки возможного ущерба станет полноценная картина бизнеса, показывающая уровень критичности всех бизнес-процессов в целом, а также отдельных нарушений их функционирования в соотношении с величиной потерь. Все перечисленные выше задачи решаются в процессе аудита, который проводится аналитиками перед началом сотрудничества. В ходе такой всесторонней оценки четко вырисовываются слабые места в системе информационной безопасности клиента и становятся понятны способы укрепления уязвимых точек. Расчет экономического эффекта (стоимости простоя бизнес-процессов) предполагает наличие справедливых допущений о вероятности наступления тех или иных инцидентов в рассматриваемый период, что в дальнейшем позволяет выбрать наиболее приемлемую стратегию. В итоге собственники и руководство компании должны совместно с аналитиками определиться с установлением так называемых тайм-аутов и производительной мощности для отдельных бизнес-процессов на случай чрезвычайной ситуации, а именно:
- Допустимого времени восстановления (Recovery Time Objective, RTO), или интервала вынужденного простоя, который технически может быть сведен к секундам, но из-за дороговизны не всегда оправдывает себя экономически.
- Целевой точки восстановления (Recovery Point Objective, RPO), или временного диапазона перед наступлением ЧС, за который все данные могут быть утрачены. Сегодня он может быть сведен к нулю, так как все зависит от частоты и технологии резервного копирования информации.
- Уровня непрерывности бизнеса (Level of Business Continuity, LBC), или допустимого уровня производительности (доли нагрузки) в чрезвычайных ситуациях в процентах от режима штатной работы.

Планирование
Планирование — это динамический процесс, а не разовая процедура. Следует поддерживать планы в актуальном и «синхронизированном» состоянии. С этой целью их нужно регулярно тестировать, при необходимости дополняя свежими данными.
- Определение стратегии непрерывности бизнеса. Она должна затрагивать такие ключевые аспекты, как безопасность сотрудников, обеспечение их рабочими помещениями, техническими средствами и необходимыми материалами, доступ к критически важной информации, беспрепятственные коммуникации с партнерами, клиентами, поставщиками и подрядчиками. Для каждого направления вырабатывается отдельная подстратегия, призванная «указывать дорогу» к скорейшему восстановлению в соответствии с параметрами, определенными на этапах анализа рисков. Обеспечение непрерывности включает три стадии: реагирование на событие, продолжение выполнения критичных для бизнеса процессов в условиях ЧС, восстановление штатной работы.
- Выбор организационных и технических решений определяется стратегией BCM. Разрабатываются политики, которые формализуют приоритетные цели и задачи поддержания непрерывности бизнеса, процедуры реагирования и области распространения системы BCM, устанавливаются кадровые потребности и степень вовлеченности персонала в реализацию программы внедрения (проекта) BCM.
- Создание технической и организационной систем BCM. В настоящее время все более широкое распространение приобретают «облачные» услуги. Для защиты информации при помощи облака существует решение — DRaaS (Disaster-Recovery-as-a-Service). Его суть состоит в том, чтобы предоставлять в облачных средах корпоративного уровня услугу аварийного восстановления данных. Это позволяет снизить расходы на обеспечение безопасности, одновременно поддерживая ее на уровне принятых в индустрии стандартов. Предусмотрены разные варианты, но все они основаны на резервном копировании ИТ-инфраструктуры или наиболее критичных ее элементов:
- Резервные копии ИТ-инфраструктуры создаются по расписанию, заданному в соответствии с нужными RTO и RPO, и помещаются в хранилище. Восстановление занимает до нескольких часов. Такая схема подходит для малого бизнеса, где некритична непрерывность, но важны экономия и надежная сохранность данных. Однако комплексную защиту резервное копирование не обеспечивает.
- Инфраструктура копируется полностью, изменения в непрерывном режиме переносятся в облако, извлечение и восстановление информации происходит за минуты.
- Запускается резервная облачная инфраструктура, полностью идентичная основной. Обновления в них происходят синхронно. Восстановление возможно за несколько секунд. Решение актуально для крупных финансовых и ИТ-компаний, госсектора — для любых организаций, где нельзя терять ни минуты на простой.
Эффективность внедрения системы
Об эффективности внедрения ВСМ на предприятии будут свидетельствовать:
- Готовность организации к продолжению работы в случае возникновения аварий в ИТ-системах.
- Оцененная вероятность простоя (недоступности) информационных систем в случае возникновения внештатной ситуации и возможные убытки.
- Прохождение аудита и соответствие требованиям регулирующих органов.
Разумеется, силами самого предприятия обеспечить создание и эффективное внедрение системы — задача практически невыполнимая. Для этого потребуются огромные финансовые, кадровые и временные ресурсы, которые есть далеко не у каждой компании.
- 1 https://ria.ru/20121030/908026582.html
- 2 https://cyberleninka.ru/article/n/strahovanie-informatsionnyh-riskov-predpriyatiy-kak-instrument-risk-menedzhmenta-1/viewer
- 3 http://www.tadviser.ru/index.php/Статья:Потери_организаций_от_простоев_и_сбоев_ИТ-систем
- 4 https://tass.ru/mezhdunarodnaya-panorama/4374732
- 5 http://www.frontnews.eu/news/ru/7920
What Is a Business Continuity Plan (BCP), and How Does It Work?
Will Kenton is an expert on the economy and investing laws and regulations. He previously held senior editorial roles at Investopedia and Kapitall Wire and holds a MA in Economics from The New School for Social Research and Doctor of Philosophy in English literature from NYU.
Updated May 30, 2023
Reviewed by
Reviewed by David Kindness
David Kindness is a Certified Public Accountant (CPA) and an expert in the fields of financial accounting, corporate and individual tax planning and preparation, and investing and retirement planning. David has helped thousands of clients improve their accounting and financial systems, create budgets, and minimize their taxes.
Fact checked by
Fact checked by Pete Rathburn
Pete Rathburn is a copy editor and fact-checker with expertise in economics and personal finance and over twenty years of experience in the classroom.
:max_bytes(150000):strip_icc()/Terms-b-business-continuity-planning-99a6b0cc671b4d009d536127e246ec5d.jpg)
Trending Videos
What Is a Business Continuity Plan (BCP)?
A business continuity plan (BCP) is a system of prevention and recovery from potential threats to a company. The plan ensures that personnel and assets are protected and are able to function quickly in the event of a disaster.
Key Takeaways
- Business continuity plans (BCPs) are prevention and recovery systems for potential threats, such as natural disasters or cyber-attacks.
- BCP is designed to protect personnel and assets and make sure they can function quickly when disaster strikes.
- BCPs should be tested to ensure there are no weaknesses, which can be identified and corrected.
Understanding Business Continuity Plans (BCPs)
BCP involves defining any and all risks that can affect the company’s operations, making it an important part of the organization’s risk management strategy. Risks may include natural disasters—fire, flood, or weather-related events—and cyber-attacks. Once the risks are identified, the plan should also include:
- Determining how those risks will affect operations
- Implementing safeguards and procedures to mitigate the risks
- Testing procedures to ensure they work
- Reviewing the process to make sure that it is up to date
BCPs are an important part of any business. Threats and disruptions mean a loss of revenue and higher costs, which leads to a drop in profitability. And businesses can’t rely on insurance alone because it doesn’t cover all the costs and the customers who move to the competition. It is generally conceived in advance and involves input from key stakeholders and personnel.
Business impact analysis, recovery, organization, and training are all steps corporations need to follow when creating a Business Continuity Plan.
Benefits of a Business Continuity Plan
Businesses are prone to a host of disasters that vary in degree from minor to catastrophic. Business continuity planning is typically meant to help a company continue operating in the event of major disasters such as fires. BCPs are different from a disaster recovery plan, which focuses on the recovery of a company’s IT system after a crisis.
Consider a finance company based in a major city. It may put a BCP in place by taking steps including backing up its computer and client files offsite. If something were to happen to the company’s corporate office, its satellite offices would still have access to important information.
An important point to note is that BCP may not be as effective if a large portion of the population is affected, as in the case of a disease outbreak. Nonetheless, BCPs can improve risk management—preventing disruptions from spreading. They can also help mitigate downtime of networks or technology, saving the company money.
How to Create a Business Continuity Plan
There are several steps many companies must follow to develop a solid BCP. They include:
- Business Impact Analysis: Here, the business will identify functions and related resources that are time-sensitive. (More on this below.)
- Recovery: In this portion, the business must identify and implement steps to recover critical business functions.
- Organization: A continuity team must be created. This team will devise a plan to manage the disruption.
- Training: The continuity team must be trained and tested. Members of the team should also complete exercises that go over the plan and strategies.
Companies may also find it useful to come up with a checklist that includes key details such as emergency contact information, a list of resources the continuity team may need, where backup data and other required information are housed or stored, and other important personnel.
Along with testing the continuity team, the company should also test the BCP itself. It should be tested several times to ensure it can be applied to many different risk scenarios. This will help identify any weaknesses in the plan which can then be identified and corrected.
In order for a business continuity plan to be successful, all employees—even those who aren’t on the continuity team—must be aware of the plan.
Business Continuity Impact Analysis
An important part of developing a BCP is a business continuity impact analysis. It identifies the effects of disruption of business functions and processes. It also uses the information to make decisions about recovery priorities and strategies.
FEMA provides an operational and financial impact worksheet to help run a business continuity analysis. The worksheet should be completed by business function and process managers who are well acquainted with the business. These worksheets will summarize the following:
- The impacts—both financial and operational—that stem from the loss of individual business functions and process
- Identifying when the loss of a function or process would result in the identified business impacts
Completing the analysis can help companies identify and prioritize the processes that have the most impact on the business’s financial and operational functions. The point at which they must be recovered is generally known as the “recovery time objective.”
Business Continuity Plan vs. Disaster Recovery Plan
BCPs and disaster recovery plans are similar in nature, the latter focuses on technology and information technology (IT) infrastructure. BCPs are more encompassing—focusing on the entire organization, such as customer service and supply chain.
BCPs focus on reducing overall costs or losses, while disaster recovery plans look only at technology downtimes and related costs. Disaster recovery plans tend to involve only IT personnel—which create and manage the policy. However, BCPs tend to have more personnel trained on the potential processes.
Frequently Asked Questions
Why Is Business Continuity Plan (BCP) Important?
Businesses are prone to a host of disasters that vary in degree from minor to catastrophic and business continuity plans (BCPs) are an important part of any business. BCP is typically meant to help a company continue operating in the event of threats and disruptions. This could result in a loss of revenue and higher costs, which leads to a drop in profitability. And businesses can’t rely on insurance alone because it doesn’t cover all the costs and the customers who move to the competition.
What Should a Business Continuity Plan (BCP) Include?
Business continuity plans involve identifying any and all risks that can affect the company’s operations. The plan should also determine how those risks will affect operations and implement safeguards and procedures to mitigate the risks. There should also be testing procedures to ensure these safeguards and procedures work. Finally, there should be a review process to make sure that the plan is up to date.
What Is Business Continuity Impact Analysis?
An important part of developing a BCP is a business continuity impact analysis which identifies the effects of disruption of business functions and processes. It also uses the information to make decisions about recovery priorities and strategies.
FEMA provides an operational and financial impact worksheet to help run a business continuity analysis.
These worksheets summarize the impacts—both financial and operational—that stem from the loss of individual business functions and processes. They also identify when the loss of a function or process would result in the identified business impacts.
The Bottom Line
Business continuity plans (BCPs) are created to help speed up the recovery of an organization filling a threat or disaster. The plan puts in place mechanisms and functions to allow personnel and assets to minimize company downtime. BCPs cover all organizational risks should a disaster happen, such as flood or fire.
BCM — Business continuity management
Управление непрерывностью бизнеса

Рано или поздно перед каждой организацией встают вопросы: в какой степени критичен для нее тот или иной риск прерывания деятельности, как избежать этого риска или минимизировать его воздействие, что предстоит сделать заранее, как определить «золотую середину» между разумными инвестициями в превентивные меры и возможными потерями. Для решения многих поставленных вопросов предназначена технологическая дисциплина Business continuity management – BCM – управление непрерывностью бизнеса.
В условиях сложной взаимозависимой деятельности подразделений в рамках организации, зависимости организаций от контрагентов, доступности систем поддержки деятельности, обеспечение бесперебойной работы является одной из важных задач, стоящих перед руководством многих предприятий. Каждая из организаций сталкивалась, так или иначе, с различными причинами прерывания рабочей деятельности – в результате сбоев в подаче электричества, поставок, функционирования информационных и коммуникационных систем, недоступности офиса, ухода ключевых сотрудников, преднамеренных действий или ошибок персонала, а также пожаров, техногенных катастроф и т. п.
BCM — подход комплексный
BCM — это комплексный подход в управлении, направленный на определение потенциальных угроз для организации, проведение анализа их влияния на бизнес в случае реализации. Он обеспечивает основу для удержания организации в стабильном состоянии и возможности для эффективного реагирования на кризисные ситуации с целью защиты интересов собственников и заинтересованных сторон, репутации и наиболее существенных сфер бизнеса компании. BCM регулирует процессы восстановления после сбоев, программы обучения, тестирования, процедуры аудита и пересмотра мероприятий, процедур и планов непрерывности бизнеса (Business Continuity Plan — BCP) с целью подтверждения их соответствия текущим условиям и потребностям организации. В настоящее время основные стандарты в области ИТ и информационной безопасности (ИБ), включая CobiT, ITIL, ISO-27001, содержат разделы, связанные с обеспечением непрерывности бизнеса: первые два предназначены для ИТ, третий — ИБ. Имеется также стандарт BS ISO 25999, касающийся управления непрерывностью бизнеса. Среди множества известных в мире стандартов, в том числе NFPA1600 (США), HB221 и HB252 (Австралия), SPRING TR19 (Сингапур) и т. п.
Правильный проект
Примерно так выглядит «правильный» проект BCM одного из бизнес-процессов в ИТ.
Анализируются возможные чрезвычайные ситуации (ЧС) в разделе ИТ, их последствия. Определяется допустимый таймаут. После этого разрабатываются возможные сценарии ЧС, описываются классы важности ИТ-сервисов и стратегия их восстановления. Создается эскиз проекта.
Главный постулат – непрерывность бизнеса, обеспечивается в обязательном порядке.
Составляется план-график реализации проекта, рассчитываются стоимость и время исполнения проекта. Согласно планам производится модернизация служб ИТ, составляются планы аварийного восстановления и тестирования для нескольких систем.
Потом фаза тестирования. Выявлены недочеты – необходимо исправлять и вносить коррективы.
Следом приходит время бизнеса: составляется иерархия реагирования из трех составляющих — штатный, управления инцидентами и уровень восстановления деятельности. По мнению экспертов, в этих планах должны быть прописаны лишь минимально необходимые действия, которые нужно совершить после катастрофы. После создания резервных рабочих мест проводится комплексное тестирование с участием бизнес- и ИТ-подразделений.
Здесь приведен пример реального проекта, осуществленного в России. Он продолжался в течение двух лет. Эксперты считают, риски нужно оценивать, анализировать их влияние на бизнес, определять возможные финансовые потери. Это не простые процессы, но только так можно в дальнейшем оптимизировать затраты на организацию BCM.
Суть стратегии управления не только в определении общих требований — необходим разумный баланс: сколько тратить и от чего защищаться.
План «Б» для бизнеса

Что есть истинная непрерывность бизнеса? Даже самые защищенные системы и бизнес-процессы однажды могут не выстоять перед форс-мажорной ситуацией – будь то тайфун, пожар или человеческий фактор. Небольшие аварии часто приводят к отмене рейсов, остановке производств, сбоям работы серверов. И хотя кажется, что вероятность наступления аварии невелика, ущерб может быть фатальным для компании любого масштаба. В результате страдает и бизнес, и клиенты. А если это корневой элемент какой-либо более масштабной рыночной цепочки, то еще и другие компании.
Останется лишь гадать, откуда «бахнет» и сколько это будет стоить. Но ведь можно не гадать, а подготовить план «Б». Но какой из? BCP или DRP ?
BCP (business continuity plan) – план обеспечения непрерывности бизнеса. Или иными словами – детальный план поддержания и восстановления бизнес-процессов после незапланированной остановки, который предполагает множество сценариев событий. BCP должен учитывать все – от простых инцидентов до ЧС, кризиса и форс-мажоров. Частный и более технический случай BCP – план послеаварийного восстановления инфраструктуры или DRP (disaster recovery plan). На деле в этом плане учитывается любой ключевой элемент инфраструктуры вплоть до автомобиля. Но чаще всего речь именно об ИТ-инфраструктуре, так как ее отказ в обслуживании может стать критичным для бизнеса.
Оборудование в дата-центрах достаточно чувствительно к внешним факторам и при этом оно аккумулирует огромные объемы данных, зачастую очень ценные. Бэкапа данных и отказоустойчивой инфраструктуры с дублированием всех основных и сопроводительных систем ЦОДа может оказаться недостаточно. «Эффект бабочки» не церемонится ни с одной системой з ащиты, и известны случаи, когда в систему подачи энергии дата-центра влетал внедорожник, а аварийная система энергоснабжения не сумела продемонстрировать свои возможности из-за отказа вспомогательного оборудования – охладительных систем. Если у компании есть резервная инфраструктура, это еще полдела. Без плана послеаварийного восстановления и тестирования работы отказоустойчивой системы инвестиции в резервную инфраструктуру не отрабатывают на все 100%. Как говорится, на технологии надейся, но сам не плошай!
Документ DRP четко описывает последовательность действий по защите IT-инфраструктуры, устранению последствий аварии и восстановлению данных, списки ответственных сотрудников, их роли и обязанности.
DRP и BCP имеют много общего:
- готовятся на случай кризисной ситуации или катастрофы;
- служат для того, чтобы в кратчайшие сроки вернуть бизнес на рабочий уровень, предшествующий сбою;
- содержат четкий набор инструкций и точное описание исполнителей;
- должны максимально учесть все требования бизнеса и подобрать для его «ахиллесовой пяты» запасные решения;
- должны периодически доказывать свою жизнеспособность на «учебной тревоге» и пересматриваться в случае капитальных преобразований в компании;
- оба плана уникальны для каждой отдельной компании.
Но это не одно и то же
Если произошел отказ работы ИТ-инфраструктуры или ее элементов, DRP содержит инструкцию быстрого и поэтапного восстановления каждой отдельной подсистемы – регламент действий для ИТ-отдела. Надеемся, что работа бригады отлажена и восстановление доступности инфраструктуры по DRP будет быстрым, но в течение какого-то времени она все равно будет недоступна. BCP описывает план переезда на новую инфраструктуру, а также действия всей компании по поддержке этого процесса вплоть до предупреждения контрагентов и сотрудников с разъяснительной информацией при необходимости. В этом случае BCP включает в себя множество DRP .
BCP разрабатывается и тестируется представителями бизнеса в рамках всей компании (включая все офисы) совместно с внешними агентами, на которых завязан бизнес-процесс. BCP разрабатывается под все цепочки деятельности организации. В план попадают не только риски и угрозы, связанные с ИТ, а все что по оценке бизнеса может повлиять на работу организации. Если в компании не предусмотрен план аварийного восстановления или ИТ-отдел недостаточно зрелый, BCP может содержать и информацию для восстановления бизнес-процессов, завязанных на ИТ-инфраструктуре. Но это частный случай. В большинстве своем эта роль принадлежит DRP – документу с инструкциями для ИТ-подразделения.
Многие вендоры систем резервного копирования предлагают в документации варианты по организации аварийного восстановления сервера резервного копирования. DRP должен учитывать несколько сценариев развития событий по нарастанию ущерба (минимальный сценарный перечень: отключение электроэнергии, отказ сервера, пожар или разрушение здания).
План аварийного восстановления должен «видеть» инфраструктуру насквозь:
- учитывать сетевую инфраструктуру (кабели, коннекторы, маршрутизаторы и др.);
- систему безопасности (система доступа и информационная безопасность);
- источники питания и защиты энергоснабжения (заземление, громоотводы, фильтры напряжения, ограничители);
- климатические устройства (кондиционер, отопление, вентиляция);
- технический и управленческий персонал;
…рассматривать ее на 360 градусов:
- рабочее пространство (включая мебель, напольное покрытие и освещение);
- коммунальные системы (водоснабжение, канализация, связь);
- конструкцию здания (схемы с расположением ключевых элементов);
- локацию инфраструктуры и ее ближайшее окружение (дороги, близость к емкостям с горючим);
…и учитывать ее работу в ретроспективе:
- перенесенный опыт ранее случавшихся отказов (результаты расследования и выводы);
- опыт и возможности реагирования со стороны контрагентов;
- отраслевую практику устранения последствий аварий.
Для самостоятельного внедрения и разработки планов у компании должны быть «зрелые» бизнес и ИТ-процессы. Если это пока не так, то лучше начинать с самого значимого процесса, не пытаясь охватить всю деятельность организации и сложные для проработки сегменты. При создании плана можно «заимствовать» зрелые процессы и наработки у проверенных партнеров и провайдеров. Тестировать такое взаимодействие конечно тоже надо регулярно, но срок подготовки и ресурсы значительно короче тех, которые требуются для обеспечения результата только своими силами.
Для непрерывности бизнеса важны оба плана – и BCP , и DRP . Каждый из них берет под свою ответственность разные стороны бизнеса, при этом DRP является локальным ядром BCP . Составьте гибкий и понятный план со сценариями и инструкциями для персонала, регулярно делайте прогоны*, модернизируйте документы вместе с развитием бизнеса, и тогда можно играть с волей случая на равных.
* Пилотные прогоны выполняют еще одну важную функцию – выстраивают систему слаженных действий сотрудников и позволяют проявить находчивость в реальных условиях, даже когда ситуация вышла за рамки всевозможных планов и инструкций.