Длительное отключение электричества нельзя пережить одной фразой «у нас есть ИБП». ИБП может дать несколько минут на корректную остановку, поддержать связь на время переключения или удержать критичный узел, но он не превращает офисную инфраструктуру в автономный дата-центр.
Подготовка начинается с честного выбора: что должно продолжать работать, что нужно безопасно остановить, кто принимает решение, как предупредить сотрудников и как проверить восстановление после возврата питания.
Определить границы сценария
Сначала нужно описать ожидаемый сценарий: отключение на минуты, часы или большую часть рабочего дня; только офис или весь район; есть ли мобильная связь; доступен ли интернет-провайдер; есть ли люди на месте; нужно ли сохранять работу склада, касс, телефонии, видеонаблюдения или только корректно остановить серверы.
Без такой рамки легко требовать от IT невозможного. Одно дело - пережить краткий провал питания без перезагрузки маршрутизатора. Другое - обеспечить работу офиса несколько часов при отсутствии внешнего питания и неработающем провайдерском оборудовании.
Карта критичных нагрузок
Нужно составить список нагрузок: серверы, storage, маршрутизатор, коммутаторы, точки доступа, телефония, видеонаблюдение, рабочие места ключевых сотрудников, оборудование провайдера, система контроля доступа, принтеры или кассы. Для каждой нагрузки фиксируют роль, потребляемую мощность на уровне оценки, зависимые сервисы, допустимый простой и порядок остановки.
Главное - не включать в критичный список все подряд. Если ИБП пытается питать лишние устройства, он быстрее потеряет ресурс для действительно важных сервисов. Иногда правильное решение - оставить сеть и связь на короткое время, но корректно остановить серверы до разряда батареи.
ИБП: что проверить без самообмана
Номинальная мощность и реальное время работы - разные вещи. Время зависит от нагрузки, состояния батарей, возраста ИБП, температуры, количества подключенных устройств и сценария отключения. Старые батареи могут держать минуты вместо ожидаемых десятков минут.
Для IT-плана достаточно безопасной проверки и документации: какие устройства подключены, какая нагрузка считается критичной, когда батареи менялись, кто получает сигнал о разряде, при каком остатке начинается остановка, кто отвечает за обслуживание. Электромонтажные работы и подключение силовых линий должны выполнять профильные специалисты, а не IT-поддержка по импровизации.
Порядок остановки сервисов
Если питание пропадает надолго, важен порядок. Сначала нужно сохранить данные и остановить приложения, затем базы, затем виртуальные машины или серверы, затем storage и вспомогательные сервисы. Некоторые системы требуют отдельной логики: например, приложение должно завершить операции до остановки базы, а файловый ресурс - дождаться закрытия активных процессов.
Порядок должен быть записан простым языком: кто дает команду, какие сервисы останавливаются первыми, какие признаки подтверждают успешную остановку, когда уже поздно ждать и нужно переходить к следующему шагу. Команды и пароли не должны лежать в открытом документе; достаточно безопасных ссылок на закрытый runbook или credential reference.
Связь и коммуникация
Во время отключения сотрудники должны понимать, какие сервисы недоступны, что можно делать, куда сообщать о проблемах и когда ждать обновления статуса. Если связь с офисом пропадает вместе с интернетом, нужен запасной канал коммуникации: мобильная связь, ответственный на месте, список контактов провайдеров и руководителей.
Для руководителя полезна короткая матрица: сервис, статус, ожидаемое время работы от резерва, действие при длительном отключении, ответственный за решение. Это снижает хаос и помогает не тратить оставшийся ресурс питания на второстепенные задачи.
Backup и данные
Перед плановыми рисковыми периодами полезно убедиться, что критичные данные попадают в backup и есть понятный порядок восстановления. Но backup не заменяет корректную остановку. Если система выключается аварийно, можно получить повреждение данных, долгую проверку базы или непредсказуемое восстановление сервисов.
Особенно важно понимать, какие данные появляются между последней копией и отключением. Если бизнес продолжает работать на локальной системе до полного разряда питания, потенциальная потеря данных может быть выше, чем при своевременной остановке и переходе на ручной или отложенный процесс.
Восстановление после возврата питания
Возврат электричества не означает, что IT уже работает. Нужно проверить питание шкафов, состояние ИБП, сетевые узлы, интернет, серверы, storage, базы, приложения, backup-задачи и мониторинг. Некоторые сервисы должны стартовать в определенной последовательности, иначе пользователи увидят ошибки даже при включенных серверах.
Хороший план восстановления содержит не только «включить все», а порядок проверки: инфраструктура, сеть, хранение, базовые сервисы, приложения, пользовательские сценарии, наблюдение после запуска. При системной интеграции такие зависимости должны быть видны заранее, потому что серверы, сеть, питание, backup и пользователи работают как одна система.
Минимальный план готовности
- Описать сценарии отключения: минуты, часы, рабочий день.
- Составить карту критичных нагрузок и исключить лишнее из питания.
- Проверить состояние ИБП, батарей, уведомлений и ответственных.
- Записать порядок безопасной остановки и восстановления сервисов.
- Подготовить коммуникацию для сотрудников, руководителей и провайдеров.
- Проверить backup и понять допустимую потерю данных.
- После восстановления подтвердить не только включение оборудования, но и пользовательские сценарии.
Итог: подготовка к длительному отключению электричества - это не обещание бесконечной автономности. Это управляемое решение: что удерживать, что остановить, как сохранить данные, кому сообщить и как доказать, что после возврата питания инфраструктура снова работает.