Свободные 30% на хранилище backup могут быть достаточным запасом, а могут закончиться через неделю. Сам процент почти ничего не говорит, если неизвестны объем источников, темп изменений, схема копирования, срок хранения и поведение сжатия.
Оценивать запас места нужно не универсальным коэффициентом, а моделью. Она должна объяснять, сколько данных появляется, сколько хранится, как долго живут цепочки копий и что изменится при росте бизнеса или крупном обновлении.
Сначала считают защищаемый объем
Первый слой расчета - не размер хранилища, а объем данных, которые действительно входят в backup. Важно отделить:
- данные, которые копируются полностью;
- базы и сервисы, для которых нужна согласованная копия;
- временные файлы, кэши и технический мусор;
- архивы, которые уже хранятся отдельно;
- системы, которые ошибочно не попали в план копирования.
Если начать с "у нас 10 ТБ на дисках", расчет будет грубым. Часть данных может не требовать резервного копирования, а часть критичных сервисов может занимать мало места, но иметь высокий RPO/RTO-риск.
Затем измеряют темп изменений
Backup хранит не только текущее состояние. Он хранит изменения между точками восстановления. Поэтому два сервера одинакового размера могут требовать разного объема хранилища: на одном данные почти не меняются, на другом ежедневно переписываются большие файлы или базы.
Темп изменений лучше измерять по фактической статистике backup за несколько циклов. Если такой статистики нет, стартовая оценка должна быть осторожной и обязательно пересматриваться после накопления данных.
На темп изменений влияют:
- активность пользователей;
- рост баз данных;
- операции импорта и выгрузки;
- виртуальные диски и снапшоты;
- большие медиафайлы;
- обновления систем и приложений;
- правила дедупликации и сжатия.
Главная ошибка - считать, что прирост равен только новым файлам. Изменение уже существующего большого файла может создать значительный новый объем в цепочке копий.
Retention превращает дневной прирост в месячный объем
Срок хранения задает, сколько точек восстановления одновременно лежит в хранилище. Чем длиннее retention, тем больше места занимают цепочки, но связь не всегда линейная: полные, инкрементальные и синтетические копии ведут себя по-разному.
| Что оценить | Зачем |
|---|---|
| Полный защищаемый объем | Понимать базовый размер начальной или синтетической полной копии |
| Средний дневной change rate | Оценить накопление инкрементов |
| Период полного цикла | Понять, сколько цепочек хранится одновременно |
| Retention по сценариям | Не хранить все одинаково долго без бизнес-причины |
| Резерв роста | Не исчерпать место при сезонном или проектном увеличении данных |
Если retention выбирают без сценариев восстановления, хранилище либо заканчивается слишком быстро, либо хранит много лишнего и все равно не закрывает нужный период.
Сжатие и дедупликация нельзя обещать заранее
Сжатие выглядит как простой способ выиграть место, но его нельзя закладывать как гарантированный результат без фактов. Текстовые документы, базы, архивы, медиа и уже сжатые форматы дают разный эффект. Дедупликация тоже зависит от того, насколько данные повторяются и как устроено ПО backup.
Практичный подход: в первом расчете указывать диапазон, а не одно точное число. После нескольких циклов заменить предположение фактической статистикой: сколько заняла полная копия, сколько занимают инкременты, как меняется размер после удаления старых точек.
Запас нужен не только для роста
Хранилище backup должно переживать нештатные ситуации:
- временное увеличение change rate после обновления;
- задержку удаления старых точек;
- повторное создание полной копии;
- добавление нового сервера;
- перенос данных между системами;
- расследование инцидента, когда старые точки нельзя удалять сразу.
Поэтому опасно планировать хранилище "впритык до следующей закупки". Если свободное место заканчивается, backup обычно перестает работать именно тогда, когда он становится особенно нужен.
Как понять, что запас уже под риском
Тревожные признаки:
- свободное место падает быстрее, чем ожидалось;
- старые точки удаляются раньше бизнес-требований;
- backup проходит с предупреждениями о нехватке места;
- администратор вручную чистит хранилище без зафиксированного решения;
- новые сервисы добавляют в backup без пересчета;
- тест восстановления откладывают, потому что "не хватает места для пробы".
Такие симптомы означают, что проблема уже не в диске, а в управлении процессом резервного копирования.
Рабочий результат расчета
Хорошая оценка должна давать не красивую цифру, а управляемое решение:
- какие источники копируются;
- сколько они занимают сейчас;
- какой фактический или ожидаемый change rate;
- какой retention нужен для разных сценариев;
- сколько места требуется на ближайший период;
- при каком пороге нужна закупка или изменение политики;
- когда расчет пересматривается.
В услуге резервного копирования это часть регулярной эксплуатации. Хранилище нельзя один раз подобрать и забыть: данные растут, сервисы меняются, требования к восстановлению уточняются. Надежность появляется там, где расчет связан с мониторингом, тестами восстановления и понятным владельцем решения.