Свободные 30% в хранилище резервных копий могут быть достаточным запасом, а могут закончиться через неделю. Сам процент почти ничего не говорит, если неизвестны объем источников, темп изменений, схема копирования, срок хранения и поведение сжатия.

Оценивать запас места нужно не универсальным коэффициентом, а моделью. Она должна объяснять, сколько данных появляется, сколько хранится, как долго живут цепочки копий и что изменится при росте бизнеса или крупном обновлении.

Сначала считают защищаемый объем

Первый слой расчета - не размер хранилища, а объем данных, которые действительно входят в резервное копирование. Важно отделить:

  • данные, которые копируются полностью;
  • базы и сервисы, для которых нужна согласованная копия;
  • временные файлы, кэши и технический мусор;
  • архивы, которые уже хранятся отдельно;
  • системы, которые ошибочно не попали в план копирования.

Если начать с "у нас 10 ТБ на дисках", расчет будет грубым. Часть данных может не требовать резервного копирования, а часть критичных сервисов может занимать мало места, но иметь высокий RPO/RTO-риск.

Затем измеряют темп изменений

Система резервного копирования хранит не только текущее состояние. Она сохраняет изменения между точками восстановления. Поэтому два сервера одинакового размера могут требовать разного объема хранилища: на одном данные почти не меняются, на другом ежедневно переписываются большие файлы или базы.

Темп изменений лучше измерять по фактической статистике заданий резервного копирования за несколько циклов. Если такой статистики нет, стартовая оценка должна быть осторожной и обязательно пересматриваться после накопления данных.

На темп изменений влияют:

  • активность пользователей;
  • рост баз данных;
  • операции импорта и выгрузки;
  • виртуальные диски и снапшоты;
  • большие медиафайлы;
  • обновления систем и приложений;
  • правила дедупликации и сжатия.

Главная ошибка - считать, что прирост равен только новым файлам. Изменение уже существующего большого файла может создать значительный новый объем в цепочке копий.

Срок хранения превращает дневной прирост в месячный объем

Срок хранения задает, сколько точек восстановления одновременно лежит в хранилище. Чем дольше хранятся копии, тем больше места занимают цепочки, но связь не всегда линейная: полные, инкрементальные и синтетические копии ведут себя по-разному.

Что оценитьЗачем
Полный защищаемый объемПонимать базовый размер начальной или синтетической полной копии
Средний дневной темп измененийОценить накопление инкрементов
Период полного циклаПонять, сколько цепочек хранится одновременно
Срок хранения по сценариямНе хранить все одинаково долго без бизнес-причины
Резерв ростаНе исчерпать место при сезонном или проектном увеличении данных

Если срок хранения выбирают без сценариев восстановления, хранилище либо заканчивается слишком быстро, либо хранит много лишнего и все равно не закрывает нужный период.

Сжатие и дедупликация нельзя обещать заранее

Сжатие выглядит как простой способ выиграть место, но его нельзя закладывать как гарантированный результат без фактов. Текстовые документы, базы, архивы, медиа и уже сжатые форматы дают разный эффект. Дедупликация тоже зависит от того, насколько данные повторяются и как устроено ПО резервного копирования.

Практичный подход: в первом расчете указывать диапазон, а не одно точное число. После нескольких циклов заменить предположение фактической статистикой: сколько заняла полная копия, сколько занимают инкременты, как меняется размер после удаления старых точек.

Запас нужен не только для роста

Хранилище резервных копий должно переживать нештатные ситуации:

  • временное увеличение темпа изменений после обновления;
  • задержку удаления старых точек;
  • повторное создание полной копии;
  • добавление нового сервера;
  • перенос данных между системами;
  • расследование инцидента, когда старые точки нельзя удалять сразу.

Поэтому опасно планировать хранилище "впритык до следующей закупки". Если свободное место заканчивается, задания резервного копирования обычно перестают выполняться именно тогда, когда копии становятся особенно нужны.

Как понять, что запас уже под риском

Тревожные признаки:

  • свободное место падает быстрее, чем ожидалось;
  • старые точки удаляются раньше бизнес-требований;
  • задания резервного копирования выполняются с предупреждениями о нехватке места;
  • администратор вручную чистит хранилище без зафиксированного решения;
  • новые сервисы добавляют в план резервного копирования без пересчета;
  • тест восстановления откладывают, потому что "не хватает места для пробы".

Такие симптомы означают, что проблема уже не в диске, а в управлении процессом резервного копирования.

Рабочий результат расчета

Хорошая оценка должна давать не красивую цифру, а управляемое решение:

  • какие источники копируются;
  • сколько они занимают сейчас;
  • какой фактический или ожидаемый темп изменений;
  • какой срок хранения нужен для разных сценариев;
  • сколько места требуется на ближайший период;
  • при каком пороге нужна закупка или изменение политики;
  • когда расчет пересматривается.

В услуге резервного копирования это часть регулярной эксплуатации. Хранилище нельзя один раз подобрать и забыть: данные растут, сервисы меняются, требования к восстановлению уточняются. Надежность появляется там, где расчет связан с мониторингом, тестами восстановления и понятным владельцем решения.