VK Cloud

Сколько стоит один процент SLA: экономика доступности и защищённости данных

4 сентября 2026 г.
Александр Иванов
Автор статьи
_blog_head_19.png

SLA (Service Level Agreement) фиксирует не «надёжность вообще», а конкретный процент доступности за период. Разница между 99% и 99,9% — на порядки в минутах простоя, а значит, и в деньгах.

При этом бизнес часто путает два разных контракта под одной аббревиатурой. Первый — доступность сервиса: работает ли система прямо сейчас. Второй — сохранность данных: сколько информации можно потерять и как быстро восстановиться после аварии. Это разные метрики с разной ценой. Смешивать их в одну строку договора — способ переплатить за лишнюю девятку там, где она не нужна, или остаться без защиты данных при формально высоком SLA на доступность.

Дальше разберём, как считать стоимость простоя и стоимость потери данных раздельно, а не одной усреднённой цифрой.

SLA, SLO, SLI: из чего складывается процент

За договорным процентом SLA стоят три связанных понятия:

  • SLI (Service Level Indicator) — измеряемая метрика: аптайм, латентность, доля ошибочных запросов.
  • SLO (Service Level Objective) — целевое значение этой метрики, которое команда ставит себе внутри.
  • SLA — то же обязательство, зафиксированное в договоре с клиентом и подкреплённое последствиями за нарушение.

Обратная сторона SLO — error budget: допустимый объём отклонения от цели (1 − SLO), который команда может «потратить» на риск изменений и инциденты за период, не нарушив договорной SLA. Пока бюджет не израсходован, команда выкатывает рискованные релизы; когда он подходит к нулю, приоритет смещается на стабильность.

Нюанс для расчёта: разные компоненты системы — API, база данных, сеть — обычно имеют собственные SLO, и итоговая доступность цепочки почти всегда ниже, чем SLA самого слабого звена. Причина в том, что вероятности отказа перемножаются, а не усредняются. Раздельный SLO по компонентам полезнее одного числа для всей системы: он показывает, где именно теряются девятки.

Математика девяток: сколько минут стоит каждый процент

Проценты доступности переводятся в абсолютные минуты и часы простоя по формуле: (1 − SLA%) × число минут в периоде.

SLAДопустимый простой в год
99%≈ 3,65 суток
99,9%≈ 8,76 часа
99,99%≈ 52,6 минуты
99,999%≈ 5,26 минуты

Когда финансовый директор произносит «нам нужны пять девяток», полезно сразу перевести это в 5,26 минуты допустимого простоя в год и спросить, готов ли бюджет под соответствующую инфраструктуру.

Каждая следующая девятка сокращает допустимый простой на порядок, но не даёт линейного прироста ценности для бизнеса. Отсюда — резкий скачок стоимости инфраструктуры при переходе с 99,9% на 99,99% и выше. Уровень 99,999% требует мультирегиональной отказоустойчивости: независимые площадки, репликация между ними, механизмы переключения нагрузки. Это качественно другой уровень затрат, а не «ещё немного надёжнее».

Экономическая цена простоя: как считать для своего бизнеса

Минимальная оценка стоимости простоя складывается из трёх слагаемых:

  • часовая выручка, умноженная на вероятность потери транзакций во время сбоя;
  • штрафы по SLA перед клиентами;
  • затраты на восстановление, включая человеко-часы инженеров и разбор инцидента.

Для e-commerce и финтеха ключевая переменная — транзакции в момент пиковой нагрузки, а не средняя выручка за сутки. Простой в обычный вторник и простой во время распродажи — принципиально разные суммы ущерба при одинаковой продолжительности отказа.

Важно знать

Штрафы (service credits), которые провайдер платит клиенту за нарушение соглашения, почти всегда меньше реального ущерба от простоя. Провайдер компенсирует часть стоимости услуги, а клиент теряет выручку, репутацию и доверие пользователей. Уровень SLA стоит выбирать по реальному риску для бизнеса, а не по размеру компенсации в договоре.

Защищённость данных — отдельная экономика, не про аптайм

SLA на доступность отвечает на вопрос «работает ли сервис прямо сейчас». RPO и RTO отвечают на другой: «сколько данных мы потеряем и как долго будем восстанавливаться». Это принципиально другой контракт с другой ценой.

  • RPO (Recovery Point Objective) определяет допустимый объём потери данных в единицах времени с момента последнего бэкапа или репликации.
  • RTO (Recovery Time Objective) — допустимое время простоя до полного восстановления сервиса после аварии.

Договор с высоким процентом SLA на доступность ничего не говорит о том, что случится с данными при серьёзном сбое, если RPO и RTO не прописаны отдельно.

Цена утечки или потери данных считается не через простой, а через инцидент-костинг: расследование, уведомление пострадавших, регуляторные штрафы, репутационные потери, отток клиентов. По данным IBM Cost of a Data Breach Report за 2025 год, средняя мировая стоимость утечки составила 4,44 млн $ — на 9% ниже показателя 2024 года (4,88 млн $). Здравоохранение остаётся самой дорогой отраслью: 7,42 млн $ на инцидент. Разброс между отраслями показывает, что «средняя» цифра ущерба почти бесполезна без учёта специфики конкретного бизнеса.

Как построить формулу стоимости одного процента SLA

Шаг 1. Перевести проценты в минуты

Перевести целевой процент SLA в абсолютные минуты простоя в год и в месяц по таблице девяток.

Шаг 2. Посчитать стоимость простоя раздельно

Посчитать стоимость простоя раздельно: для инфраструктуры и для данных. Аптайм и RPO/RTO — разные риски с разной ценой. Объединять их в одну цифру нельзя: так теряется понимание, за что именно платит бизнес.

Шаг 3. Сравнить рост затрат с реальным риском

Сравнить прирост инфраструктурных затрат за каждую следующую девятку с реальным финансовым риском простоя. Не с абстрактным «чем выше, тем лучше», а с конкретной суммой недополученной выручки и штрафов.

Шаг 4. Заложить в контракт RPO и RTO

Заложить в контракт раздельные RPO и RTO помимо процента SLA. Без них соглашение о доступности ничего не говорит о судьбе данных при аварии, а именно потеря данных чаще оборачивается многомиллионным инцидентом.

Для внутренних некритичных сервисов переплата за SLA 99,99% и выше часто не окупается. Разница в финансовом риске между 99,9% и 99,99% для такого сервиса минимальна в деньгах, а инфраструктурные затраты на дополнительную девятку растут нелинейно.

Для платёжных и медицинских систем экономика обратная. Даже небольшое повышение процента SLA и ужесточение RPO/RTO может окупаться за счёт избежания одного дорогого инцидента. Здравоохранение стабильно лидирует по цене утечки данных, и стоимость лишней девятки здесь нужно сравнивать не со средним ущербом по рынку, а с ценой единичного отказа в конкретной инфраструктуре.

Оставьте заявку, чтобы получить консультацию

Наши специалисты свяжутся с вами в ближайшее время и ответят на все вопросы.

section_subscribe_2x_9ab2d878a6_ac1afd4471.png

            Узнавайте о выходе новых статей в блоге первыми!

            Будем держать в курсе новостей и облачных трендов

            section-subscribe_2x.png
              section-subscribe_2x.png
              Ссылка скопирована
              Поделиться

              Почитать по теме

              _blog_head_14.png
              3 сентября

              ИИ в облаке: где хранить данные и на чём считать модели

              _blog_head_13.png
              4 сентября

              IaaS для стартапа: с чего начать и когда переходить на Kubernetes

              _blog_head_186.png
              3 сентября

              SSL-сертификат для сайта: виды, как получить бесплатно и настроить на сервере

              40+ готовых сервисов