Штрафы (service credits), которые провайдер платит клиенту за нарушение соглашения, почти всегда меньше реального ущерба от простоя. Провайдер компенсирует часть стоимости услуги, а клиент теряет выручку, репутацию и доверие пользователей. Уровень SLA стоит выбирать по реальному риску для бизнеса, а не по размеру компенсации в договоре.
Сколько стоит один процент SLA: экономика доступности и защищённости данных

SLA (Service Level Agreement) фиксирует не «надёжность вообще», а конкретный процент доступности за период. Разница между 99% и 99,9% — на порядки в минутах простоя, а значит, и в деньгах.
При этом бизнес часто путает два разных контракта под одной аббревиатурой. Первый — доступность сервиса: работает ли система прямо сейчас. Второй — сохранность данных: сколько информации можно потерять и как быстро восстановиться после аварии. Это разные метрики с разной ценой. Смешивать их в одну строку договора — способ переплатить за лишнюю девятку там, где она не нужна, или остаться без защиты данных при формально высоком SLA на доступность.
Дальше разберём, как считать стоимость простоя и стоимость потери данных раздельно, а не одной усреднённой цифрой.
SLA, SLO, SLI: из чего складывается процент
За договорным процентом SLA стоят три связанных понятия:
- SLI (Service Level Indicator) — измеряемая метрика: аптайм, латентность, доля ошибочных запросов.
- SLO (Service Level Objective) — целевое значение этой метрики, которое команда ставит себе внутри.
- SLA — то же обязательство, зафиксированное в договоре с клиентом и подкреплённое последствиями за нарушение.
Обратная сторона SLO — error budget: допустимый объём отклонения от цели (1 − SLO), который команда может «потратить» на риск изменений и инциденты за период, не нарушив договорной SLA. Пока бюджет не израсходован, команда выкатывает рискованные релизы; когда он подходит к нулю, приоритет смещается на стабильность.
Нюанс для расчёта: разные компоненты системы — API, база данных, сеть — обычно имеют собственные SLO, и итоговая доступность цепочки почти всегда ниже, чем SLA самого слабого звена. Причина в том, что вероятности отказа перемножаются, а не усредняются. Раздельный SLO по компонентам полезнее одного числа для всей системы: он показывает, где именно теряются девятки.
Математика девяток: сколько минут стоит каждый процент
Проценты доступности переводятся в абсолютные минуты и часы простоя по формуле: (1 − SLA%) × число минут в периоде.
| SLA | Допустимый простой в год |
|---|---|
| 99% | ≈ 3,65 суток |
| 99,9% | ≈ 8,76 часа |
| 99,99% | ≈ 52,6 минуты |
| 99,999% | ≈ 5,26 минуты |
Когда финансовый директор произносит «нам нужны пять девяток», полезно сразу перевести это в 5,26 минуты допустимого простоя в год и спросить, готов ли бюджет под соответствующую инфраструктуру.
Каждая следующая девятка сокращает допустимый простой на порядок, но не даёт линейного прироста ценности для бизнеса. Отсюда — резкий скачок стоимости инфраструктуры при переходе с 99,9% на 99,99% и выше. Уровень 99,999% требует мультирегиональной отказоустойчивости: независимые площадки, репликация между ними, механизмы переключения нагрузки. Это качественно другой уровень затрат, а не «ещё немного надёжнее».
Экономическая цена простоя: как считать для своего бизнеса
Минимальная оценка стоимости простоя складывается из трёх слагаемых:
- часовая выручка, умноженная на вероятность потери транзакций во время сбоя;
- штрафы по SLA перед клиентами;
- затраты на восстановление, включая человеко-часы инженеров и разбор инцидента.
Для e-commerce и финтеха ключевая переменная — транзакции в момент пиковой нагрузки, а не средняя выручка за сутки. Простой в обычный вторник и простой во время распродажи — принципиально разные суммы ущерба при одинаковой продолжительности отказа.
Защищённость данных — отдельная экономика, не про аптайм
SLA на доступность отвечает на вопрос «работает ли сервис прямо сейчас». RPO и RTO отвечают на другой: «сколько данных мы потеряем и как долго будем восстанавливаться». Это принципиально другой контракт с другой ценой.
- RPO (Recovery Point Objective) определяет допустимый объём потери данных в единицах времени с момента последнего бэкапа или репликации.
- RTO (Recovery Time Objective) — допустимое время простоя до полного восстановления сервиса после аварии.
Договор с высоким процентом SLA на доступность ничего не говорит о том, что случится с данными при серьёзном сбое, если RPO и RTO не прописаны отдельно.
Цена утечки или потери данных считается не через простой, а через инцидент-костинг: расследование, уведомление пострадавших, регуляторные штрафы, репутационные потери, отток клиентов. По данным IBM Cost of a Data Breach Report за 2025 год, средняя мировая стоимость утечки составила 4,44 млн $ — на 9% ниже показателя 2024 года (4,88 млн $). Здравоохранение остаётся самой дорогой отраслью: 7,42 млн $ на инцидент. Разброс между отраслями показывает, что «средняя» цифра ущерба почти бесполезна без учёта специфики конкретного бизнеса.
Как построить формулу стоимости одного процента SLA
Шаг 1. Перевести проценты в минуты
Перевести целевой процент SLA в абсолютные минуты простоя в год и в месяц по таблице девяток.
Шаг 2. Посчитать стоимость простоя раздельно
Посчитать стоимость простоя раздельно: для инфраструктуры и для данных. Аптайм и RPO/RTO — разные риски с разной ценой. Объединять их в одну цифру нельзя: так теряется понимание, за что именно платит бизнес.
Шаг 3. Сравнить рост затрат с реальным риском
Сравнить прирост инфраструктурных затрат за каждую следующую девятку с реальным финансовым риском простоя. Не с абстрактным «чем выше, тем лучше», а с конкретной суммой недополученной выручки и штрафов.
Шаг 4. Заложить в контракт RPO и RTO
Заложить в контракт раздельные RPO и RTO помимо процента SLA. Без них соглашение о доступности ничего не говорит о судьбе данных при аварии, а именно потеря данных чаще оборачивается многомиллионным инцидентом.
Для внутренних некритичных сервисов переплата за SLA 99,99% и выше часто не окупается. Разница в финансовом риске между 99,9% и 99,99% для такого сервиса минимальна в деньгах, а инфраструктурные затраты на дополнительную девятку растут нелинейно.
Для платёжных и медицинских систем экономика обратная. Даже небольшое повышение процента SLA и ужесточение RPO/RTO может окупаться за счёт избежания одного дорогого инцидента. Здравоохранение стабильно лидирует по цене утечки данных, и стоимость лишней девятки здесь нужно сравнивать не со средним ущербом по рынку, а с ценой единичного отказа в конкретной инфраструктуре.
Оставьте заявку, чтобы получить консультацию
Наши специалисты свяжутся с вами в ближайшее время и ответят на все вопросы.

Узнавайте о выходе новых статей в блоге первыми!
Будем держать в курсе новостей и облачных трендов


Почитать по теме

ИИ в облаке: где хранить данные и на чём считать модели

IaaS для стартапа: с чего начать и когда переходить на Kubernetes

