Что такое SLA дата-центра
SLA (Service Level Agreement) — это письменное обязательство дата-центра по доступности инфраструктуры: электропитания, охлаждения и сети. В договоре аренды выделенного сервера SLA обычно выражен в процентах, например 99.9% или 99.99%, и привязан к денежной компенсации за простой сверх нормы.
Процент доступности сам по себе мало что говорит, пока вы не переведёте его в часы и минуты простоя за год. Дальше разберём, как это сделать и на что в SLA дата-центра смотреть в первую очередь.
Уровни Tier I-IV: в чём разница
Классификация Uptime Institute делит дата-центры на четыре уровня по резервированию инженерных систем — питания, охлаждения, вводов связи.
| Tier | Резервирование | Гарантированная доступность | Простой в год |
|---|---|---|---|
| Tier I | Без резерва | 99.671% | 28.8 часа |
| Tier II | N+1 | 99.741% | 22.0 часа |
| Tier III | N+1, обслуживание без остановки | 99.982% | 1.6 часа |
| Tier IV | 2N+1, отказоустойчивый | 99.995% | 0.4 часа |
Провайдер редко указывает Tier явно в маркетинге, но почти всегда пишет процент SLA — по нему можно понять реальный уровень резервирования систем питания, о которых рассказано отдельно.
Сколько это в минутах простоя
Перевести проценты в абсолютные цифры несложно: (100% − SLA%) × количество минут в году.
| SLA | Простой в год |
|---|---|
| 99% | 3.65 суток |
| 99.9% | 8.76 часа |
| 99.95% | 4.38 часа |
| 99.99% | 52.56 минуты |
| 99.999% | 5.26 минуты |
Разница между 99.9% и 99.99% — это разница между рабочим днём простоя и часом обеда. Для интернет-магазина или биллинга это принципиально.
Что SLA дата-центра не покрывает
SLA дата-центра отвечает за инфраструктуру здания и канала до стойки. Он не отвечает за:
- Аварии операционной системы и приложений на самом сервере.
- Выход из строя диска или планки памяти внутри вашего оборудования.
- Ошибки конфигурации, которые внёс администратор сервера.
- DDoS-атаки на уровне приложения — от них помогает отдельная защита.
Поэтому высокий процент SLA от дата-центра не отменяет мониторинга самого сервера и резервного копирования данных.
Как проверить доступность сервера самостоятельно
Не полагайтесь только на отчёты провайдера — ведите независимый учёт аптайма.
uptime
# 10:14:02 up 214 days, 3:41, 2 users, load average: 0.12, 0.09, 0.05
Для внешнего контроля используйте сторонний сервис проверки доступности с интервалом опроса 30-60 секунд и алертом в мессенджер. Это дополняет мониторинг железа через IPMI, который следит за температурой, дисками и питанием внутри самого сервера.
Чек-лист перед выбором дата-центра
- Уточните заявленный Tier и процент SLA письменно, а не на словах.
- Проверьте, что компенсация в SLA не превращается в символические бонусные дни.
- Спросите про резервирование электропитания и локацию дата-центра относительно рисков региона.
- Ведите собственный мониторинг доступности параллельно с отчётами провайдера.