Как CEO хотел "три инцидента в месяц" и почему я провалился

Ситуация: защита стратегии развития ИТ поддержки перед топ-менеджментом.

Выдаю графики с отличными цифрами: 1 критический инцидент за месяц (после внедрения крупного проекта), доступность 99.5%, динамика снижения MTTR, наши планы по оптимизации щагов поддержки. Все проходит отлично, аудитория задумчиво кивает.

Генеральный директор (искренне): — Валерий, спасибо. Всё красиво. А когда мы сможем сделать, чтобы у нас было три инцидента в месяц? Как в компании N?

Пауза.

Я внутри: «ТРИ ИНЦИДЕНТА? Мы тут Availability считаем, мы инциденты по критичности делим, у нас сломанная мышь — тоже инцидент! Вы вообще понимаете, что SLA — это не про количество сбоев?»

Я вслух: «Эээ… давайте я лучше расскажу про SRE-практики».

Спойлер: презентация не зашла.

Что я понял позже: C-Level не хотел слушать про процесс. Они хотели услышать про результат. «Три инцидента» для них — синоним слова «спокойствие». Они не просили метрик, они просили гарантию, что бизнес не встанет.

Так что прежде чем грузить про ITSM и SRE, нужно спросить: «Что именно вас беспокоит? Боитесь потери данных? Простоя сайта? Или просто хотите спать спокойно?»

Потому что заказчику не нужна дрель — ему нужна ровная дырка в стене.

Как CEO хотел "три инцидента в месяц" и почему я провалился | Сетка — социальная сеть от hh.ru