Огнетушитель не должен гореть
Директор смотрит в отчет утилизации ресурсов и хмурит брови. У ведущего сетевого инженера треть рабочего времени не закрыта проектными задачами. В таск-трекере пустоты. Вывод очевиден: человек недогружен, компания теряет деньги на ровном месте. Надо докинуть ему еще пару проектов, чтобы отрабатывал оклад на все сто.
Через месяц на пограничном шлюзе падает BGP-сессия. Встает трафик ключевых клиентов. Цена простоя - миллион рублей в минуту.
Директор в панике звонит инженеру: бросай все, спасай прод! А инженер сидит на третьем подряд обязательном созвоне по новому проекту, который ему заботливо «догрузили». У него дедлайн по сдаче проектной документации и еще четыре горящих тикета в очереди. Пока он вынырнул из чужого контекста, пока согласовал переключение, пока разобрался в дампе трафика - бизнес потерял дневную выручку.
В операционном менеджменте этот запас называется slack capacity. Если раньше мы разбирали физику очередей и замедление системы, то сегодня давай посмотрим на чистую экономику этого же резерва.
Незрелый руководитель видит лень, разгильдяйство и лишние косты. Зрелый понимает, что это страховой полис бизнеса.
Никому в здравом уме не придет в голову требовать, чтобы огнетушитель в серверной тушил пожары восемь часов в день пять дней в неделю ради окупаемости. Это логика начальника, который при виде скучающей пожарной части отправляет караул красить заборы пока что-то не загорится. Ни один вменяемый эксплуатационщик не станет грузить дизель-генератор майнингом криптовалюты, пока в сети есть штатное электричество. Огнетушитель и генератор стоят молча. Их ценность измеряется тем, что они сработают в ту самую секунду, когда погаснет свет или начнется пожар.
С высококвалифицированными инженерами логика ровно та же. Если специалист загружен под завязку плановой текучкой, у бизнеса исчезает время реакции. Любой чих на инфраструктуре моментально превращается в катастрофу, потому что некому оперативно подхватить падающее бревно. Неоткуда взять ресурс на тушение пожара, помощь младшим коллегам или аудит архитектуры перед запуском.
Попытка выжать из сильной команды сто процентов загрузки ради красивых отчётов - это верный способ остаться без штанов при первом же серьезном инциденте. Резервная мощность команды покупает бизнесу маневренность и право на выживание в кризисе. Это прямая плата за устойчивость системы.
Так что когда в следующий раз от тебя потребуют «дозагрузить свободных людей задачами», задай простой вопрос: сколько минут простоя ключевого сервиса готова оплатить компания, когда у этих людей не окажется ни одной свободной секунды?