Спроси про аптайм — иначе будешь дежурить вечно

Идёшь в DevOps на собеседование? Спроси про Uptime — иначе работа по выходным обеспечена.

🧮 Суть метрики (перевод на язык денег) SLA/Uptime — это процент времени, когда твоя система работает без сбоев. Но для тебя это не «надёжность», а прямой триггер твоего графика, размера премии и срока жизни в компании. Если Uptime ниже 99,9% — инфраструктура сыпется, ты будешь тушить пожары ночами, а бюджет на твой бонус уйдёт на аварийный овертайм. Если Uptime выше 99,99% — компания зарабатывает стабильно, и у тебя есть рычаг требовать долю от сэкономленных простоев.

🚦 Светофор (ориентиры рынка и что они значат для тебя)

🔴 Красная зона (Danger): Uptime < 99,5% Комментарий: Это клинический случай. Система падает чаще раза в неделю. Компания экономит на резервировании, мониторинге и инженерах. Твои риски:

· зарплата не индексируется (все деньги уходят на штрафы клиентам); · KPI по времени восстановления (MTTR) нереалистичны — ты не успеваешь, и премия сгорает; · через 3–6 месяцев — выгорание или сокращение отдела, потому что бизнес решит «оптимизировать» дорогую команду. Повод обновить резюме до собеседования.

🟡 Жёлтая зона (Market Avg): Uptime 99,9% Комментарий: Типичный «средний по больнице». Пару часов простоя в квартал — допустимо. Для тебя это:

· оклад на рынке, бонус — 10–15% от годовой зарплаты, но только если не было инцидентов в конце квартала; · дежурства по графику «одна неделя в месяц» — предсказуемо, но дёргают по ночам; · карьерный потолок: чтобы просить повышение, нужны не подвиги, а просто отсутствие косяков. Скучно, но стабильно.

🟢 Зелёная зона (Best Practice): Uptime ≥ 99,99% Комментарий: Это уровень топ-провайдеров и финтеха. Простой — менее 52 минут в год. Для тебя:

· компания зарабатывает на надёжности, поэтому легко соглашается на бонус до 30–40% от оклада за каждый «девять» сверх контракта; · бюджеты на SRE-инструменты, обучение и дублирующие дата-центры — есть; · твой голос на совещаниях весомый — ты не «пожарный», а «мастер устойчивости». Именно здесь можно торговаться за опционы или процент от роста выручки.

⚖️ Контекст (нюансы для соискателя/менеджера) Хитрость №1: Работодатели часто показывают внутренний Uptime (без учёта плановых работ) или средневзвешенный за год, где один крупный сбой «размазывают» по месяцам. Спроси: «А какой был наихудший месячный Uptime за последние полгода?» — если HR мямлит, это красный флаг.

Хитрость №2: В стартапах норма 99,5% — и это ок, если тебе дают долю в компании. Но если это зрелый бизнес с сотнями клиентов, а Uptime < 99,9% — значит, менеджмент тупо не вкладывается в инфру, и твой отдел — статья расходов, а не центр прибыли. Не дай себя обмануть «мы работаем над надёжностью» — запроси отчёт по инцидентам за квартал.

🛠 Карьерные рычаги (как использовать себе во благо)

1. На собеседовании спроси прямо: «Какое целевое значение SLA у вас в оффере, и как мой бонус зависит от его выполнения? Если мы превысим 99,99% — какой % от сэкономленных штрафов я получу?» Это сразу отсекает компании, где KPI дутые, а бонусы — пустышка. 2. При подписании оффера пропиши в индивидуальных KPI не просто «обеспечить Uptime», а привяжи к своему окладу: например, базовый бонус 15% при 99,9%, +5% за каждый 0,01% сверху, но не более 40%. Так ты превращаешь абстрактную метрику в живые деньги. 3. Для повышения зарплаты собери отчёт: сколько часов простоя ты предотвратил за год, переведи в выручку (средний чек клиента × число затронутых юзеров). Покажи, что твоя работа сэкономила компании X млн руб. — и проси 5–10% от этой экономии в виде годовой премии. Если откажут — ты уже знаешь, что они не ценят стабильность, и пора искать зелёную зону.

💬 Коллеги, а какая цифра Uptime зашита в ваши KPI и как она реально влияет на вашу премию?

Спроси про аптайм — иначе будешь дежурить вечно | Сетка — социальная сеть от hh.ru