Краши после релиза — это про вас, если каждое утро вы первым делом открываете Crashlytics, видите гору стеков и не понимаете, с чего начать.

Релиз выкатили в пятницу, а в понедельник рейтинг уже проседает, поддержка присылает скрины «приложение вылетает», и вы чините первый попавшийся краш. Завтра появляется второй, потом третий: один и тот же стек всплывает раз в неделю, команда спорит, кто виноват, а вы до сих пор не знаете, какой из стеков реально задевает пользователей, а какой — особенность одного устройства.

Почему это важно: без crash-free SLO и честной очереди triage команда превращается в пожарных, которые бегут по симптомам. Регрессия, попавшая в один билд, размывает доверие к продукту, съедает спринт на срочные хотфиксы и лишает вас возможности говорить с бизнесом на языке метрик, а не ощущений. Симптом лечится хотфиксом, причина остаётся в архитектуре — и возвращается на следующий релиз.

Разбираю это в канале: как связать релиз с инцидентом, в каком порядке разгребать очередь и какие метрики держать в голове. На вопрос «с чего начинать, когда крашей больше, чем времени» отвечу в следующих постах — подписывайся, чтобы не пропустить 👇

Собрать это в систему помогёт курс Crashlytics и client SRE — 37 лекций про release health, triage и профилактику регрессий.