Observability нового уровня.

Все мы видели страницы со стасусами, где продукты отчитываются какие они доступные и зеленые.

Работают они обычно через HTTP хелс чеки. Вернул HTTP эндпойнт 200 статус, значит продукт здоров и работоспособен. А что если я скажу, что это вообще ничего не значит? 😄

Если магазин возвращает 200 статусы, но не может продать товар, разве он тогда доступен? А решается это синтетическим тестированием, когда мы эмулируем поведение реального пользователя и проверяем работоспособность функционала.

Звучит круто, но почему тогда почти никто это не измеряет? Это отнюдь не новая идея. Раньше это было дорого. Поди разорись на покупку NewRelic, который это поддерживает. Сейчас это стало комодити и поддерживать это стали многие observability инструменты.

Ну что теперь то мешает? Это непросто реализовать. Во-первых DevOps синтетическое тестирование не знают, некоторые QA знают. А ты возьми да подружи PO, DevOps, QA и разработчиков это сделать. Лебедь раком щуку...

Раз уж пост от меня, то как тут себя не похвалить 🤣 Наш DevOps Lead поменял наш репортинг доступности на измерение реально важной функциональности пользователям. И это было сделать сложнее чем обычно, ибо наши клиенты пользуются и несколькими десктоп приложениями, и веб приложением, и даже API. Про такое в книжках уже не пишут.

В результате мы сегодня автоматически поймали аутедж одного из наших партнеров до того, как наши клиенты это заметили. При этом наш партнер его сам даже не успел заметить 💪

Observability нового уровня.
Все мы видели страницы со стасусами, где продукты отчитываются какие они доступные и зеленые.
Работают они обычно через HTTP хелс чеки | Сетка — социальная сеть от hh.ru