SRE/DevOps (удаленно). 14 лет в IT. Последние 3+ года - на страже uptime. Был по обе стороны инфраструктуры: поднял 50+ серверов с нуля, потом держал прод в МосБирже и X5 Tech. Знаю, как пахнет ночной инцидент в 3 часа, и как сделать так, чтобы он не повторился. Люблю, когда: алерты не врут (сократил шум на 60%) есть runbook, а не «спроси у Васи» инфраструктура описана кодом, а не живёт в голове Linux, Kubernetes, Ansible, Prometheus/Grafana, ELK, Kafka, Gravitee IO, Python. Дежурства не пугают.
Ищу команду, где надёжность - не галочка, а культура. За мной - проверяемые цифры и стек, а ещё умение разобрать инцидент послойно, от сети до приложения, и довести до пост-мортема