Когда в клиента — банк из Топ-10 — летит многовекторный DDoS на 2 Тбит/с, разбираюсь с этим я: по трафику и логам в реальном времени, а не наугад.
DevOps / SRE / Incident Response. За плечами:
— поднял отдел мониторинга с нуля: процессы, команда, режим 24/7/365. MTTR упал с нескольких дней до минут; — observability на Zabbix + ClickHouse, Prometheus/Grafana — метрики, алерты, дашборды и SQL-аналитика по access-логам прямо в момент атаки; — автоматизация на Python / Bash / Ansible: парсеры логов, поиск аномалий и сканеров, внутренний сервис мониторинга 5xx с алертами в Telegram — команда пользуется им каждый день; — anti-bot: пайплайн корреляции TLS↔HTTP на tshark + Python, детект ботнетов по JA3/JA4, BPF-сигнатуры для scrubbing-центра.
Прошёл путь от L1-поддержки до ведущего инженера, держу в голове стек от L3 до L7 и от железа до LLM-сервисов. Вечером собираю похожее в своём homelab на Proxmox — потому что мне это правда нравится.
Что важно: меньше ручной рутины, ниже MTTR, выше надёжность. Люблю инциденты, где надо думать, а не просто перезапустить сервис.
Ищу DevOps / SRE / Incident Response — удалёнка или гибрид, открыт к релокации. Резюме приложил, детали — в личку.