14 лет в IT научили меня одному: инфраструктура не должна держаться на одном человеке, который «всё знает». Ищу роль SRE/DevOps Middle/+ на удалёнке - туда, где важно выстроить процессы, а не быть вечным пожарником. Делаю надёжность измеримой: SLI/SLO, error budget, FinOps-метрики - чтобы улучшения приоритезировались по влиянию на бизнес, а не по тому, кто громче стукнул по столу. Это снижает риски внеплановых трат и помогает пережить пиковые сезоны без ночных подвигов. Не падаю в обморок при общении со смежными командами и бизнесом. Оказываю поддержку команд и создаю понятные бизнесу дашборды с описанием метрик и полной документацией в Confluence. Что я приношу в команду: K8s и GitOps : Kubernetes, ArgoCD, Helm, диагностика подов и ресурсов, OOM, лимиты. Git как источник истины, без ручных правок «на горячую». CI/CD : GitLab CI, Jenkins, Bitbucket. Пайплайны от сборки до production, с rollback-стратегиями. Автоматизация : Ansible, Terraform, Python, Bash. Воспроизводимые конфигурации, скрипты для валидаций и интеграций. Снижение конфигурационного дрейфа не лозунг, а результат. Наблюдаемость : Prometheus, Grafana, Zabbix, ELK/OpenSearch, Zipkin, Alertmanager. Golden Signals, RED/USE. Алертинг, который не бесит: сократил ложные срабатывания и MTTR - через runbook'и, blameless postmortem и формализацию сценариев диагностики. Linux и сеть : Debian, CentOS, RedOS, Windows Server. Глубокая диагностика: от этапов загрузки ОС до сетевых протоколов. Балансировка через HAProxy и Nginx. Секреты : HashiCorp Vault, RBAC в K8s. Базы данных : кластеры и патчинг не моё, но PostgreSQL, Patroni, pgBouncer, Redis, Kafka, RabbitMQ встраиваю в платформу: мониторинг, CI/CD, наблюдаемость. Также работал с Gravitee (API-шлюз), VMware, Docker/Docker Compose, MS SQL.